讲师中心 微信公众号
AI工具推荐 视频效率加速

我给机器人当“燃料”:叠衣服时薪30元,卖数据估值150亿

浅杰大大_1557

浅杰大大_1557

发布时间:2026-07-13 14:10:03

|

419人浏览过

|

来源于php中文网

原创

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

我给机器人当“燃料”:叠衣服时薪30元,卖数据估值150亿

具身智能面临海量数据需求,一条隐蔽却高速运转的数据供应链正悄然崛起。

社交平台中,“具身智能数据采集员”“机器人行为数据采集”等岗位招聘信息频繁刷屏,日薪标价240元起。应聘者佩戴多角度传感设备,在家庭、街道、商场等真实环境中反复执行叠衣、系鞋带、开柜门、取快递等日常动作。这些看似平凡的动作被系统记录、清洗、标注后,被打包为结构化训练样本,成为喂养AI机器人的“数字养料”,最终输送至各大具身智能研发企业。

而产业链上游,则是另一番火热景象:一家估值突破150亿元的数据服务商,在短短两周内完成两轮合计20亿元融资;过去一年,行业部分资本正加速向“不造机器人、专供数据”的企业倾斜。

当硬件厂商仍在持续投入巨额研发成本时,数据服务商已率先实现商业化变现——有公司单季度签约额达5.5亿元,甚至超过去年全年总和。

在家叠被子、在超市理货,我成了机器人的“低成本训练素材”

张月每天清晨8点准时打卡上岗。她的工作内容表面简单:系鞋带、扫地、叠被子……但实操过程远非家务劳动可比。她需严格模拟机器人动作逻辑,身体上可同时佩戴5个摄像头或1台运动相机,每个关节转动、每次抬手高度、每一步移动轨迹都被毫秒级捕捉。

这类从业者被业内称为“具身智能数据采集员”或“机器人行为示范员”,他们通过真人示范或远程操控机器人,在真实物理环境中采集人类操作行为数据,用于训练机器人理解并复现日常生活及工业场景中的复杂动作。

在苏州,像张月这样的居家采集员日薪为250元。新人按出勤时间结算,工作时段为早8点至晚8点,但她坦言:“真正能稳定采集的有效时长只有6小时左右。”原因在于设备稳定性极差——U盘读取失败、传感器失联、镜头偏移、主机过热等问题频发,严重影响录制连续性。

按企业要求,采集员每日需往返公司交接U盘与设备。张月告诉Tech星球:“设备好坏全靠运气。有时拿到的是调试好的,有时一整天都在修——录着录着突然断电,传感器罢工,U盘识别不了,镜头歪了自己都发现不了。”

最耗时的环节还属穿戴调试:全身5个摄像头必须逐一校准角度,张月每次穿戴就要花半小时。“连挠痒痒都不允许,中途可以脱设备,但再穿一次又得半小时。”她说。

相较室外采集,居家场景对有效时长要求更高:室外只需满6小时,居家则必须达标8小时。这意味着即便设备频频掉链子,她也得争分夺秒抢出“黄金拍摄窗口”。

所有采集视频经后台质检合格后,将被打包售予全国多家机器人企业。“都是大厂下定制需求,指定要哪个场景,我们就拍哪个。”张月表示,“招人全是中介,我们只管拍,拍完合格的数据就归他们所有,直接变成模型训练用的原始素材。”

而在户外场景中,王雷的工作流程略有不同。尽管日薪同为250元,但他所在团队配有专职巡检人员负责设备调试与配送,采集员只需专注拍摄任务,且场地周期性轮换。此前他在家附近三百米的超市采集,如今已被调往十公里外的汽修厂。

这些合作场地均由企业业务员实地洽谈,覆盖超市、快递驿站、物流中转站、制造工厂、汽修车间、酒店、餐饮门店等多种真实环境。

据张月介绍,她入职前经历了统一岗前培训,内容集中在设备穿戴规范与基础操作流程。同期参训者多为二十岁出头的年轻人,也有不少在校大学生。该公司所有岗位均为兼职性质,包括采集员、巡检员、业务拓展员等;其中薪资最高的是“视频质检员”,即在办公室审核采集视频质量的岗位,月薪可达万元之上。

相比基础采集岗,猎聘等平台显示,具备技术背景或需驻场支持的数据采集相关职位,月薪普遍在8000–15000元之间;资深工程师或管理类岗位则可达2万元以上。

小陈的身份则是“真机遥操作员”,工作地点设在某互联网大厂自建的专业数据采集中心。他每天坐在操作台前,通过远程界面控制机械臂完成指令序列:例如按顺序用左右手拾取三件物品,并准确投入垃圾桶。

他选择夜班制,日薪370元。任务本身并无技术门槛,类似标准化流水线作业,但自由度更高。“中间休息时看看世界杯,赚完300块回宿舍睡觉。”小陈说。

据他透露,岗位准入门槛较低,但存在隐性年龄筛选机制——与其共事的外包员工基本都在25岁以下。他曾目睹一位37岁女性入职首日便离职,“第一天大概走掉六七成,很多人觉得太重复、太枯燥,根本干不下去”。

虽然甲方是头部互联网企业,但整套数据采集业务由多家第三方承包商承接,小陈签署的均为外包协议。最近他休整了一周,因上一个项目临时终止,正等待新任务启动。不过他对这种不确定性并不焦虑:“做兼职,这已经算不错的选择了。”

处于产业链最底层的“原子级数据”,中间商加价超10倍转售

具身智能数据采集员如同精密产线上的“原子单元”,一个基础动作往往被重复采集数百乃至上千次,只为让人形机器人学会如何自然地叠一件衬衫、打开一扇柜门。

其背后是严重失衡的供需关系。行业测算显示,要训练出接近人类认知与操作能力的机器人“大脑”,至少需要10亿小时的真实交互数据;而当前全球可用的有效数据总量仅约500万小时,缺口高达200倍。

张月这类居家采集员岗位爆发式增长,一方面源于实验室与工厂环境无法覆盖家庭、商超等真实生活空间,必须依靠真人进入毛细血管级场景完成行为采集;另一方面,“无本体采集”模式(即发放设备让兼职人员在家自主采集)相比动辄百万级投入的“真机遥操作”,大幅降低了数据获取门槛与边际成本。

不同于大语言模型可从互联网文本中汲取海量语料,机器人所需的三维动作数据必须来自真实世界——“拿、放、走、抓、避障、操作”等行为涉及力觉、视觉、空间感知多重模态,采集难度高、泛化门槛严,业内已将2026年定义为“具身智能数据元年”。

目前主流数据来源分为三类,构成典型的金字塔结构:塔尖为真机数据,即员工借助VR设备、外骨骼或远程接口操控实体机器人,同步记录动作轨迹与力反馈信息,精度最高、成本最贵,却是人形机器人落地的核心支撑;中部为仿真数据,依托虚拟引擎批量生成交互行为,成本低、可规模化,用于填补真机数据缺口;底层则是互联网公开视频、人类行为录像等泛化性强但精度有限的数据源。

居家采集员,几乎位于整个数据价值链的最末端。同一组原始数据,在流通链条中价值层层跃升:采集端支付给张月、王雷等人的成本约为30元/小时;中间商封装处理后,以300–500元/小时价格售予机器人厂商;越靠近下游应用层,利润空间越厚,企业估值也水涨船高。

此外,当前市场明显呈现供不应求的卖方格局,数据稀缺性进一步推高定价天花板。

据澎湃新闻报道,当前具身智能数据整体报价区间为200–500元/小时,其中真机数据单价最高,达500–1000元/小时。

今年4月,觅蜂科技CEO姚卯青曾指出,在具身智能尚未大规模商用前,数据作为底层基础设施,将比终端产品更早实现商业闭环。他还预判:脱离特定机器人本体的无本体采集数据,长期价格将稳定在真机数据的三分之一至二分之一区间。例如若真机数据售价1000元/小时,无本体数据有望锚定于300–400元/小时。

机器人厂商反哺数据服务商,谁才是真正“现金牛”

随着市场需求井喷、竞争白热化,居家采集员的单位报酬持续承压下滑;与此同时,“卖铲子”与“供水”的数据服务商估值却一路狂飙。

第一类为独立第三方数据服务商,代表企业如光轮智能。该公司成立于2023年1月,当前估值已超150亿元,近期更在两周内完成两轮融资总计20亿元,估值甚至超越部分一线机器人整机厂商。

其核心盈利逻辑在于“数据资产复用”:一套高质量采集数据经标准化加工后,可打包为通用型产品,同步销售给智元、银河通用等多家头部客户;优质场景数据复购率可达10倍以上。这意味着采集成本一次性支出,而数据资产可无限次货币化。2026年第一季度,光轮智能新增订单金额达5.5亿元,超过2025年全年总额。

第二类为机器人厂商孵化的数据子公司。例如2026年2月,智元机器人内部拆分成立觅蜂科技,创始人姚卯青透露,当前数据采购方主要集中于大模型团队、国内外科技巨头及初创机器人公司,采购节奏呈现“有多少收多少、随时要随时发”的紧迫态势。

觅蜂科技采取激进策略,避开高成本真机路径,自主研发MEgo系列无本体采集硬件,既对外销售设备,也利用自有采集网络生产数据,构建“硬件销售+数据服务”双引擎盈利模式,目标是在2026年内建成千万小时级真实数据产能。

冲刺IPO的宇树科技也在招股书中坦承:前期研发投入聚焦于机器人本体与运动控制系统(“小脑”),在具身大模型(“大脑”)层面布局薄弱,亦未系统开展大规模真实数据采集与工厂级训练部署。为此,公司计划将20.22亿元募集资金(占募资总额近半)投向智能机器人模型研发项目,其中关键任务正是“构建超大规模真实世界数据集”,再次印证数据已成为具身智能时代最具战略价值的基础设施。

第三类玩家是拥有场景优势的互联网大厂。今年3月,京东宣布启动具身智能数据采集中心,动员内部超10万名员工及外部最多50万名跨行业从业者参与,目标两年内积累1000万小时人类行为视频数据;百度则推出“具身智能数据超市”,建立多层级标签体系,整合多方数据资源。

一级市场对具身智能核心零部件与数据基建的关注度同步升温。Tech星球统计显示,自2025年11月至2026年7月,简智机器人、弈人科技、鹿明机器人、光轮智能、无问智科、千寻智能等十余家企业陆续完成融资,金额从数千万元至数亿元不等。其中简智机器人于2025年7月成立后,4个月内密集完成三轮融资,成立仅5个月即获蚂蚁集团、滴滴出行、德联资本联合领投。

这场围绕具身数据的产业化掘金浪潮,才刚刚启幕。

(备注:文中张月、王雷、小陈为化名。)

本文来自微信公众号“Tech星球”(ID:tech618),作者:林京,36氪经授权发布。

热门AI工具

更多
SkildArt
SkildArt Hot

SkildArt是一款AI文本写作工具,一站式 AI 视觉创作平台。

咔片AIPPT

一款在线AI演示文稿制作工具,可根据主题和内容需求辅助生成PPT结构与页面,提高演示材料制作效率。

Laper
Laper Hot

Laper是专为编剧、导演和制片人推出的 AI 原生剧本创作工具。

讯飞智作

讯飞智作是一款AI视频创作工具,AI文本配音工具,数字人课程、营销视频制作。

音述AI
音述AI Hot

一款AI音频处理工具,主要用于音述AI是一个以“用声音述说故事”为核心的 AI 音乐创作与声音分享社区,适合需要提升相关任务效率的用户。

豆包大模型

豆包大模型是一款由字节跳动推出的企业级大语言模型服务平台。

WorkBuddy

一款AI办公效率工具,主要用于腾讯云推出的AI原生桌面智能体工作台,适合需要提升相关任务效率的用户。

LibLibAI
LibLibAI Hot

一款AI视频创作工具,主要用于国内领先的AI创意平台,以海量模型、低门槛操作与“创作-分享-商业化”生态,让小白与专业创作者都能高效实现图文乃至视频创意表达,适合需要提升相关任务效率的用户。

DeepSeek

DeepSeek是一款面向对话、写作、编程和推理场景的AI大模型工具。

相关专题

更多
Buffalo框架数据库开发全教程
Buffalo框架数据库开发全教程

本专题围绕Buffalo框架数据库开发,讲解database.yml多环境配置、soda与fizz迁移生成回滚、模型结构体标签、增删改查与条件查询、一对多与多对多关联、数据校验、回调钩子、事务处理及原生SQL执行能力。

160

2026.09.23

Buffalo框架路由与请求处理实操指南
Buffalo框架路由与请求处理实操指南

本专题讲解Buffalo框架路由与请求处理机制,涵盖路由注册与分组、资源路由、Handler编写规范、Context上下文方法、参数绑定、中间件编写挂载、Session与Cookie读写、Flash消息及错误页面定制方法。

80

2026.09.23

Buffalo框架零基础入门教程
Buffalo框架零基础入门教程

本专题整理Buffalo框架入门内容,涵盖Go环境准备、buffalo CLI安装、新项目生成、目录结构说明、dev热加载启动、数据库连接配置与常见报错排查,帮助新手按约定优于配置的思路跑通第一个Buffalo框架应用。

80

2026.09.23

Conan创建软件包配方指南
Conan创建软件包配方指南

本专题介绍通过conanfile.py创建软件包的方法,讲解包名、版本、依赖和构建设置等基础信息,以及source、build、package、package_info等常用方法的作用及编写思路。

40

2026.09.22

Conan二进制包配置指南
Conan二进制包配置指南

本专题介绍Conan根据操作系统、编译器、架构和构建类型生成二进制包的方法,讲解Profile、Settings、Options及Package ID的作用,帮助管理不同平台和编译环境下的包版本。

60

2026.09.22

Conan私有仓库搭建教程
Conan私有仓库搭建教程

本专题系统的讲解Conan私有仓库的搭建流程,涵盖仓库服务部署、存储目录配置、用户认证、权限划分和远程地址添加,并介绍内部C++依赖包的上传、下载及版本维护方法。

60

2026.09.22

loomy官网入口地址合集
loomy官网入口地址合集

本专题汇总了 Loomy 桌面 AI 助理的官方入口地址合集及使用指南。提供 macOS 与 Windows 客户端下载 。Loomy 是讯飞推出的桌面级 AI 工作搭子,支持文件整理、数据分析、网页操作及通过飞书/钉钉远程操控电脑,助你高效完成本地办公任务 。

60

2026.09.22

NumPy常见函数使用方法
NumPy常见函数使用方法

本专题整理 NumPy 常见函数使用方法相关教程,覆盖函数大全、参数用法、数组运算、统计聚合、排序处理、where 条件筛选、linspace 创建数列等常用场景,帮助读者快速掌握 NumPy 函数调用思路和实际数据处理技巧。

80

2026.09.22

NumPy性能优化版本更新与常见报错排查
NumPy性能优化版本更新与常见报错排查

本专题整理 NumPy 性能优化、版本更新与常见报错排查相关教程,覆盖向量化计算、广播性能、内存布局、NumPy 2.0 升级、版本兼容冲突、安装导入报错、dtype 溢出、矩阵运算异常和 broadcasting 报错修复,帮助读者系统掌握 NumPy 性能调优与问题定位方法。

80

2026.09.22

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
极致CMS零基础建站教学视频
极致CMS零基础建站教学视频

共62课时 | 9.2万人学习

oracle基础视频教程
oracle基础视频教程

共31课时 | 7.8万人学习

淘宝开放平台开发文档
淘宝开放平台开发文档

共92课时 | 95.9万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn