NEWS CENTER
THE LATEST ADVICE ON THE INDUSTRIAL DESIGN INDUSTRY
1000万小时、3000个SKU、99%成功率——具身智能的数据账本是怎么算的
阅读:12   更新时间:2026-07-20 10:34:29
在WAIC 2026现场,一个容易被展台表演和机器人舞蹈掩盖的关键数字是:智元今年的数据采集目标,是近1000万小时。

1000万小时是什么概念?如果一台机器人每天24小时不间断地采集数据,需要1141年。智元当然不是靠一台机器人——他们在展馆部署了60台机器人做导览等公共服务,每一台都在"干活"的同时采集数据。干活,和积累干活的能力,目前还是一枚硬币的两面。

普渡的数据更惊人。它的类人形机器人PUDU D7,背后是13万台在役机器人每年产生的5000万小时真实数据。这些数据来自餐厅里端盘子、酒店里送物品、医院里运药品的真实场景中产生的真实数据。真实数据的价值,比仿真数据高得多——因为真实世界充满了实验室里永远不会出现的意外:餐厅的地面可能刚拖过有点滑,酒店的走廊可能被清洁车挡了一半,医院的电梯可能临时维修。

具身智能的核心瓶颈,正在从"算法"转向"数据"。算法已经能跑通很多任务,但跑通一次和稳定跑通一万次之间的差距,核心在于更多的训练数据,算法优化只是其中一环。而数据采集,本身就是一个工业设计问题。

第一个设计挑战,是数据质量和数量的矛盾。理论上,数据越多越好。但现实中,数据采集是有成本的——采集设备、人工操作、标注校对,每一项都要花钱。如果采集到的数据质量不高——比如传感器精度不够、动作标注不准确、场景覆盖不全面——那数量再多也训练不出好模型。如何在有限的采集预算内,最大化数据的"有效信息密度",是数据采集系统设计的核心命题。

大晓机器人在WAIC上发布的开悟世界模型Kairos,走的是"仿真+真实"的混合路线。世界模型可以在虚拟环境中生成大量训练数据,成本低、速度快,但仿真数据和真实数据之间始终存在"域差距"——仿真环境里没有真实世界的摩擦力、碰撞噪声、光照变化。Kairos的策略是:用仿真数据做预训练,用真实数据做微调。这种"仿真打底、真实校准"的策略,在数据效率和训练效果之间找到了一个平衡点。

从创品工业设计五维框架的"专利维"来看,数据采集系统涉及的核心技术——传感器标定、数据同步、动作捕捉、场景重建——每一样都有技术壁垒。大晓机器人从商汤"1+X"拆分出来,不做本体,专做模型与数据,天使轮由蚂蚁集团领投,上半年累计融资数亿美元。资本愿意为"数据采集和训练基础设施"这个赛道砸钱,说明市场已经意识到:具身智能的竞争,核心在于谁有更好的数据,而非谁做出了更酷的机器人。

第二个设计挑战,是端侧推理和云端训练的平衡。面壁智能在WAIC上发布的MiniCPM-Robot,选择了一条与众不同的路线:纯端侧离线。数据全程本地处理,不上传云端。这个选择的优势是隐私安全和低延迟——不需要网络连接,不需要等待云端响应,机器人可以在没有信号的工厂车间或地下管廊里自主运行。但代价是端侧算力有限,模型规模受限,训练数据不能实时汇聚到云端进行全局优化。

在"合规维"上,端侧方案的数据隐私优势是显著的。在医疗、金融、军工等对数据安全有严格要求的场景中,端侧离线是刚需。但端侧离线不等于"不需要训练数据"——它只是把训练数据的采集和使用,从"云端集中式"变成了"端侧分布式"。每一台在端侧运行的机器人,都需要在本地积累自己的训练数据,但不同机器人之间的数据无法共享,导致整体学习效率下降。如何在端侧隐私和云端协同之间找到平衡,是数据架构设计的一个核心问题。

第三个设计挑战,是数据采集的"场景覆盖度"。智元1000万小时的数据目标,不是随便采集的——它需要覆盖尽可能多的场景、动作、物体、环境。洗手间里捡起掉落的牙刷、厨房里从冰箱取出鸡蛋、办公室里从抽屉里拿文件夹——每一个场景的数据采集,都需要专门设计采集方案。采集方案的设计,涉及场景搭建、物体选择、动作定义、传感器配置、数据标注标准,每一个环节都需要工业设计思维的介入。

在创品工业设计四力框架的"创新力"维度上,数据采集方案的创新,体现在"用更少的采集成本获取更多的有效数据"。普渡的5000万小时真实数据,靠的是"一脑多形"的架构设计,而非"多装传感器"堆出来的——全球13万台机器人在不同场景中运行,产生的数据天然具有场景多样性。这种"用运营规模置换数据采集成本"的策略,是数据驱动产品设计中最聪明的做法。

在"成本维"上,数据采集的成本结构决定了具身智能公司的商业模式。如果一个公司需要花1亿元来采集训练数据,然后训练出一个能卖1000万元的机器人,这个商业模式显然不可持续。合理的逻辑是:训练数据采集的成本,应该通过规模化量产来分摊——卖出去的机器人越多,每台机器人分摊的数据采集成本越低。智元联合擎天租在展馆部署60台机器人,本质上是在"以展促采"——用展会场景来采集真实的公共服务数据,而这些数据的采集成本,被展会的营销价值部分覆盖了。

在"量产维"上,数据采集设备本身的量产能力,也是一个设计问题。高精度数据采集手套、动作捕捉系统、多视角摄像头阵列——这些设备如果只能小批量手工生产,就会成为整个数据采集流程的瓶颈。面壁智能选择与乐聚合作做纯端侧离线的导览Agent和巡检系统,一个隐含的逻辑是:乐聚已经建立了量产能力,面壁的模型可以借助乐聚的硬件快速铺开,而铺开的每一台设备都在采集数据反哺模型。

诺曼在《设计心理学》中讨论过"知识在头脑中"和"知识在世界中"的区分。一个熟练的装配工人,知道怎么拧螺丝不会滑丝、怎么插接口不会卡住、怎么判断一个零件装得到不到位——这些知识在他的"头脑中",是隐性的、难以言传的。数据采集系统的作用,就是把这些"在头脑中"的隐性知识,转化为"在世界中"的显性数据——记录下来,让机器人能通过学习这些数据来获得同样的能力。这个转化的效率,决定了具身智能的进化速度。

合肥拥有中科院、中国科学技术大学等一批在人工智能和机器人方向上有深厚积累的机构,在具身智能数据采集和训练领域,有着天然的人才和科研优势。1000万小时、3000个SKU、99%成功率——这些数字背后,是数据采集系统设计、训练基础设施建设的系统工程。具身智能的竞争,已经进入了"拼数据"的阶段,而数据采集系统的设计质量,决定了谁能在这场竞争中跑得更快。
已累计预约 5360
  • 手机号 预约成功
  • 手机号 预约成功
  • 手机号 预约成功
  • 手机号 预约成功
  • 手机号 预约成功
  • 手机号 预约成功
  • 手机号 预约成功
  • 手机号 预约成功
  • 手机号 预约成功