机器人运动会把家务打成300分,遥操作只算一半

8月22日开幕的第二届世界人形机器人运动会,把比赛搬进了真的酒店房间和真的公寓。家庭赛满分300分,客厅75、叠衣服100、洗晾125。只要有人伸手介入,整轮按遥操作结算,系数从1降到0.5。

机器人运动会把家务打成300分,遥操作只算一半

8 月 23 日,新华社把一段画面写进了通稿:临时搭出来的餐厅里,一台人形机器人用夹子夹起一份小食,放进微波炉,转动定时旋钮,然后转身去接下一单。裁判在旁边看着打分。

第二届世界人形机器人运动会 8 月 22 日晚在国家速滑馆开幕,赛程排到 26 日。666 支队伍、2056 台机器人,来自 16 个国家和地区,参赛队数是去年首届的四倍。项目从 26 项加到 51 项,场次从 487 场涨到 1301 场。

新加进去的东西里,最该看的是 21 个场景赛。

300 分是怎么切开的

家庭赛第一次办,场地放在北京一处叫 Habit@ 的智能公寓,38 支队伍进场。满分 300 分,切成三块:客厅整理 75 分,卧室叠衣服 100 分,浴室和阳台洗衣晾衣 125 分。

中途还塞了一个计划外任务。语音提示一响,机器人要停下手里的活,去把快递拿进来,再回来接着做原来那件事。撞到东西、掉了东西、越出边界,都扣分。

酒店赛更早两天,摆在北京五洲大酒店的真房间里。十几支队伍,每台 30 分钟,要把不同尺寸的行李推进指定房间,补齐毛巾、拖鞋和瓶装水,撤掉脏床品,再把床铺好。负责这个项目的李子叶说,在规定时间内做完本身拿不到高分,铺得整不整齐要单独打分。

同一天还有图书馆赛。真图书馆,30 分钟,收回还书、上架、把放错位置的书归位。考的是精度、视觉识别和推理这三样。

餐厅赛的细节最能说明这套评分表的刻度:微波炉定时要拧到 5 分钟,误差超过 1 分钟就扣分;送饮料的路上洒出来太多,也扣。

还有一个专门的灵巧手项目,八项微操作:电动工具装配、镊子夹豆、粉末称重、撬瓶盖、接柔性线缆。今年 1 月从智元拆分出来的 AGILINK 对《环球时报》说,拿下灵巧手比赛等于给产品做了一次能力认证,意味着它过了「演示级」这道门槛。

真正定调子的是那个 0.5

所有场景赛都设两种模式。全自主运行,系数记 1;遥操作,系数记 0.5。家庭赛把这条写得更死:只要有人伸手介入,整轮直接按遥操作结算。

径赛那边的规则同样值得记一笔。除了 100 米和 400 米栏,运动会所有径赛和竞技项目都要求全自主。

行业分析师刘丁丁把这条规则的含义讲得很直白:遥操作意味着到了落地那一步,旁边还得再配一个人操作和照看,机器人实际上已经把它本该带来的价值丢掉了。

这是一句会计口径上的话,不是技术评论。一台需要遥操作员的机器人,没有省掉一个岗位,只是把岗位从酒店客房挪到了控制台前面。折半计分是主办方对这件事的明码标价。同一件活干完,自主完成值两倍。

这 21 个场景摊开就是一张岗位表

北京市经信局副局长刘为亮说,项目不是拍脑袋定的,是先去商业服务、园林巡检、应急救援这些行业问过一圈才设计出来的。超市那一项直接照搬了夜班员工的活:补货、打包线上订单、把顾客随手放错的商品归位。

把 21 个场景摊开,对应的岗位很具体:酒店客房服务员和行李员、餐厅后厨和传菜、超市夜班理货、图书馆流通台、家政、园林巡检、应急救援。全是那种重复、费体力、脏、危险或者难做的活——这也是主办方自己给的筛选口径。

这里有个跟我们此前观察对得上的地方。8 月 11 日我们写过三家整车厂的人形机器人都在分拣零件:宝马用 Figure,现代自己拥有波士顿动力,奔驰在测 Apptronik,第一个任务全是 kitting。工厂那边收敛到一件活,服务业这边一次铺开 21 个场景。看着相反,其实是同一件事的两头。工厂只肯把最容易的那件活交出去;运动会则是在把服务业还没交出去的活,一件一件搭成考场。

X-Humanoid 的天轶 2.0 参加了全部场景赛。这台轮式机器人躯干能在 130 厘米到 165 厘米之间升降,一次充电跑两个多小时——够一台机器同时够到毛巾架和床头柜。这家公司把四台机器人铺进了运动会大约 40 个项目。

躯干升降这个设计说明了一件事:服务业的物理约束不在算法里,在家具高度里。

奖牌什么时候变成订单

北京市经信局局长姜广智给了官方的时间路径:很多比赛规则预计会沉淀成技术标准。他的原话是,一旦机器人掌握这些「最后一米」的技能,奖牌就能变成订单,可以从赛场直接走进真实工作场景。

刘为亮补了一句更实在的:每完成一个任务,实际上就是一次真实场景的试运行,赛后不需要再重建同样的测试环境,场上的表现本身就是商业可行性的证据。

宇树创始人王兴兴在同一周给了另一半答案,而且是往下压的那一半。他说泛化能力是全球人形机器人行业当前最大的瓶颈。在受控环境里,数据喂够的模型能把任务成功率做到接近 100%;一旦被操作的物体或者周围环境变了,成功率会掉得很快。他给「具身智能的 ChatGPT 时刻」定了个门槛:把机器人扔进一个陌生环境,用一句话或者一行字指令,它能完成大约 80% 的日常任务。快的话两三年,慢的话五到十年。

酒店房间正好是这个瓶颈的标准考题。李子叶列过一间正在营业的楼里会扔给机器什么:非结构化空间、会变形的软物、装满东西不好平衡的推车,还有一条长到足以暴露任何不稳定的任务链。人民大学和 X-Humanoid 联队的张翼卓说得更土:走廊窄,推行李就成了在狭小空间里的操控考试。

对岗位意味着什么

三条时间线,不一样长。

灵巧手那八项,最短。 电动工具装配、粉末称重、接线缆,这些是工位级的动作,环境高度可控,正好落在王兴兴说的「受控环境接近 100%」那一档。8 月 21 日我们写过中国已经建了 70 个具身智能训练场,86% 面向制造业,训练场的存在意味着这类动作有稳定的数据来源。制造业里的重复装配岗位,压力最先到。

酒店、超市、图书馆这一档,中等。 环境半结构化:房型有限,货架固定,书有编号。但物体会变形、会被顾客挪位置。这一档的关键变量不是机器人能不能做,而是那个 0.5 什么时候变成 1。在此之前,酒店买的是一台机器加一个远程操作员,账算不过来。

家政那一档,最长。 300 分里有 125 分给洗衣晾衣,再加一个随机打断的取快递任务,这是主办方自己承认最难的部分。家庭环境每一户都不一样,正是泛化能力最吃紧的地方。

值得单独盯的是第三类岗位:遥操作员本身。折半计分是在给这个岗位定价,而且定的是负价。行业越是往自主走,这个岗位越短命;但在走到之前,它是真实存在的雇佣需求。我们在京东开出 10 万个机器人服务工程师岗位那篇里写过同一个结构:机器人铺开的第一阶段,创造的是围着机器转的人力需求。

赛程 26 日结束。到时候值得看的不是谁拿了奖牌,是场景赛里有多少轮是按系数 1 结算的。那个比例,比任何一块金牌都更接近岗位表上的答案。

资料来源

继续读

特斯拉 Cybercab 奥斯汀首发,车内彻底拿掉方向盘 机器人

特斯拉 Cybercab 奥斯汀首发,车内彻底拿掉方向盘

9月3日,特斯拉在奥斯汀正式推出 Cybercab:两座、没有方向盘、没有踏板,人在车里连接管的物理条件都不存在。得州自动驾驶车登记总数当天报到420辆,而特斯拉自己今年7月才承认,付费载客里程数字是「倒退」而不是增长。

#tesla#waymo#robotaxi
机器人在三菱产线跑满一千小时,三菱接着领投 机器人

机器人在三菱产线跑满一千小时,三菱接着领投

9 月 1 日,Lumos Robotics 发布轮式双臂机器人 MOS 2。上一代机器在三菱电机常熟工厂连续无故障运行超过 1,000 小时,三菱随后领投了它的 A1、A2 轮。创始人的说法是:「跳舞、跑步、后空翻证明不了工业价值。」

#lumos-robotics#mitsubishi-electric#humanoid-robots