周六就要开赛的 WHRG'26,人形机器人终于要正面硬刚了
图里能认出来的:Unitree H1、Figure 02、Apollo、Digit、GR-1,甚至还有俩没贴 Logo 的原型机,肩膀上焊着激光雷达支架,一看就是临时改装上场的。主办方只透露了三个大项:移动操作、动态平衡、自主导航,每项 20 分钟,不插电、不外挂算力、全程自主。这规则一出,直接把「视频里跑得飞快、实测掉电秒趴」那批选手过滤掉了。
最有看头的是移动操作。按规则,机器人要在 10×10 米场地里,按随机生成的指令完成「搬运→组装→检测」全流程,中间随机插入干扰:地面铺泡沫砖、挂绳子、甚至有志愿者故意撞一下。Figure 团队上周在自家 Discord 透露,他们把 02 的手腕力矩传感器采样率从 1kHz 干到了 4kHz,专门为应对「被撞后仍能抓稳工件」这类边缘情况。Unitree 那边更狠,H1 的腿部关节把峰值扭矩密度推到 360 Nm/kg,官方视频里单腿跳箱子高度 0.85 米,落地膝盖不锁死、直接衔接下一步——这要是比赛现场复现,动态平衡项基本稳拿满分。
但我更担心自主导航。去年 DARPA SubT 决赛,最强的四足狗在无 GPS 隧道里也会迷路;人形机器人重心高、视野盲区大、双足接地不稳,SLAM 漂移一旦累积,直接摔成散件。GR-1 团队说他们上了「视觉-惯性-足底压力」三模态融合,闭环延迟压到 8 ms 以内,但实测能不能扛住比赛现场的强光、烟雾、人群遮挡,周六见分晓。
有个细节挺有意思:报名截止前三天,主办方突然补了条「不允许使用云端大模型推理」的补充条款。意思很明显——别指望把 70B 参数模型扔云上、靠 5G 低延迟回传动作,必须全栈上车。这直接把几家主打「云端大脑+本地躯干」架构的初创公司卡死了。我在群里看到某队领队发语音抱怨:「模型蒸馏到 Jetson Orin 上推理延迟 120 ms,配合整体控制回路 200 Hz,相位滞后根本稳不住。」最后他们连夜把视觉语言模型从 7B 裁到 1.5B,量化 INT4,勉强卡进 30 ms 预算。
周六上午十点开赛,官方说会在 YouTube 同步直播,延迟 30 秒。要是真按规则跑完全程、不插电、不外挂、不人工接管,哪怕只有一台机器人把三项都跑完,也是人形机器人从「实验室演示」走向「工程交付」的里程碑。我会守着直播熬夜,顺便录屏留证——万一真有队伍翻车现场拆机修电机,那画面比任何发布会都真实。