“捂脸跑”机器人天工夺冠,研发团队揭秘:自主迭代优化跑姿
2026-08-24 08:04:52未知 作者:徽声在线
据徽声在线8月23日报道,在第二届世界人形机器人运动会400米(小型组)决赛中,一款名为天工的机器人凭借独特的“捂脸跑”姿态,以45.66秒的优异成绩夺得冠军,引发了广泛关注。
赛后,徽声在线记者对天工Omni 400米小型组的研发团队负责人、北京人形机器人创新中心运动控制算法专家韩刚进行了专访。韩刚明确表示,天工的跑姿并非模仿某位“小姑娘”,而是其自主迭代优化的结果。
“我们最初设计的是标准的百米跑步模式,但天工是在仿真环境中通过大量数据迭代学习而来的。在学习过程中,它可能发现‘捂脸跑’比传统的摆臂跑更加舒适,因此逐渐形成了这种独特的跑姿。”韩刚解释道,这相当于机器人自己做出了决策。
天工Omni以“捂脸跑”姿态完赛,成为赛场焦点
韩刚进一步澄清,团队并未特意让天工模仿“小姑娘”的跑姿。实际上,由于天工的身体结构与人类相似,因此其跑姿自然地呈现出与人类相似的风格,尤其是与小姑娘的跑步姿态颇为相似。
对于“捂脸跑”的优势,韩刚指出,摆臂动作会迅速增加肩部负载,导致发热风险上升。而“捂脸跑”则有效规避了这些问题,同时还对提升速度产生了一定帮助。
那么,机器人是如何进行思考并做出决策的呢?韩刚用教育小朋友作比喻:“在仿真环境中,我们会设定一些大方向的目标,比如速度、发热等。但具体如何实现这些目标,我们并不干涉。我们给天工提供了一个标准的人的跑姿作为参考,然后通过奖励机制来驱动它不断尝试和学习。在跌倒重来的过程中,天工逐渐调整自己的跑姿,最终发现这种‘捂脸跑’的姿势既能满足我们的要求,又让自己感到舒适。”
韩刚还补充道,机器人的强化学习方式很难通过人为设计来实现。这也是为什么强化学习在机器人运动控制领域比传统的模型方式更具优势。“以前我们会编写方程来规划机器人的每一个动作和状态,但实际上很多时候很难写清楚。而强化学习则不需要这些,它完全基于数据驱动来自我优化和调整。”
徽声在线记者 王田



