宇树科技实现世界模型实时驱动全自主人形机器人格斗
驱动中国9月7日消息,宇树科技今日宣布,全球首次实现世界模型实时驱动全自主人形机器人格斗,并同步公布了实拍画面。这一进展意味着人形机器人不再依赖预设程序或人工遥控,而是能够依靠自身对世界的理解,在高对抗动态场景中完成自主决策与实时行动。
据宇树科技介绍,此次突破依托于其UnifoLM-X2-1.0模型,该模型攻克了世界-动作大模型在瞬时规划、决策和动态交互执行等环节的瓶颈,实现了高动态、强交互状态下的实时未来预测与动作规划,进而让机器人能够进行全自主搏击。官方评价称,这验证了世界模型驱动的人形机器人大规模落地部署的基础可行性。

事实上,宇树科技的人形机器人此前已有多次公开“格斗”亮相。2025年11月5日第八届中国国际进口博览会首日,两台宇树人形机器人便曾在展台上展开擂台格斗表演,引来大量观众围观。不过,彼时的展示更多停留在演示层面,机器人的动作编排与临场反应仍受到预设程序或人工操控的制约。
相较之下,此次UnifoLM-X2-1.0的关键进阶在于机器人能够通过世界模型实时预测未来物理状态,并据此自主完成决策链条与动态交互执行,而非按照写死的逻辑机械出招。换句话说,机器人在对抗中展现出了类似“预判”的能力,能够根据环境变化不断调整自身策略。
“世界模型”是近年来具身智能领域备受关注的研究方向,其核心理念是让智能体在内部建立对物理世界的预测性表征,在抽象空间中推演和规划未来状态,而不是对周围环境进行逐像素的还原与重建。这一路线被视作通往通用机器人的重要途径之一,业界已有多个代表性成果,例如Meta首席AI科学家Yann LeCun提出的JEPA系列架构,其中V-JEPA 2已经展示了零样本机器人规划能力;此外,多家厂商也陆续推出了各自的世界模型底座。
宇树此次将世界模型路线落地到人形机器人的高对抗动态场景,进一步拓展了该技术的应用边界。与静态抓取、简单导航等任务不同,机器人格斗要求模型在极短时间窗口内完成状态感知、趋势预测、动作选择和本体控制,其难度更接近真实世界的复杂交互。因此,这次突破不仅是一次产品层面的炫技,更是在验证世界模型能否支撑高实时性、强耦合的物理决策任务。
从行业意义来看,若世界模型驱动的人形机器人能在类似格斗这样的极端场景中稳定运行,那么它在工业生产、抢险救援、家庭服务等更广泛领域的落地前景也将获得更强支撑。宇树科技此次公布的结果,为人形机器人从“执行指令的工具”向“具备环境理解与自主决策能力的智能体”演进提供了一个新的观察样本。
当然,目前公开信息仍以宇树官方口径为主,实拍画面中机器人的对抗强度、决策独立性程度等细节,尚需更多第三方测试与验证加以佐证。不过,这一全球首次的尝试无疑将引发行业对世界模型实用化路径的进一步讨论,也为后续同类技术竞赛设定了新的参照坐标。