摘要:
场景赛真正考的是大脑。
凤凰网科技 出品
作者|Dale
编辑|董雨晴
这个暑期,世界机器人运动会的画风有点混搭。
冰丝带里,穿武术服的机器人扎着马步,一招“白鹤亮翅”推得有板有眼;北京消防战勤保障大队里,另一个机器人抱着灭火器冲进模拟火场,在砖块和木条搭成的“废墟”里翻找危化品。酒店客房里,机器人跟床单较上劲,铺平、捋直、再铺平,动作肯定算不上麻利的,但每一步操作都是机器人自己拿主意。
8月22日晚,第二届世界人形机器人运动会在北京国家速滑馆开幕。来自全球16个国家的666支队伍、2056台机器人涌入冰丝带,参赛队伍较首届增长138%,规模创下历届之最。开幕式上,智元远征A3在无遥控、无脚本、无人工干预的条件下,与乒乓球奥运冠军丁宁完成了多轮对打,这是全球首个公开完成该能力的全尺寸双足人形机器人,驱动它的是智元和北京大学联合研发的SpikePingpong运动控制算法。
开幕式里的热闹已经应接不暇,真正的较量则在赛场的各个角落展开。
直至大赛闭幕,智元以 18金 16银12铜居金牌奖、奖牌榜首位。去年这个位置属于宇树科技,2025年首届运动会上,宇树靠1500米、400米、100米障碍赛和4×100米接力四枚径赛金牌霸榜,共计11枚奖牌。今年场景赛增强了对大脑的重视,智元的奖项也多来自于此。
这意味着,这不仅仅是挑战运动极限的比赛,更是一场“谁能干活”的考试。而后者恰恰是今年机器人赛道最难能可贵的能力。
五花八门的赛场,机器人的花活儿拉满了
如果你以为今年的机器人运动会还在博快,寻求人类生理的极限,那就大错特错了,今年机器人运动会最核心的突破就是大脑的智能。
机器人不仅能跑会跳,还能叠床单、找消防危险品……稍不留神,你会觉得打工人这次真的集体硅基化了。
灵巧手比赛:粉末称重
这些名场面,来自新增的场景赛板块,21个赛项占总赛项数量超过四成。更热闹的是,不少场竞赛的赛场直接搬进真实环境,比如酒店赛区设在五洲大酒店,消防救援赛区就放在北京消防战勤保障大队。
考题也从运动为主转向全面上岗。30分钟内,消防赛项的机器人要依次完成危险物品识别、阀门关断、灭火器操作三项任务,一项不合格就不能进入下一项;图书馆赛项要求完成图书回收、摆放、巡检纠错三个环节,中途不得放弃;酒店赛项则要搬行李、补客房物资、整理床单,全流程考验“眼、脑、手”协同。第一次看到“班味儿”如此重的比赛现场。
场景赛的核心考验就在智能。据组委会安排,场景赛各赛项采用全自主方式的分值权重为1.0,遥操方式仅为0.5。这意味着,靠人远程操控完成任务的队伍,分数直接打对折。
凤凰网科技了解到,此次智元机器人系列的主要战力就在这里。
轮式底盘的精灵G2参加了场景赛相关项目,双足人形的灵犀X2报名了障碍赛,远征A3则出现在太极拳等赛项。就像是“打工人偶尔放风”。身为一家重视落地部署的公司,智元更在意机器人在非结构化、高扰动环境中的真实作业能力,而不仅仅是跑道上的极限速度。
据统计,智元在“脑力大赛”中夺得了最佳成绩,其中,消防救援岗,智元夺得冠军和亚军;图书整理岗,智元分别获得了冠军和季军。智元远征A3在太极拳项目中更是以40.5分夺金,3个高难度动作全部完成,领先第二名宇树科技队接近一半分数。
据凤凰网科技不完全统计,智元此次拿下了灵巧手最多金牌数量、场景赛最多金牌数量,同时拿下舞蹈武术类最多奖牌。
奖牌的底色是大脑,智元的储备很足
在热闹的画面之外,场景赛考的到底是什么?
场景赛真正考的是大脑。全自主模式下,机器人需要独立完成从感知到决策再到操作的全链路:看懂环境、识别物体、理解任务、规划路径、执行任务。
任何一个环节掉链子,任务就会中断。这也是全自主权重是遥操两倍的原因,遥操本质上是人在干活,机器人只是执行的载体,全自主才是机器人自己在干活。
灵巧手是AI大脑的最佳试验场,在这次为期两天的灵巧手专项比赛决赛中,智元子公司临界点闯入全部八个项目决赛,赢得了“积木搭建”、“粉末称重”、“镊子夹豆”等 7 个项目的金牌,同时包揽4 枚银牌,3 枚铜牌,在所有参加灵巧手比赛的队伍中,成绩卓然。智元临界点参加比赛的灵巧手OmniHand具有极强通用性,对不同精细操作都能应对,本质上是靠优异硬件及软件算法实现“一手打天下”,且凤凰网科技了解到,其是以量产版本参与灵巧手所有赛项。
灵巧手比赛:积木搭建
智元在大脑上的投入,是它此次奖牌丰收的底层逻辑。
智元采用“三智一体”的产品架构:本体为基础,叠加运动智能、交互智能、作业智能三个基座模型。与行业中不少公司侧重硬件本体或运动控制不同,智元走的是软硬全栈自研路线,且在软件和AI模型上的投入占比更高。
在不少学术榜单上,智元均有所获。2026年7月,复旦大学研究团队发布的具身全模态理解权威榜单DailyOmni显示,智元自研的WITA-Omni Preview以85.21分综合成绩登顶,超越Gemini、千问、豆包、英伟达等国内外模型,在八项细分指标中六项拿下第一。DailyOmni被业内视为检验音视频时序对齐与跨模态联合推理能力的试金石,通俗说,它考的是模型能不能“边看边听边理解”,这正是机器人在真实环境中作业的核心能力。
两个月前,智元自研的世界模型Genie Envisioner-Sim 2.0(GE-2)在CVPR 2026 WorldArena世界模型赛道中拿下总分冠军。WorldArena是世界模型领域最权威的评测基准之一,考的是模型对物理世界的理解和预测能力,机器人要先在脑子里推演动作的后果,才能在现实中做出正确决策。
这些技术上的成果与成绩,成了智元拿下场竞赛奖项的技术底座。
在这样的重压投入背后,智元的思考很清晰。
智元创始人、董事长兼CEO邓泰华在今年4月17日的智元合作伙伴大会(APC 2026)上,把行业发展划分为XYZ三条曲线:X曲线是具身突破,机器人能动起来,对应开发尝鲜期,主要价值是科研工具和文娱表演;Y曲线是智能突破,机器人能干活,进入部署成长期;Z曲线是智能涌现,机器人通过物理世界图灵测试,迎来ChatGPT 3.5时刻。
“不应该仅仅满足于在第一曲线。”邓泰华在演讲中说。在他看来,过去三年中国具身智能公司的快速发展主要依赖X曲线——本体硬件的突破,这是中国产业链的优势所在。但X曲线的市场空间有限,“情绪价值来得快,也可能去得快”,边际效应持续下降。主动跳到Y曲线,靠智能突破实现生产力落地,才是更大的市场。
今年的运动会似乎为这一判断提供了注脚。当竞速赛道上的机器人还在为缩短几秒而努力时,场景赛上的机器人已经开始在真实酒店里整理床单、在真实消防队里操作灭火器。智能的含金量往往更高。
部署态依旧依赖数据飞轮,更多机器人在更多场景中产生更多真实数据,反哺算法迭代,进而实现能力涌现。这个逻辑成立的前提是:部署规模足够大、数据质量足够高、飞轮转动足够快。目前,智元是行业中最有机会率先跑通这个飞轮的公司之一,这是一场新的竞赛。
过去两年,这个行业太擅长制造哇哦时刻,翻跟头、跑接力、跳舞,掌声来得快,散得也快。但真正的落地部署却一直空着。今年的运动会把赛场搬进真实的酒店和消防队,与其说是比赛,不如说是一场提前进行的考核。这是一个令外界兴奋的时刻,至少通过智元的部署态落地和运动会金牌奖牌榜的双登顶,让我们看到了“三智一体”正在飞速向前发展,“具身智能的技术演进仍在超出预期”,具身智能的ChatGPT时刻,正以令人意外的速度朝我们涌来。
