发生了什么
在2026世界机器人大会上,300余家企业、3000余件展品把北京亦庄变成了具身智能的‘秀场’。但与去年铺天盖地的‘端到端’争论不同,今年会场内外的讨论明显‘降温’,人们不再执着于给VLA或世界模型贴标签,而是开始追问:数据从哪里来、怎么采?
关于技术路线,圆桌讨论上出现了不少‘融合’声音。清华大学副研究员苏航判断,VLA与世界模型不是单选题,可以在不同时间尺度上结合;擎朗智能发布的KOM 3.0将潜空间世界模型与VLA结合,让机器人在动作前先预演物理结果;星海图CEO高继扬则称二者同源共生,未来会走向融合。
与此同时,另一些团队给出了更激进的方案。北京人形机器人创新中心推出统一表征的Pelican-Unify,把视觉、动作和世界预测放进同一套框架;智平方开源了模拟‘皮层-小脑-脊髓’协同的NeuroVLA;深诣机器人提出L4E与E4L两条自进化路径,并采用‘混合物理专家模型’。定义如此多样,正如大晓机器人董事长王晓刚所说,行业底层对齐还很粗,连评测标准都未统一。
为什么重要
路线争论降温并不等于答案已经出现,而是行业把注意力转向了更务实的问题。算法优劣要靠数据检验,VLA、世界模型还是大一统模型,都要回答同一道题:在真实家庭和工厂场景中,能否把‘数据—训练—执行’的闭环跑通。
世界模型被不少从业者视为让机器人‘理解物理世界’的基础设施,但各方定义与评测标准仍在形成中。哪条路线能率先在真实场景中证明自己,谁才可能真正打通从‘大脑’到‘身体’的最后一公里。
关键事实
2026世界机器人大会在北京亦庄举办,300余家企业、3000余件展品参展,技术讨论氛围较去年降温。
清华大学副研究员苏航认为VLA与世界模型并非二选一,未来可能融合;多家企业发布了VLA+世界模型、统一表征世界模型等不同架构。
北京人形机器人创新中心发布Pelican-Unify并登顶WorldArena;智平方推出类脑架构NeuroVLA;大晓机器人称行业底层定义和评测标准尚未统一。
接下来看什么
世界模型的定义和评测标准能否逐步收敛,避免各家自说自话。
VLA+世界模型的融合方案,以及Pelican-Unify等大一统模型,能否在家庭、工厂等非结构化场景中拿出可复现的结果。
具身智能竞争重心会不会进一步转向数据采集与闭环能力,让‘最后一公里’成为分水岭。
