
|
人形机器人「大脑」重构:VLA 与世界模型两条技术路线并行
一句话:9 月,Robots Daily 梳理人形机器人架构演变:具身「大脑」正从状态机/规则引擎,被 VLA(端到端视觉-语言-动作)与世界模型(先仿真再决策)两条大模型路线重写。
背景
2026 年 9 月,Robots Daily 长文梳理人形机器人架构演变:本体(电机/减速器/传感器)、小脑(运动控制)、大脑(场景理解/指令理解/任务分解/决策/对话)。过去机器人「决策」靠状态机、任务树、规则引擎,能力受限于工程师预写分支。近两年大模型的「大脑」路线出现两条:VLA(RT-2、GR00T N1、π0.5 等)端到端视觉-语言-动作;世界模型(NVIDIA Cosmos、Meta 前 LeCun 团队)先学物理世界内部模型、在「脑内」仿真再决策。2024–2025 VLA 最热,2026 世界模型路线快速追赶。无论哪条赢,替换的是大脑而非小脑。
核心要点
- 机器人三层:本体/小脑/大脑
- 旧决策:状态机/任务树/规则引擎
- VLA 路线:端到端视觉-语言-动作
- 世界模型路线:先仿真再决策
- 2026 世界模型快速追赶 VLA
- 替换的是大脑而非小脑
为什么重要
大模型把机器人从「预编程木偶」变成「能对话即操作」的智能体,泛化能力取代「会走路」成为真正门槛。VLA 与世界模型的竞争决定下一代机器人的「思考方式」,也决定仿真(Isaac/Cosmos)与真实数据的权重分配。
关键事实速记
- 梳理:2026-09
- 来源:Robots Daily
- VLA 代表:RT-2/GR00T N1/π0.5
- 世界模型:Cosmos/LeCun
- 热点迁移:2024-25 VLA→2026 世界模型
- 结论:换脑不换小脑
← 返回资讯列表
AI8899 · 内容仅供学习参考