← 资讯列表
|

人形机器人「大脑」重构:VLA 与世界模型两条技术路线并行

📅 2026/9/6 08:00:00👁 1 阅读⏱ 约 3 分钟

一句话:9 月,Robots Daily 梳理人形机器人架构演变:具身「大脑」正从状态机/规则引擎,被 VLA(端到端视觉-语言-动作)与世界模型(先仿真再决策)两条大模型路线重写。

背景

2026 年 9 月,Robots Daily 长文梳理人形机器人架构演变:本体(电机/减速器/传感器)、小脑(运动控制)、大脑(场景理解/指令理解/任务分解/决策/对话)。过去机器人「决策」靠状态机、任务树、规则引擎,能力受限于工程师预写分支。近两年大模型的「大脑」路线出现两条:VLA(RT-2、GR00T N1、π0.5 等)端到端视觉-语言-动作;世界模型(NVIDIA Cosmos、Meta 前 LeCun 团队)先学物理世界内部模型、在「脑内」仿真再决策。2024–2025 VLA 最热,2026 世界模型路线快速追赶。无论哪条赢,替换的是大脑而非小脑。

核心要点

  • 机器人三层:本体/小脑/大脑
  • 旧决策:状态机/任务树/规则引擎
  • VLA 路线:端到端视觉-语言-动作
  • 世界模型路线:先仿真再决策
  • 2026 世界模型快速追赶 VLA
  • 替换的是大脑而非小脑

为什么重要

大模型把机器人从「预编程木偶」变成「能对话即操作」的智能体,泛化能力取代「会走路」成为真正门槛。VLA 与世界模型的竞争决定下一代机器人的「思考方式」,也决定仿真(Isaac/Cosmos)与真实数据的权重分配。

关键事实速记

  • 梳理:2026-09
  • 来源:Robots Daily
  • VLA 代表:RT-2/GR00T N1/π0.5
  • 世界模型:Cosmos/LeCun
  • 热点迁移:2024-25 VLA→2026 世界模型
  • 结论:换脑不换小脑
← 返回资讯列表 AI8899 · 内容仅供学习参考