94%|虚拟训练到真实环境成功率
谷歌DeepMind发布Gemini Robotics 2.0,机器人灵巧操作实现突破
灵巧操作能力质的飞跃
谷歌DeepMind在今日的科技大会上发布了Gemini Robotics 2.0——这是全球首个让机器人具备"精细触觉"能力的多模态大模型。与此前版本相比,2.0版本引入了全新的"触觉-视觉-语言"三模态联合推理架构,使机器人能像人类一样感知物体的硬度、表面纹理和重量分布。在发布会上,搭载新模型的机械臂成功完成了穿针引线、折千纸鹤、单手剥熟鸡蛋壳等十余项传统机器人几乎不可能完成的精细操作。DeepMind机器人部门负责人表示,这标志着机器人从"粗放抓取"迈入"灵巧操控"的新时代。
技术突破背后的三大创新
Gemini Robotics 2.0的技术突破基于三大创新。首先是"Sim-to-Real 2.0"训练范式:先在超大规模物理模拟环境中训练10亿次虚拟操作,再通过少量真实世界数据微调,使模型迁移到真实环境中的成功率从上一代的65%跃升至94%。其次是"触觉Token"编码:DeepMind研发了新型触觉传感器,能将压力、温度和纹理信息编码为与语言token相同的向量表示,实现触觉与视觉、语言的无缝融合。第三是"连续动作空间"推理:模型不再离散地规划"抓-放"动作,而是在连续空间中实时调整力度、角度和速度。这些技术已在Nature Robotics期刊发表。
产业应用前景广阔
谷歌宣布将Gemini Robotics 2.0通过Google Cloud向制造业、医疗健康和物流行业的企业客户开放API。在发布会上,富士康展示了利用该模型进行精密电子元件组装的试点项目,良品率从人工操作的97%提升至99.5%。强生公司则展示了手术辅助机器人原型,可自主完成显微缝合操作。业内分析认为,Gemini Robotics 2.0的发布将加速全球制造业的智能化转型,预计到2028年将带动超过2000亿美元的机器人新增市场规模。
← 返回资讯列表
AI8899 · 内容仅供学习参考