
具身智能VLA模型人形机器人Google DeepMindGemini Robotics 2Apptronik Apollo 2
谷歌 DeepMind 发布 Gemini Robotics 2:通用具身智能「大脑」开启全身智能时代
2026/8/260作者:聚身之家编辑部事件日期 2026/7/30Robot202607201832影响力 50
谷歌 DeepMind 于 7 月 30 日正式发布新一代视觉-语言-动作(VLA)模型 Gemini Robotics 2 及配套的 Gemini Robotics ER 2。该模型可为不同品牌、不同形态的机器人提供统一的「大脑」控制,实现全身协同、灵巧操作与多机器人协作,并在 Apptronik Apollo 2 人形机器人、Franka FR3 Duo 双臂平台上完成演示。
事件概述
2026 年 7 月 30 日,Google DeepMind 正式发布新一代视觉-语言-动作(VLA)模型 Gemini Robotics 2,同时推出面向视频理解与多步规划的 Gemini Robotics ER 2。这是继 Gemini Robotics 1.0 之后,DeepMind 在具身智能方向的一次重大升级:目标是为任意品牌的机器人提供一个统一的「大脑」,让智能真正覆盖从感知、推理到全身协调执行的完整链路。
核心亮点
- 全身智能(Whole-Body Intelligence):模型不再局限于机械臂的单点操作,而是能够同时控制人形机器人的全身关节,完成全身伸展、弯腰抓取等连贯动作。
- 灵巧操作(Dexterous Manipulation):演示覆盖打结、拧灯泡等精细动作,且同一模型可适配五指灵巧手与二指平行夹爪等多种末端执行器。
- 多机器人协作:Gemini Robotics 2 支持不同硬件平台之间的任务协同,展示中 Apollo 2 人形机器人与 Franka Mobile FR3 Duo 双臂机器人分工配合完成复杂任务。
- 长时序任务能力:在基于 Franka Research 3 Duo 的演示中,机器人全自主完成工具整理(Tool Kitting)等长时序任务——识别工具、规划双臂动作、连续完成抓取搬运与精准放置。
产业影响
Gemini Robotics 2 的意义在于将「通用性」提升到新高度:同一套模型权重可跨硬件平台迁移,显著降低机器人厂商接入 AI 能力的门槛,被视为通用人形机器人从「演示」走向「可用」的关键技术节点。DeepMind 表示,该模型已在家用任务(如垃圾处理)中展示出理解环境、规划多步骤行动并在最小人工干预下执行任务的能力,为消费级与商用级机器人落地提供了更强的技术底座。
关联产品
本次发布的核心演示平台之一为 Apptronik 旗下 Apollo 2 人形机器人。Apollo 2 定位商用级人形机器人,面向物流仓储与智能制造场景,在 Gemini Robotics 2 的驱动下完成了全身协同与精细操作等高难度任务,展示了「通用大模型 + 人形本体」组合的落地潜力。