RobotJia
🇺🇸 美国·2026-08-01

谷歌发布Gemini Robotics 2,让机器人全身协同

谷歌发布Gemini Robotics 2,让机器人全身协同Google DeepMind官方发布页

Google DeepMind 7月30日发布Gemini Robotics 2系列:主模型负责全身运动与精细操作,ER 2规划多步骤任务,On-Device 2可在设备端运行。ER 2已开放试用或私有预览,另外两款仍限早期合作伙伴。

Google DeepMind 7月30日发布Gemini Robotics 2系列,试图把机器人从预编程的单一动作推进到能够理解指令、规划步骤并控制全身完成任务。系列包含Gemini Robotics 2、Gemini Robotics ER 2和Gemini Robotics On-Device 2三款模型。

Gemini Robotics 2是一款视觉—语言—动作模型,可把相机画面和自然语言指令转成电机控制。官方展示它控制完整人形机器人行走、下蹲、伸手和搬放物品,也能控制双臂机器人及不同类型的手和夹爪。

Gemini Robotics ER 2承担更高层的具身推理与任务规划。它可以观察环境、理解人的指令、把持续数分钟的任务拆成多个步骤,再与动作模型配合执行;官方还展示了不同机器人通信协作以及失败后调整步骤。

On-Device 2面向网络延迟高或无法联网的场景,可直接在机器人设备端运行。Google称,它能用数小时数据适配新的双臂机器人形态,通常需要少于200个示例,但这是官方研究结果,不代表所有硬件都能达到相同适配速度。

演示中,Apptronik Apollo 2人形机器人根据指令走到桌边拿起洒水壶,再把它放入低层货架的绿色箱子;五指灵巧手还完成了打结和封合密封袋等动作。Google同时承认,多指精细操作仍然具有挑战,机器人移动速度也需要继续提升。

可用性边界需要明确:Gemini Robotics ER 2已在Google AI Studio提供,并在Gemini Enterprise Agent Platform进行私有预览;Gemini Robotics 2动作模型和On-Device 2目前只向早期合作伙伴开放,并不是已经面向所有企业销售的量产产品。

安全方面,Google发布ASIMOV-Agentic测试集,用于评估系统能否拒绝不安全的工具调用、判断任务是否可完成并在不确定时请求人工介入。公司还称ER 2在人体接近时可以触发安全工具并让机器人停止,但真实部署仍要结合硬件急停、力限位和现场安全认证。

这次更新的意义在于把全身控制、长期任务规划、端侧运行和多机器人协作放进同一模型体系。现阶段公开证据主要来自Google的演示与内部评测,距离大规模进入家庭和工厂,还要经过第三方测试、硬件适配、稳定性验证和商业交付。

#Gemini Robotics 2#具身智能#机器人模型#Google DeepMind
信息来源:Google DeepMind / Axios · 本站综合整理改写