Gemini Robotics ER 2 是什么?
它是谷歌DeepMind推出的最具能力的具身推理模型,可作为机器人的“高级大脑”,负责理解物理世界、规划多步任务,并将运动执行交给VLA模型。
(翻译)Gemini Robotics ER 2:以视频理解、任务编排与多机器人协作赋能机器人

Gemini Robotics ER 2 is a step change in video understanding, tool orchestration, and multi-robot collaboration for robotic applications.
谷歌DeepMind发布Gemini Robotics ER 2具身推理模型,用于机器人视频理解、任务编排与多机器人协作。模型可调用VLA模型及工具,支持进度分类与时刻查找,较前代在空间推理和安全性上显著提升,现已通过Gemini API向开发者开放。
它是谷歌DeepMind推出的最具能力的具身推理模型,可作为机器人的“高级大脑”,负责理解物理世界、规划多步任务,并将运动执行交给VLA模型。
相比前代,它在视频理解、任务进度分类(准确率57.4%)、关键时刻定位(准确率91.3%)、多机器人协作、空间推理与安全性方面均有显著提升。
该模型现已通过Gemini API、Google AI Studio公开提供,并在Gemini Enterprise Agent Platform上提供私人预览。