Google DeepMind Blog 发布于 07/30 23:00

Gemini Robotics ER 2: powering robotics with video understanding, task orchestration, and multi-robot collaboration

(翻译)Gemini Robotics ER 2:以视频理解、任务编排与多机器人协作赋能机器人

查看原文

资讯摘要

Gemini Robotics ER 2 is a step change in video understanding, tool orchestration, and multi-robot collaboration for robotic applications.

AI 摘要

谷歌DeepMind发布Gemini Robotics ER 2具身推理模型,用于机器人视频理解、任务编排与多机器人协作。模型可调用VLA模型及工具,支持进度分类与时刻查找,较前代在空间推理和安全性上显著提升,现已通过Gemini API向开发者开放。

AI 问答

Gemini Robotics ER 2 是什么?

它是谷歌DeepMind推出的最具能力的具身推理模型,可作为机器人的“高级大脑”,负责理解物理世界、规划多步任务,并将运动执行交给VLA模型。

Gemini Robotics ER 2 主要有哪些提升?

相比前代,它在视频理解、任务进度分类(准确率57.4%)、关键时刻定位(准确率91.3%)、多机器人协作、空间推理与安全性方面均有显著提升。

开发者如何获取 Gemini Robotics ER 2?

该模型现已通过Gemini API、Google AI Studio公开提供,并在Gemini Enterprise Agent Platform上提供私人预览。

打开原文