Google 发布 Gemini Robotics 2.0,主打灵巧操作与全身智能
Google DeepMind 推出 Gemini Robotics 2,包含三个子模型,其中 ER 2 已面向开发者开…
Google DeepMind 近日推出 Gemini Robotics 2 系列模型,主打机器人在灵巧操作、环境感知与多机协作上的全面升级。据介绍,新版本包含三个子模型,其中 Gemini Robotics ER 2 已从即日起面向开发者开放使用。
何为 Gemini Robotics 2
Gemini Robotics 是 Google DeepMind 面向「通用机器人」方向构建的 AI 系统,目标是让机器人具备类似人类的通用任务能力,研究团队内部将其称为「物理 AGI」(physical AGI)。与传统机器人依赖预先编程执行单一动作不同,Gemini Robotics 希望实现「用户下达指令,机器人直接完成」的闭环。
在 2.0 版本中,Google 表示该模型已经可以控制整台人形机器人,并针对复杂灵巧手部结构进行了优化,使机器人在执行精细操作时具备更高稳定性。
核心能力:全身智能与具身推理
Gemini Robotics 2 的核心卖点被概括为「全身智能」(whole-body intelligence),意味着模型不仅控制机械臂末端执行器,还会对躯干、腿部乃至全身姿态进行协调。
配合这一升级的是新一代具身推理模型 Gemini Robotics ER 2。Google DeepMind 称 ER 2 相较上一代 1.6 版本是一次显著跃升,并已与 Gemini Live API 打通,开发者可通过该 API 调用相关能力。
三个子模型与开放策略
本次更新包含三个新模型,其中:
- Gemini Robotics ER 2:升级版具身推理模型,即日起面向开发者公开;
- 其余两个子模型:Google 未在本次披露中给出具体开放范围。
这种分层发布策略与 DeepMind 此前在 Gemini 系列上的做法类似,先以推理与决策模型开放给社区,再逐步释放执行与控制层能力。
意义与待观察点
从行业视角看,Gemini Robotics 2 延续了 2024–2025 年具身智能赛道的密集迭代节奏,Google 选择以「通用机器人 + 大模型」路线与 Figure、Tesla Optimus、Physical Intelligence 等对手竞争。
不过,目前 Ars Technica 报道中并未披露 ER 2 的具体 benchmark 成绩、参数规模或真实场景成功率,第三方独立验证仍需等待后续实测。机器人领域的「Demo 惊艳 → 量产落地」之间长期存在落差,Gemini Robotics 2 能否真正缩小这一差距,仍有待观察。
