Google DeepMind 发布 Gemini Robotics 2,可控制人形机器人全身
Google DeepMind 推出 Gemini Robotics 2,将人形机器人控制范围从仅上半身扩展到从脚到指尖…
Google DeepMind 于本周四宣布推出 Gemini Robotics 2 模型,新版本将控制范围从上一代的人形机器人「上半身」扩展到「全身」,可同时协调从脚到指尖的多个身体部位完成动作。这是 Gemini Robotics 系列在具身智能方向上的一次重要能力升级。
从上半身到全身的关键跨越
据 Google DeepMind 官方介绍,前一代 Gemini Robotics 模型主要聚焦于人形机器人的上半身控制,例如手臂抓取与物体操作。Gemini Robotics 2 在此基础上新增了对「全身动作(whole-body motions)」的支持,使机器人能够完成行走、下蹲、伸展以及更复杂的物体操控等任务。这意味着模型需要同时处理下肢移动、上肢操作以及躯干平衡之间的协同,对底层控制策略提出了更高要求。
与 Apptronik Apollo 2 联合演示
Gemini Robotics 2 的能力演示由 Apptronik 提供的人形机器人 Apollo 2 完成。Google DeepMind 公开的视频显示,Apollo 2 在 Gemini Robotics 2 的驱动下能够弯腰拾取地上的浇水壶,并能在货架上识别并取出指定物品,例如将一只棒球手套从货架上取下。这类任务同时涉及移动、视觉定位与精细操作,是衡量全身控制模型实用性的典型场景。
对具身智能赛道的意义
人形机器人被视为具身智能落地的重要载体,而「上半身 vs 全身」是控制模型能力边界的关键分水岭。Google DeepMind 通过 Gemini Robotics 2 把控制范围扩展到全身,相当于把可用任务空间显著扩大,为后续更复杂的服务、工业或家庭场景提供了基础。短期内,该模型仍主要面向研究与合作生态,具体的开放形式、训练数据规模、benchmark 表现等细节尚未在本次披露中给出,有待 DeepMind 后续进一步说明。
