谷歌DeepMind发布GeminiRoboticsER2,机器人实现多机协同与全身控制

在机器人技术领域,谷歌DeepMind于近期正式推出了其最新一代具身推理AI模型——Gemini Robotics ER 2。这款专为机器人设计的"大脑"不仅提升了机器人在物理环境中的理解能力,更实现...

人工智能

在机器人技术领域,谷歌DeepMind于近期正式推出了其最新一代具身推理AI模型——Gemini Robotics ER 2。这款专为机器人设计的"大脑"不仅提升了机器人在物理环境中的理解能力,更实现了不同机器人之间的协作功能,为机器人技术的发展开辟了新的可能性。

与传统的机器人控制模型不同,Gemini Robotics ER 2能够将视觉信息和自然语言指令转化为机器人电机控制指令,同时具备规划多步骤任务的能力。在实际演示中,该模型成功控制Apptronik公司的Apollo人形机器人完成了穿越房间、拾取浇水壶并放置至架子等一系列复杂动作,充分展示了其在环境感知和任务执行方面的强大能力。

这一新模型建立在Gemini 3.5 Flash之上,新增了视频片段定位、任务进度分类等功能,使机器人能够在连续动作过程中持续观察结果,并根据实际情况调整执行策略。Google DeepMind机器人部门副总裁Carolina Parada表示:"我们的目标是将AI带入物理世界,并构建一个可供每台机器人使用的智能层。"

图片

值得注意的是,Gemini Robotics ER 2不仅是对单个机器人控制能力的提升,更是机器人协作技术的重要突破。该模型首次实现了多机器人协同工作,能够协调多个机器人共同完成同一目标。例如,在仓库或工厂环境中,多个机器人可以分工合作,分别负责物品搬运、分拣和装配等任务,从而显著提高工作效率。

此外,Google还同步推出了另外两款机器人AI模型——Gemini Robotics ER 2和On-Device 2。其中,Gemini Robotics ER 2主要负责任务规划和多机器人协调,而On-Device 2则专注于本地化运行,能够在不联网的情况下快速适配各类新型机器人本体。

尽管Gemini Robotics ER 2在多项关键技术上取得了突破,但Google DeepMind机器人部门总监Kanishka Rao也坦言,真正意义上的灵活性仍是遥远目标。目前机器人的动作仍然显得缓慢且刻意,需要进一步优化才能达到人类水平的直觉判断能力。

这一系列进展表明,谷歌正在加速推进其在机器人领域的战略布局。自2010年代初期收购多家机器人初创公司后,谷歌经历了多次战略调整,但此次连续推出新一代模型,显示出其在机器人技术上的长期投入和坚定决心。面对来自OpenAI和英伟达等竞争对手的压力,谷歌正通过技术创新保持其在机器人领域的领先地位。