Google于7月31日宣布,推出面向下一代机器人的核心智能模型“Gemini Robotics 2”。
据介绍,Gemini Robotics 2可帮助机器人对任务进行智能规划并执行相应动作,不仅能够完成多样化任务,还支持与其他机器人开展协同作业。
Google表示,这一具身智能模型支持在设备端本地运行,并可在数小时内适配全新的机器人形态。
此次发布包括三款模型,分别为Gemini Robotics 2、Gemini Robotics ER 2和Gemini Robotics On-Device 2。
其中,Gemini Robotics 2基于Google的视觉-语言-动作(VLA)模型,可用于控制从脚尖到指尖的人形机器人全身动作,也支持双臂机器人控制。
Gemini Robotics ER 2则是一款视觉-语言模型(VLM),主打Google的具身推理(ER)和智能体能力,可支持机器人与人交流、理解物理环境,并对持续数分钟的多步骤任务进行规划。
Gemini Robotics On-Device 2是针对机器人设备端本地运行优化的VLA模型。Google称,该模型只需基于数小时的数据,即可快速适配全新的机器人形态。
记者信息