谷歌推出可在本地机器人上运行的全新 Gemini 模型

6.25 该公司表示,开发人员可以向机器人展示50到100个任务演示,以便使用MuJoCo物理模拟器上的这些模型来训练它们执行新任务

20250625135527

图片来源:Westend61


谷歌 DeepMind 周二发布了一种名为 Gemini Robotics On-Device 的新语言模型,该模型可以在机器人上本地运行任务,而无需互联网连接。


Gemini Robotics On-Device是基于该公司3 月份发布的Gemini Robotics 模型构建的,可以控制机器人的动作。开发者可以使用自然语言提示来控制和微调该模型,以满足各种需求。


谷歌声称,在基准测试中,该模型的性能接近基于云端的 Gemini Robotics 模型。该公司表示,该模型在通用基准测试中的表现优于其他设备上的模型,尽管该公司并未透露具体型号。


20250625135528
图片来源:谷歌


在演示中,该公司展示了运行该本地模型的机器人执行诸如拉开袋子拉链和折叠衣服等操作。谷歌表示,虽然该模型最初是为ALOHA 机器人进行训练的,但后来对其进行了调整,使其能够在双臂 Franka FR3 机器人和Apptronik 的 Apollo 人形机器人上运行。


谷歌声称双臂 Franka FR3 成功解决了之前从未“见过”的场景和物体,例如在工业传送带上进行装配。


Google DeepMind 也发布了Gemini Robotics SDK。该公司表示,开发人员可以向机器人展示 50 到 100 个任务演示,以便使用 MuJoCo 物理模拟器上的这些模型来训练它们执行新任务。 


其他 AI 模型开发者也在涉足机器人领域。Nvidia 正在构建一个平台,用于创建人形机器人的基础模型;Hugging Face 不仅在开发机器人的开放模型和数据集,还在开发机器人;而由 Mirae Asset 支持的韩国初创公司RLWRLD 则致力于创建机器人的基础模型。