Google DeepMind 发布 Gemini Robotics 2,Apptronik 人形机器人展示全身 AI 控制
Google DeepMind 发布了 Gemini Robotics 2,这是一套全新的 AI 模型套件,旨在通过全身控制、先进的灵巧操作能力和多机器人协作,为人形机器人及其他机器人赋予更强的自主性。
该系统正在 Apptronik 的 Apollo 2 人形机器人上进行演示。Google DeepMind 表示,Apollo 2 现在能够执行全身自主运动,包括行走、下蹲、弯腰和操纵物体,同时实时推理复杂任务。
此次发布建立在两家公司持续合作的基础之上。本月早些时候,Apptronik 启用了 Robot Park 设施,Apollo 2 机器人在此收集用于训练下一代 AI 模型(包括 Gemini Robotics 2)的数据。
Google DeepMind 将 Gemini Robotics 2 描述为机器人的"智能层",使机器能够超越预先编程的任务,适应不断变化的环境。
该公司表示,该平台设计为可跨不同机器人类型工作,并可在数小时内适配新硬件。
Google DeepMind 表示,Gemini Robotics 2 通过增加全身控制扩展了此前的成果。早期版本主要聚焦于上半身操作,而最新模型使人形机器人能够协调"从脚到指尖"的运动。
在一段演示中,Apollo 2 接收到"把浇水壶放进底层架子上的绿色垃圾桶"的指令,随后走过房间,拿起物体并将其放置到正确位置。
该公司还重点介绍了机器人灵巧操作方面的改进。Gemini Robotics 2 可以控制配备五指 SharpaWave 灵巧手的 Apptronik Apollo 2,执行诸如扎紧垃圾袋或拧下灯泡等任务。
该模型还支持传统的平行夹爪,用于包括精密插入和装箱在内的工业操作任务。
另一项新能力是多机器人协作。Google DeepMind 表示,Gemini Robotics ER 2 允许不同类型的机器人相互通信,并在复杂工作流中进行协调,否则这些工作流将需要单台机器完成所有任务。
该推理模型还设计为可在数分钟内管理任务执行,监控进度、从失败中恢复并适应不断变化的情况。
为支持云连接受限的工业部署场景,Gemini Robotics On-Device 2 直接在机器人硬件上运行。据 Google DeepMind 称,该模型只需不到 200 个训练样本、短短数小时的采集,即可适配新的双臂机器人平台。
安全性也是本次发布的一部分。
Google DeepMind 推出了 ASIMOV-Agentic 基准,用于评估"智能体安全编排与不确定性消解"。该基准衡量机器人拒绝不安全动作、判断任务何时无法安全完成,以及在适当情况下请求人工干预的能力。
该公司表示,Gemini Robotics ER 2 还增强了人体感知能力,使机器人能够检测到附近的人、触发安全功能,并在有人进入其工作区域时安全停止。
Gemini Robotics ER 2 现已通过 Google AI Studio 提供,并在 Gemini Enterprise Agent Platform 上提供私有预览,而 Gemini Robotics 2 和 Gemini Robotics On-Device 2 则面向选定的早期体验合作伙伴开放。
我们的网站依靠广告来提供免费内容并维持运营。通过关闭广告拦截器,您将帮助我们继续免费为您提供有价值的内容。
我们衷心感谢您的理解与支持。谢谢您考虑为本网站禁用广告拦截器。