谷歌发布新一代机器人AI模型

谷歌DeepMind近日发布新一代机器人人工智能模型Gemini Robotics 2,首次实现对人形机器人从行走、下蹲到精细抓取的全身协调控制,标志着Gemini系列AI技术正式从数字世界迈向物理世界。新系统不仅能将自然语言指令直接转化为电机控制信号,还具备环境推理与多步骤任务规划能力,让人形机器人真正开始“思考着行动”。
 
与此前仅能控制上半身操作的模型不同,Gemini Robotics 2实现了端到端的全身运动控制。在演示中,该系统驱动Apptronik公司的人形机器人Apollo自主穿过房间、避开障碍物、拾起洒水壶并精准放置到架子上,整个过程流畅自然。更值得关注的是,DeepMind同时推出了三层协同的模型架构:Gemini Robotics 2作为“小脑与肌肉”,负责将视觉和语言转化为精确动作;Gemini Robotics ER 2充当“高层大脑”,负责任务拆解、进度追踪与多机器人协作调度;而On-Device 2则专为边缘设备优化,可在无网络环境下本地运行,仅需不到两百个样本就能在几小时内适配全新的机器人本体。
 
灵巧性方面,新系统在“拧下灯泡”这类精细操作中成功率达到九成以上,但在扎垃圾袋、封密封袋等涉及柔性物体和高自由度手指协调的复杂任务上,成功率仍有明显短板。对此,DeepMind机器人业务总监Kanishka Rao坦言,机器人距离人类水平的灵巧性还有很长路要走——目前机器人的动作依然缓慢谨慎,每执行一步都要停下来“思考”,学习效率远低于人类,往往需要海量试错才能掌握新技能。
 
安全始终是具身智能的核心命题。谷歌同步推出了一套新的机器人安全评测基准,用于测试模型是否能识别不确定情境并拒绝危险指令。据披露,Gemini Robotics ER 2在安全指令遵循和人员接近避让两项测试中表现优异,被官方称为迄今最安全的机器人模型。
 
在商业化落地上,ER 2模型已通过AI Studio向开发者开放,并提供企业级平台的私人预览;而涉及核心运动控制的Gemini Robotics 2与On-Device 2,则率先向Apptronik、波士顿动力、Agile Robots等百家受信任测试机构和早期合作伙伴开放。DeepMind机器人业务副总裁Carolina Parada表示,团队的目标是构建一层能被所有机器人通用的物理世界智能系统,将AI真正带入现实空间。
 
此次发布也是谷歌重启延续十余年的机器人战略的重要信号。就在几年前,Alphabet曾缩减机器人业务并关闭Everyday Robots部门,如今借由Gemini大模型的成熟,谷歌正以“通用机器人大脑”的身份重新入场,与英伟达的GR00T平台、OpenAI探索的通用机器人基础模型形成正面角逐。对于行业而言,谷歌将“脑”与“手”分层解耦的思路,为全球机器人开发者提供了一套可接入的智能底座——当人形机器人开始具备推理、协作与自我纠错能力,具身智能距离真正走进工厂、仓库和家庭,又近了一步。

快递今日最新新闻【今天最新新闻】:转载请保留快递新闻网链接。