谷歌DeepMind近日宣布推出新一代机器人AI模型Gemini Robotics 2系列,标志着机器人控制技术迈入全新阶段。该系列模型首次实现人形机器人全身动作的统一控制,从基础行走、蹲下到复杂的手部操作,均由单一模型完成,同时具备自主规划多步骤任务及多机器人协作能力。
此次发布的三个模型各具特色:Gemini Robotics 2作为核心控制单元,将视觉输入与语言指令直接转化为精准动作;Gemini Robotics ER 2侧重环境感知与任务协调,可理解人类指令并统筹多机器人分工;Gemini Robotics On-Device 2则通过本地化部署降低网络依赖,提升响应速度。其中,ER 2版本已通过Gemini API和Google AI Studio向开发者开放,另两款模型暂限早期合作伙伴使用。
实验室测试数据显示,新模型在特定任务中展现显著进步:拆卸灯泡成功率达92%,但安装成功率仅为36%;涉及手指精细操作的任务,如绑垃圾袋、密封食品袋及使用簸箕,成功率在32%至44%之间波动;从地面拾取物品的成功率约为46%。这些数据反映出当前技术仍面临动作流畅度与复杂任务适应性的挑战。
谷歌DeepMind机器人部门负责人Kanishka Rao坦言,实现真正拟人化的机器人灵活性仍是长期目标。现阶段模型虽能完成预设任务,但动作轨迹仍显机械,尤其在动态环境中的应变能力有待提升。研究团队正通过优化算法架构与训练数据,逐步缩小实验室表现与实际应用场景的差距。
该系列模型的推出,为工业自动化、家庭服务及医疗辅助等领域提供了新的技术路径。其多模态交互能力与跨平台协作特性,或将推动机器人从单一功能设备向通用型智能助手演进。不过,技术商业化进程仍需克服成本、安全性及伦理规范等多重考验。
本报道内容基于公开信息整理,相关数据及结论仅供参考,不构成任何形式的投资或应用建议。实际使用前请务必通过官方渠道核实信息准确性。






















