
谷歌发布 Gemini Robotics 2.0,宣称灵巧性与安全性显著提升
谷歌近日发布了 Gemini Robotics 2.0,这是其在机器人领域的最新成果,包含三款模型,但目前仅有一款向公众开放。该版本重点改进了机器人的灵巧操作能力和安全性,标志着 AI 与机器人融合的又一重要进展。
三款模型,各有所长
Gemini Robotics 2.0 系列包括三个不同定位的模型,分别侧重基础控制、物体操作和安全交互。然而,谷歌目前只开放了其中一款——推测为基础控制模型,用于执行简单的抓取和移动任务。其余两款模型仍在内部测试中,预计未来数月内陆续推出。这种分阶段发布策略,既体现了谷歌对技术成熟度的谨慎考量,也为开发者提供了逐步适应的空间。
灵巧性:从“抓取”到“操作”的跨越
与上一代相比,Gemini Robotics 2.0 在灵巧性方面有了质的飞跃。传统机器人往往只能执行预设的抓取动作,而新模型能够实时感知物体形状与材质,并调整手指力度与角度,完成诸如拧瓶盖、穿针引线等精细操作。这得益于其底层视觉-语言模型的增强,使机器人不仅能“看到”物体,还能理解“如何操作”的语义指令。例如,当用户说“小心地拿起鸡蛋”时,机器人会自动降低抓取速度并增加接触面积。
安全性:从“避障”到“预判”
安全性是 Gemini Robotics 2.0 的另一大亮点。新系统引入了动态风险预测模块,能够在运动过程中实时评估环境风险。不同于传统的“遇到障碍再停下”的反应式安全机制,Gemini Robotics 2.0 可以预判人类或物体的运动轨迹,提前调整动作幅度或路径。例如,在协作场景中,机器人看到人类手臂快速接近时,会主动减速并改变抓取方向,避免碰撞。谷歌表示,该模块在实验室测试中将意外接触率降低了 40%。
行业影响与现实意义
此次发布正值全球机器人市场加速增长之际。根据国际机器人联合会数据,2024 年全球服务机器人市场规模已突破 500 亿美元,而 AI 驱动的智能机器人正成为核心增长点。Gemini Robotics 2.0 的灵巧性与安全性突破,有望推动其在医疗手术、精密制造、家庭服务等领域的落地。例如,在手术辅助中,机器人需要同时满足高精度操作与患者安全保障;在家庭场景中,机器人需能安全地处理易碎物品或与儿童互动。
开放有限,但信号明确
尽管目前仅开放一款模型,但谷歌此举已向行业释放明确信号:AI 机器人正从实验室走向实用化。开发者可以利用基础模型快速搭建原型,而谷歌则通过用户反馈迭代更复杂的模型。这种“渐进式开放”策略,既降低了早期风险,又为生态建设奠定了基础。
未来,随着剩余两款模型的开放,Gemini Robotics 2.0 有望成为机器人开发者的重要工具。但安全问题仍是最大挑战——当机器人进入真实世界,任何细微失误都可能造成后果。谷歌能否通过持续优化赢得信任,将是该系列成功的关键。
