AI工具AI评分 一般 (63)AI 中文改写

谷歌AI进入现实世界:Gemini Robotics 2发布

1 小时前 1 阅读来源:Wired AI
谷歌AI进入现实世界:Gemini Robotics 2发布

AI 中文改写

原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接

Google DeepMind 刚刚发布了其人工智能模型 Gemini 的新版本——Gemini Robotics 2,这个模型能够控制多种不同类型的机器人,包括能够完成拧灯泡、系垃圾袋等精细操作的人形机器人。这标志着谷歌在将 AI 从数字世界带入物理世界方面迈出了重要一步。 Gemini Robotics 2 的核心创新在于它将多个不同的 AI 模型整合到一个系统中。具体来说,它包含一个视觉语言模型(VLM),能够理解图像和视频,与人类进行交流,并推理如何执行不同的任务;同时还有两个视觉语言动作模型(VLA),专门训练来理解如何在物理空间中移动,控制机器人的全身动作以及抓取器或手部的精细操作。在发布前的视频演示中,谷歌展示了多款机器人使用这个整合模型自主完成复杂任务,例如 Apptronik 的 Apollo 2 机器人使用 Sharpa 公司的手部装置整理货架。值得注意的是,谷歌 DeepMind 是通过人类远程操作、视频示例和模拟训练相结合的方式来训练模型的——目前 AI 模型还无法在没有特定训练的情况下执行广泛的复杂任务。 这个发布背后有更深层的战略考量。虽然 Anthropic 和 OpenAI 在聊天机器人和 AI 编程工具方面领先,但谷歌在机器人研究领域有着更强的历史记录,并发表过许多关于用 AI 训练机器人做有用事情的重要研究。谷歌 DeepMind 机器人部门负责人 Carolina Parada 表示,这是“朝着实现物理 AGI(通用人工智能)的又一个里程碑,意味着让机器人能完成人类能做的任何事情”。此前,谷歌已经与腿式机器人领域的领导者波士顿动力公司合作,为这些机器提供“大脑”。然而,让前沿 AI 模型控制机器人在工作场所或家庭中移动并操作物体也伴随着风险。此前的研究表明,使用前沿 AI 控制机器人可能会产生意想不到甚至危险的行为。Parada 强调:“安全问题更加紧迫,因为你把它们放在很多其他情境中,会有很多不确定性出现,所以你需要更深入地理解安全问题。”为此,谷歌采取了多层安全方法,在每个模型层都设置了防护栏,并推出了 ASIMOV-Agentic 基准测试,用于衡量各种 AI 系统协作控制机器人时的安全性。谷歌 CEO Demis Hassabis 此前曾表示,他希望开发一个类似 Android 操作系统之于智能手机的、适用于多种不同机器人的 AI 操作系统。

以上为 AI 中文改写版本,如需查看英文原文请访问

英文原文 · Wired AI

内容版权归原作者及 Wired AI 所有

这篇文章对你有帮助吗?
觉得有用?分享给更多人

留言 · 0

暂无留言,来说两句吧

留言经合规过滤后展示,禁止违法内容