行业动态AI评分 一般 (63)AI 中文改写

谷歌发布Gemini Robotics ER 2

1 小时前 2 阅读来源:blog.google

AI 中文改写

原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接

谷歌刚刚发布了Gemini Robotics ER 2,这是其“具身推理”机器人模型的最新版本。简单来说,它不再只是一个能看懂周围环境的“眼睛”,而是升级成了能指挥机器人行动的“大脑”。这个新模型允许机器人实时观看视频流、规划多步骤任务,甚至让多个机器人协同工作,完成单个机器人无法独立完成的复杂流程。 这次升级的背景是,谷歌认为机器人要在真实世界中真正帮到人类,光有精确的空间感知能力远远不够,它们还必须能“快速思考”,根据物理世界的实时变化来调整决策和行动节奏。Gemini Robotics ER 2正是为此而生。它相当于一个高级指挥官,负责与人类对话、理解物理世界、规划任务步骤,然后把具体的动作执行指令下发给底层的视觉-语言-动作模型(VLA模型)。更关键的是,它还能原生调用谷歌搜索等外部工具来获取信息,或者执行用户自定义的功能。这意味着机器人可以一边执行当前动作,一边“思考”下一步该做什么,实现了“边做边想”。 对跨境电商卖家和AI从业者来说,最值得关注的是两个核心变化。第一是自我纠错能力:通过持续观看视频流,机器人现在能追踪自己的进度,如果某个步骤出错(比如抓取物品时滑落),它能即时发现并调整,而不是机械地执行完所有错误指令。第二是多机器人协作:在仓库或工厂等共享空间里,多个机器人可以像团队一样分工合作,完成更复杂的物流分拣或装配流程。开发者现在可以通过Gemini API、Google AI Studio或Gemini企业代理平台(私有预览版)直接调用这个模型。谷歌还提供了配置示例和提示词模板,帮助开发者快速上手,为机器人赋予更实用的物理AI能力。对于正在探索自动化仓储、柔性制造或智能客服机器人的中国卖家而言,这意味着一套更成熟、更接近商业落地的机器人“大脑”方案已经开放。

以上为 AI 中文改写版本,如需查看英文原文请访问

英文原文 · blog.google

内容版权归原作者及 blog.google 所有

这篇文章对你有帮助吗?
觉得有用?分享给更多人

留言 · 0

暂无留言,来说两句吧

留言经合规过滤后展示,禁止违法内容