研究人员让AI驾驶丰田卡罗拉去买汉堡
18 小时前 4 阅读来源:Wired AI

AI 中文改写
原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接
三位AI工程师最近做了一件让整个行业侧目的事:他们让OpenAI的GPT-6 Astra大模型直接操控一辆2024款丰田卡罗拉,穿过加州湾区一家In-N-Out汉堡店的汽车穿梭通道,顺利取到了午餐。整个过程没有预先编程,没有专门训练,只靠一个聊天界面连接服务器,服务器再连接挡风玻璃上的摄像头和汽车的动力转向系统。副驾上坐着安全驾驶员,脚始终悬在刹车上。车辆缓慢但平稳地驶向取餐窗口,其中一位工程师感叹:“也许AGI真的来了。”
这件事之所以值得关注,不在于自动驾驶本身——Waymo和特斯拉早就上路了——而在于操控汽车的是一个为生成文本和代码而设计的大语言模型,而且它是在没有任何事先指导的情况下即兴完成的。这背后指向一个更大的趋势:语言模型正在开始获得对物理世界的基本理解能力。Axiom的三位工程师在业余时间做了这个实验,他们此前发现Astra能构建复杂的三维模拟场景,于是好奇这种能力能否迁移到真实世界的导航中。他们先试了SpaceXAI的Grok,又试了OpenAI和Anthropic的最新模型,最初模型甚至拒绝接管车辆控制权。
这个实验并非孤例。Scale AI的研究科学家郭兴刚与一家名为Elorian AI的初创公司合作开发了一个叫“人类第六感”的基准测试,专门衡量AI模型理解物理场景的能力。Elorian的CEO Andrew Dai此前在Google DeepMind做研究,他认为更好的视觉推理将打开大量新应用,比如判断餐厅顾客是否吃得满意,或者让机器人在家庭环境中正常工作。他说:“没有这个能力,你根本无法想象家用机器人。”
对跨境电商卖家和AI从业者来说,这件事的意义在于:大语言模型的能力边界正在从纯数字世界向物理世界延伸。今天它能开车取汉堡,明天就可能操控仓库机器人分拣包裹、在无人配送场景中做实时决策。当然,把一个通用模型放在两吨重的高速钢铁上,风险不言而喻。三位工程师自己也承认这是高风险操作。但随着物理理解能力提升,AI将以令人印象深刻——也可能令人不安——的方式介入现实世界。这个领域正在成为继文本、图像、代码之后,AI公司争夺的下一个前沿阵地。
这篇文章对你有帮助吗?
觉得有用?分享给更多人
留言 · 0 条
暂无留言,来说两句吧
