财富科技:谷歌重返AI前沿之旅
18 小时前 1 阅读来源:fortune.com
AI 中文改写
原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接
谷歌本周发布了Gemini 4 Argon,号称是迄今为止最强的大模型。目前该模型仅通过谷歌的Fairwind计划向部分网络安全合作伙伴开放,谷歌内部员工也可使用。从公司公布的基准测试来看,Argon在长上下文处理、编程和企业级智能体任务上表现突出,而这些恰恰是谷歌此前相对薄弱的领域。凭借Argon,谷歌重新回到了AI前沿竞争的牌桌上。
不过,围绕这款模型的争议也随之而来。据彭博社报道,部分使用过Argon的员工反映,它在基准测试中成绩亮眼,但实际使用体验令人失望,尤其是在前端设计等编程任务上表现不佳,且模型体量过大导致运行成本高昂。两位知情人士称,Argon存在“刷榜”迹象,即针对测试分数进行调优,而非真正提升实用能力。谷歌方面则回应称,说该模型编程能力不行的说法“不准确”。这一事件折射出当前AI大模型竞争中的一个普遍困境:基准测试成绩与真实场景表现之间的鸿沟越来越大,而企业客户最终买单的是实际效果,不是跑分。对跨境电商卖家和AI工具用户而言,选型时更应关注模型在自己业务场景中的实测表现,而非厂商宣传的榜单排名。
其他值得关注的动态:OpenAI因三名员工向AI安全组织分享信息而将其解雇;AI“教父”Yann LeCun表示对人类灭绝“零担忧”,并称Anthropic CEO Dario Amodei“妄想”;Anthropic的IPO据称将在感恩节前推进;围绕AI算力管道的交易管线正在形成;一起针对英伟达品牌卡车的盗窃案——车上装了两万磅沙子——揭示了大型科技公司面临的1.5亿美元AI硬件被盗难题;拥有111年历史的开利公司(Carrier)借助AI与暖通空调的结合,跻身《财富》AIQ 75榜单前十。
这篇文章对你有帮助吗?
觉得有用?分享给更多人
留言 · 0 条
暂无留言,来说两句吧
