AI工具AI评分 头条 (85)AI 中文改写

谷歌发布Gemini 4 Argon,重夺基准测试领先地位

10 小时前 1 阅读来源:venturebeat.com

AI 中文改写

原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接

Google在8月23日发布了新一代前沿AI模型Gemini 4 Argon,宣称在多项企业级基准测试中重新夺回对OpenAI和Anthropic的领先地位。不过这款模型目前并未全面开放,谷歌仅通过本月早些时候推出的Fairwind计划向部分受信任的网络安全防御人员开放,同时正在参与美国政府的自愿预发布模型访问流程。按照谷歌内部博客的说法,面向开发者、企业和消费者的广泛可用版本将“尽快”推出,优先顺序是付费API客户和Google AI Ultra订阅用户。 这次发布与其说是一次聊天机器人产品的更新,不如说是谷歌在经历OpenAI和Anthropic数月压制后的一次战略反击。谷歌将Argon的定位精准锚定在企业已经在花钱的三个方向:软件开发、专业知识工作和网络安全运营。从披露的18项基准测试来看,Argon在12项中 outright 领先,另有1项并列第一;GPT-6 Astra在3项中领先,Claude Opus 5.5在2项中领先。Argon的优势集中在企业级和长上下文场景,比如在Harvey法律代理基准上拿下19.6%,远超GPT-6 Astra的5.4%和Claude Opus 5.5的3.8%;在Zapier的端到端业务执行基准AutomationBench上得分51.3%,高于Claude的42.5%和GPT-6的41.4%;在长视频理解基准LVBench上以91.7%领先。但竞争远未结束,GPT-6 Astra在FrontierSWE v2和Terminal-Bench Science 0.1上均以10.5个百分点的优势反超,Claude Opus 5.5也在Terminal-bench 4.0上领先Argon约9个百分点。对跨境电商卖家和AI工具用户而言,这意味着企业级AI工具的选择窗口正在重新打开,但短期内还无法直接接入Argon,需要关注谷歌后续的开放节奏和定价策略。

以上为 AI 中文改写版本,如需查看英文原文请访问

英文原文 · venturebeat.com

内容版权归原作者及 venturebeat.com 所有

这篇文章对你有帮助吗?
觉得有用?分享给更多人

留言 · 0 条

暂无留言,来说两句吧

留言经合规过滤后展示,禁止违法内容