谷歌发布Gemini 4 Argon新前沿模型
10 小时前 1 阅读来源:9to5google.com
AI 中文改写
原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接
谷歌正式发布新一代前沿模型Gemini 4 Argon,这是其在取消Gemini 3.5 Pro、集中资源打磨3.8 Flash之后,推出的首个采用全新命名体系的前沿模型。谷歌将其定位为“前沿智能的新纪元”,主打跨复杂长周期工作流的深度推理能力,覆盖编程、知识工作、网络安全防御和创意写作等场景。最直观的升级在输出端:单次输出上限从64K tokens跃升至100万tokens,意味着模型可以在一次任务中持续生成数十万字的推理链条,把过去需要拆成多轮才能完成的复杂问题一次性解决。在基准测试中,Argon在DeepSWE v1.1上拿到77.9%,领先Claude Opus 5.5的74.2%和GPT-6 Astra的74.1%。
对开发者和企业用户来说,更值得关注的是定价和落地节奏。Argon将率先向Google AI Ultra订阅用户和付费API客户开放,尝鲜价为每百万输入tokens 2美元、每百万输出tokens 10美元,缓存输入再打九五折;优惠期结束后恢复至每百万输入4美元、输出20美元。谷歌同时强调,该模型在网络安全防御上做了专门训练,将以“不设网络护栏”的方式向受信任的防御方和谷歌内部团队开放,以便充分发挥其漏洞修复能力——在评估漏洞修复的CWE-bench v1上,Argon以68%的成绩并列第一。此外,它在Zapier的AutomationBench(端到端业务流程执行)上以51.3%排名第一,在长视频理解基准LVBench上以91.7%达到当前最优水平。
谷歌此次还罕见地披露了安全防护细节,包括监控模型内部激活以识别滥用、针对间接提示注入攻击的防御(称其为“迄今最具韧性的模型”)、在高风险训练前隔离沙箱环境,以及监控思维链和动作、必要时中止执行的错位缓解机制。内部应用方面,Argon已在谷歌内部驱动数千名员工的工作流,例如有团队用Argon智能体分析全 fleet 性能遥测数据,自动识别并应用内存优化,上线后释放超过300 TiB内存,预计总节省可达500 TiB至1 PiB。对跨境电商卖家和AI工具用户而言,百万级输出上限配合多步推理能力,意味着长文档生成、多轮客服自动化、复杂选品分析等场景的单次调用成本结构可能被重新定义,而缓存输入的大幅折扣则对高频重复调用的应用更为友好。
这篇文章对你有帮助吗?
觉得有用?分享给更多人
留言 · 0 条
暂无留言,来说两句吧
