谷歌将推出新AI模型,员工称正测试更优模型。
23 小时前 1 阅读来源:businessinsider.com
AI 中文改写
原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接
谷歌正准备向公众推出其新一代大模型Gemini 4的首个版本Argon,但公司内部员工已经在测试性能更强的后续版本。据Business Insider看到的内部文件和截图,谷歌员工近日正在试用一款内部代号为Carbon的Gemini 4新版本。该模型已出现在谷歌内部编程平台Jetski上,可能是一次针对Argon的更新,也就是所谓的检查点版本。一名员工在试用后表示,Carbon在编程方面的表现感觉像Anthropic最强的长期智能体编程模型Opus 5.5,但也补充说还需要更多测试才能下结论。
谷歌内部这一系列动作,折射出AI编程智能体赛道正在急剧升温的竞争态势。谷歌9月底才正式发布Gemini 4系列,如今内部已迭代出多个版本。根据内部文档,谷歌至少测试了Argon、Barium和Carbon三个代号,其中Barium-B被选定为最终以Argon之名公开发布的版本。不过,Carbon究竟会作为Argon的又一次更新,还是作为Gemini 4家族中的独立模型推出,目前尚无法确定。早期Argon版本在内部评价不一,有员工认为它在部分编程任务上落后于Anthropic的Claude Opus 5,而Carbon等新版本有望缩小这一差距,但谷歌并不保证一定会将这些内部测试版本对外发布。
这一动态对开发者和企业用户而言意义重大。目前Anthropic和OpenAI在面向复杂工程任务的编程模型上已取得明显领先,谷歌正承受着证明自己仍处于前沿的压力。谷歌上月宣称Argon在法律、金融等领域的编程和知识工作基准测试中达到了前沿水平,并特别强调了防御性网络安全能力,计划先通过Fairwind计划向合作伙伴开放,再逐步向公众推广。与此同时,谷歌本周还发布了一款面向工作场景的通用Gemini AI智能体,加码智能助手领域的竞争。对于依赖AI编程工具的中国出海开发者和跨境电商技术团队来说,谷歌能否借Carbon等新版本追平甚至反超Anthropic和OpenAI,将直接影响他们未来在工具选型和开发效率上的选择空间。
这篇文章对你有帮助吗?
觉得有用?分享给更多人
留言 · 0 条
暂无留言,来说两句吧
