AI评分 头条 (82)AI 中文改写
Gemini 3.7 Flash:谷歌最强全能模型
14 小时前 1 阅读来源:blog.google
AI 中文改写
原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接
谷歌今日正式发布Gemini 3.7 Flash,这是其Flash系列中面向编码和智能体任务的最强“工作马”模型。距离上一代3.6 Flash发布仅过去三周,谷歌表示此次快速迭代直接源于开发者反馈和算法创新,并计划将这些成果应用到未来模型中。新模型在软件工程、知识工作和网页开发流程上均有显著提升,且入门价格仅为3.6 Flash原始定价的一半,即每百万输入tokens收费0.75美元,每百万输出tokens收费3.75美元。
在核心性能上,Gemini 3.7 Flash相较3.6 Flash实现了跨越式进步。在代码调试和问题修复任务中,其首次生成代码的准确率大幅提高,在FrontierCode 1.1 Main基准测试中得分从34.4%跃升至43.6%,在DeepSWE v1.1上更是从49.0%提升至65.3%,意味着它已能更可靠地生成生产级代码。针对金融、法律和生物科学等知识密集型领域,模型在处理复杂文档的GDP.pdf基准上得分从22.0%翻倍至34.0%,在AutomationBench真实业务流程测试中也从17.0%提升至30.4%。网页开发方面,3.7 Flash能用更少的提示词生成功能更完整的布局和应用,在WebDev Arena的Elo评分达到1588分,明显高于前代的1538分。
对于开发者而言,3.7 Flash带来的体验升级同样关键。它更善于适应开发过程中的障碍,能在必要时主动澄清意图,并以更高保真度遵循指令。在涉及多步骤规划和工具调用的任务中,模型会投入更多“思考精力”,执行过程更加严谨,从而减少人工监督和重试次数。谷歌还展示了该模型在创意场景中的潜力,例如结合Nano Banana图像模型实时生成3D游戏角色和纹理,或编排子智能体构建交互式视差网页组件。从今天起,面向Google AI Pro和Ultra订阅用户开放的Gemini Spark智能体也已切换至3.7 Flash,该服务覆盖全球160多个国家,可全天候运行并代为执行任务。
这篇文章对你有帮助吗?
觉得有用?分享给更多人
留言 · 0 条
暂无留言,来说两句吧
