AI评分 头条 (82)AI 中文改写

Gemini 3.8 Flash及网络安全版发布

3 天前 2 阅读来源:Google DeepMind Blog

AI 中文改写

原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接

谷歌DeepMind今日发布Gemini 3.8 Flash及3.8 Flash Cyber两款新模型,距离上一代3.7 Flash发布仅三周,这也是谷歌在六周内第三次推出Flash系列模型。新模型主打推理与编程能力,在保持与3.7 Flash相同速度和低成本的前提下,实现了性能的显著跃升,尤其针对智能体工作流和网络安全两大场景进行了深度优化。 Gemini 3.8 Flash被定位为“最智能的勤勉型模型”,在软件工程、智能体任务以及专业领域的多步推理上相较3.7 Flash有大幅提升。定价方面,3.8 Flash延续了3.7 Flash的入门价格,每百万输入token收费0.75美元,每百万输出token收费3.75美元。而另一款3.8 Flash Cyber则是谷歌迄今最强的网络安全模型,在漏洞检测和自动修复方面达到前沿水平,目前仅通过全新的Fairwind项目向受信任的防御方开放。两款模型共享同一底层智能,并通过长周期智能体循环机制不断递归评估和优化模型表现,谷歌表示,在网络安全这一高要求领域的严格训练是此次编程与推理能力大幅提升的关键驱动力之一。 从实际性能来看,3.8 Flash在DeepSWE v1.1长周期软件工程基准测试中,以远低于大型前沿模型的成本,自主解决端到端复杂工程问题的能力超过了多数更大规模的竞品。在专业领域,它在Vals Finance Agent V2和Harvey法律智能体基准测试中均超越了3.7 Flash及其他前沿模型,HLE-Verified得分达到54.9%,展现出覆盖STEM、人文学科和专业领域的多步推理能力。这些成绩源于一个核心设计选择:3.8 Flash在复杂任务上“更努力”——它会执行额外的推理步骤,并迭代调用工具,有时为了最大化性能会消耗更多token。对于计算效率优先的应用场景,开发者可以选择较低的努力级别来减少token开销,或继续使用仍获全面支持的3.7 Flash。 谷歌在官方博客中展示了多个3.8 Flash的实际应用案例,包括仅凭简单提示词在Google Antigravity中构建出包含谜题、环境叙事和Nano Banana生成纹理的沉浸式3D游戏,以及单次提示生成可玩的DOS版Google Maps。此外,还有基于美国地质调查局真实数据生成的地理地形交互可视化,以及在Google AI Studio中构建的硬件解剖3D可视化工具。这些演示凸显了模型在创意编码和复杂应用开发方面的潜力。 对于跨境电商卖家和出海企业而言,Gemini 3.8 Flash的发布值得关注。其强大的编程能力和低推理成本意味着,中小团队可以用更低的算力预算实现更复杂的自动化运营工具,例如智能客服、多语言商品描述生成、供应链预测分析等。而3.8 Flash Cyber的推出则针对日益严峻的跨境电商网络安全环境——独立站和品牌官网经常面临恶意攻击、数据泄露和支付欺诈风险,谷歌此次将前沿级漏洞检测和自动修复能力引入模型,虽然目前仅向受信任防御方开放,但预示着未来AI驱动的安全防护将更加普及,卖家在选型AI工具时也应将安全能力纳入考量。

以上为 AI 中文改写版本,如需查看英文原文请访问

英文原文 · Google DeepMind Blog

内容版权归原作者及 Google DeepMind Blog 所有

这篇文章对你有帮助吗?
觉得有用?分享给更多人

留言 · 0

暂无留言,来说两句吧

留言经合规过滤后展示,禁止违法内容