AI工具AI评分 头条 (80)AI 中文改写

谷歌发布Gemini 3.8 Flash及网络安全版

32 分钟前 1 阅读来源:blog.google

AI 中文改写

原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接

谷歌今天正式发布了新一代模型 Gemini 3.8,距离上一代 3.7 Flash 发布仅过去三周,这也是谷歌在六周内推出的第三款 Flash 系列模型。这次发布包含两个版本:面向通用开发者的 Gemini 3.8 Flash,以及专为网络安全场景设计的 Gemini 3.8 Flash Cyber。前者在保持与 3.7 Flash 相同定价(每百万输入 token 0.75 美元、每百万输出 token 3.75 美元)的前提下,大幅提升了代码生成、智能体任务处理和复杂多步推理能力,被视为目前性价比最高的"全能打工人"模型。 这次升级的核心变化在于模型"更愿意下功夫"。谷歌官方博客解释,3.8 Flash 在复杂任务上会主动执行额外的推理步骤,并反复调用工具来验证结果,而不是像以往那样追求"一步到位"的省 token 策略。这种设计直接反映在第三方基准测试上:在 DeepSWE v1.1 长周期软件工程测试中,3.8 Flash 的端到端自主解题能力已经超过多数价格更高的前沿大模型;在金融领域的 Vals Finance Agent V2 和法律领域的 Harvey's Legal Agent Benchmark 上,它也全面领先 3.7 Flash。此外,该模型在 HLE-Verified 综合推理测试中拿到 54.9% 的分数,说明其在 STEM、人文和专业领域的跨学科推理能力已经接近顶级模型水准。 对于开发者来说,这次发布还有一个值得注意的取舍逻辑。谷歌明确表示,3.8 Flash 在"高努力模式"下可能会消耗更多 token 来换取性能上限,但如果你的应用场景对计算成本极其敏感,可以调低努力等级来控制 token 开销,或者继续使用完全受支持的 3.7 Flash。这种"丰俭由人"的弹性设计,意味着跨境电商卖家在搭建客服机器人、选品分析或广告投放优化等 AI 工作流时,可以根据预算灵活选择模型档位,而不必为了新版本被迫增加算力成本。 另一个重要看点是与 3.8 Flash 同步推出的网络安全专用版本 Flash Cyber。这一版本在漏洞检测和自动修复方面达到了前沿水平,但谷歌并未将其全面开放,而是通过一个新的"Fairwind 计划"定向提供给经过审核的防御方(如安全团队、红队研究人员)。这一策略显然是为了防止强大的攻击代码生成能力被滥用。对普通卖家而言,虽然用不上 Cyber 版本,但谷歌透露,训练 Cyber 时积累的高强度安全数据反过来也增强了 3.8 Flash 的代码推理能力——这意味着你在日常使用中遇到的代码生成质量,实际上也受益于这次安全领域的"特训"。 目前 Gemini 3.8 Flash 已开放 API 调用,定价与 3.7 Flash 保持一致。考虑到谷歌在六周内连续三次迭代 Flash 系列,这种"高频打新"的节奏正在倒逼整个 AI 应用层加速适配。对于依赖大模型 API 的跨境电商工具开发者来说,建议尽快测试 3.8 Flash 在自身业务场景(如多语言客服、评论分析、合规审查)中的实际表现,同时留意 token 消耗变化——毕竟"更努力"的模型,在某些任务上可能会让你的账单悄悄变厚。

以上为 AI 中文改写版本,如需查看英文原文请访问

英文原文 · blog.google

内容版权归原作者及 blog.google 所有

这篇文章对你有帮助吗?
觉得有用?分享给更多人

留言 · 0

暂无留言,来说两句吧

留言经合规过滤后展示,禁止违法内容