谷歌称Gemini 3.8 Flash更“卖力”但成本或更高
3 天前 2 阅读来源:The Verge AI

AI 中文改写
原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接
谷歌刚刚发布了新一代轻量级模型Gemini 3.8 Flash,距离上一代3.7 Flash推出仅隔数周。谷歌宣称,新模型在复杂任务上会执行更多推理步骤,并“迭代式调用工具”,因此“更卖力干活”。但这份“勤奋”可能是有代价的——虽然它的入门定价与3.7 Flash完全一致,每百万输入tokens收费0.75美元,每百万输出tokens收费3.75美元,但谷歌自己也在文档中提醒:“为了最大化性能,模型可能会消耗更多tokens,尤其是在高努力级别下。”换句话说,单价没变,但账单可能变厚。
对于开发者而言,这其实是一个需要权衡的选择。如果追求极致性能和复杂任务处理能力,3.8 Flash的“多步推理”和“工具调用”特性确实能带来更优结果,但token消耗量会随之上升。反之,如果项目对成本敏感、任务相对简单,继续使用3.7 Flash则能有效控制token开销。谷歌此次并未强制升级,而是保留了旧版本供开发者按需选用,这在一定程度上缓解了成本焦虑。
从行业角度看,谷歌此举反映出大模型竞争正从“参数竞赛”转向“效率与成本平衡”的新阶段。对于中国跨境电商卖家和AI工具用户而言,这意味着在选择模型时不仅要看单价,更要评估实际任务中的token消耗模式。例如,在处理多轮客服对话、复杂商品描述生成或供应链数据分析时,3.8 Flash的“更努力”可能带来更精准的输出,但若任务简单,过度推理反而会造成资源浪费。建议开发者先在小流量场景中测试3.8 Flash的实际token消耗,再决定是否全面切换。目前,Gemini 3.8 Flash已向开发者开放,早期反馈显示其在代码生成和数据分析任务上表现亮眼,但具体成本效益仍需更多实际案例验证。
这篇文章对你有帮助吗?
觉得有用?分享给更多人
留言 · 0 条
暂无留言,来说两句吧
