AI工具AI评分 头条 (80)AI 中文改写

Anthropic发布Claude Haiku 5.5,API价格降90%,对标GPT-6 Luna

3 小时前 1 阅读来源:venturebeat.com

AI 中文改写

原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接

Anthropic 在 10 月 7 日发布 Claude Haiku 5.5,把短请求的 API 价格直接砍到原来的十分之一。具体来说,当单次请求的 token 数低于 10 万时,输入价格降至每百万 token 0.1 美元,输出价格降至每百万 token 0.5 美元,与 OpenAI 的 GPT-6 Luna 完全持平。超过 10 万 token 的长请求则享受五折优惠,输入 0.5 美元、输出 2.5 美元。Anthropic 估算,综合考虑请求规模和 token 消耗变化后,企业跑同样的工作负载比 Haiku 4.5 便宜约 75%。这次发布还同步下调了 Sonnet 5.5 的缓存费用,并给 Max 和 Team 订阅用户每月发放 API 额度,显然不只是推一个便宜模型那么简单。 Haiku 5.5 的定位很明确:给企业级 AI 代理当"下手"。Anthropic 把它描述为 Opus 和 Sonnet 的辅助角色,后者仍是复杂编程任务的首选。金融 AI 公司 Rogo 给出的例子很直观——大模型负责组装一份财务演示文稿,Haiku 则去数据库里把某张幻灯片需要的营收数字捞出来。Rogo 应用 AI 团队的 Alex Wang 表示,这个模型"准确到我们可以放心用,又快到便宜到可以大量跑"。对做跨境电商的团队来说,这意味着批量处理商品描述翻译、评论分类、订单信息提取这类重复性工作时,成本压力会明显下降。 不过省钱有边界。10 万 token 是一道分水岭:超过这个门槛,价格立刻跳到输入 0.5 美元、输出 2.5 美元,虽然仍比 Haiku 4.5 便宜一半,但和短请求的九折降幅完全不是一个量级。Anthropic 称约 90% 的 Haiku 4.5 请求都落在短请求区间,所以大多数用户能吃到最大红利。但官方材料没有说明正好 10 万 token 的请求怎么计费,也没讲清楚具体是哪些 token 决定这个门槛,实际使用中需要留意账单。 横向对比来看,Haiku 5.5 的低价档确实有竞争力,但并非市场最低。OpenAI 的 GPT-6 Luna 在基础费率上和它一模一样,包括缓存价格,只是 Luna 的涨价门槛设在 27.2 万输入 token,比 Haiku 的 10 万宽松不少。Google 的 Gemini 3.5 Flash-Lite 标准价是输入 0.3 美元、输出 2.5 美元,比 Haiku 贵;Gemini 3.8 Flash 促销价 0.75 美元/3.75 美元,优惠到 2026 年底。Grok 4.3 和 4.7 的价格更高,GPT-6.1 Sol 和 Claude Sonnet 5.5 则都在输入 2 美元、输出 10 美元的档位。需要提醒的是,这些只是 token 单价,不等于完成同一项任务的总成本——token 消耗量、重试次数、准确率都会影响最终账单。 性能方面,Anthropic 公布的基准测试显示 Haiku 5.5 比 Haiku 4.5 有提升,在选定评测上领先 GPT-6 Luna,但仍落后于 Sonnet 5.5。这些是厂商自报数据,未经独立验证。另外,Anthropic 提到新版分词器在处理相同内容时会消耗略多 token,这也是它估算 75% 平均节省时已经考虑进去的因素。对正在选型的团队来说,价格表只是起点,真正要算的是跑完自己业务场景后的综合成本。

以上为 AI 中文改写版本,如需查看英文原文请访问

英文原文 · venturebeat.com

内容版权归原作者及 venturebeat.com 所有

这篇文章对你有帮助吗?
觉得有用?分享给更多人

留言 · 0 条

暂无留言,来说两句吧

留言经合规过滤后展示,禁止违法内容