Anthropic推出Claude Sonnet 5.5
7 小时前 1 阅读来源:anthropic.com
AI 中文改写
原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接
Anthropic 发布了 Claude 5.5 家族的第二款模型 Claude Sonnet 5.5,距离 Opus 5.5 亮相没多久。官方给它的定位很明确:不是旗舰,而是走量的主力。相比上一代 Sonnet 5,它跑得快了 30% 以上,完成大多数任务的成本最多能降 30%。价格表没变,输入每百万 token 收 2 美元(约合人民币 14.5 元),输出每百万 token 收 10 美元(约合人民币 72 元),缓存读取每百万 token 收 0.2 美元,但官方强调它完成同样的活通常消耗的 token 少得多,所以单任务实际花费反而更低。Anthropic 还预告,面向高并发、成本敏感场景的 Claude Haiku 5.5 会在未来几周内加入这个家族。
性能提升的幅度值得单独拎出来说。在智能体编程评测 Terminal-Bench 4.0 上,Sonnet 5.5 拿到 70.6%,而 Sonnet 5 只有 10.3%——这不是挤牙膏,是跨代式的跳变。在覆盖多种职业真实工作场景的 GDPval-AA 测试中,它只比 Opus 5.5 低两分。长程任务和图像理解也有突破,它是首个仅凭截图就能通关《宝可梦红》的 Sonnet 模型。Anthropic 同时坦承,基准分数只是一方面,在需要持续判断力的复杂开放式工作上,Opus 5.5 依然明显更强。换句话说,Sonnet 5.5 的甜区是边界清晰的日常任务:修 bug、做文档、做幻灯片、做表格,而且设计感不错。安全方面,由于它的网络安全能力已经接近 Opus 5,Anthropic 首次给 Sonnet 系列配上了此前只用于最强模型的网络防护和回退机制,生物安全防护则与 Sonnet 5 一致,两者都只针对少数高风险请求,常规软件开发和大部分生命科学工作不受影响。
对国内做跨境和出海的团队来说,这次更新的实际意义在于成本结构。过去想在智能体编程、批量文档处理、客服自动化这类场景里用上接近旗舰的能力,账单往往压不住;Sonnet 5.5 在低或中等推理强度下,就能以大约十分之一的单任务成本超过 Sonnet 5 的最好成绩。这意味着原本因为成本被砍掉的自动化环节——比如批量生成多语言商品页、自动处理退货工单、跑大规模数据清洗——现在可以重新算账。等到 Haiku 5.5 上线,高频低价值的调用还能再往下压一层。
这篇文章对你有帮助吗?
觉得有用?分享给更多人
留言 · 0 条
暂无留言,来说两句吧
