Claude Sonnet 5 今天本该涨到 $3/$15,但涨价取消了:官方文档确认 $2/$10 成为标准价

Claude Sonnet 5 发布时给的 $2/$10(每百万输入/输出 token)标注为优惠价,有效期至 2026 年 8 月 31 日,9 月 1 日起本应涨到 $3/$15。Anthropic 已取消这次上调:官方定价文档现在明确写着,原定 9 月 1 日的涨价不会发生,$2/$10 就是标准价。需要注意的是不少第三方定价指南仍在按 $3/$15 列。另有一处更影响实际账单的变化与费率无关:Claude 4.7 及之后的模型换了新分词器,同样的文本大约多产生 30% 的 token,Sonnet 4.6 及更早仍用旧分词器。

先把当前价格钉死

按 Anthropic 官方定价文档,Claude Sonnet 5 现在是:输入 $2/百万 token,输出 $10/百万 token;5 分钟缓存写入 $2.50,1 小时缓存写入 $4,缓存命中 $0.20。批处理 API 五折,即 $1/$5。文档里挂着一条专门的说明:发布时标注为「优惠价至 2026 年 8 月 31 日」的 $2/$10 现在就是标准价,原定 2026 年 9 月 1 日上调到 $3/$15 的计划不会发生。 这条值得单独写一篇,是因为时间点:今天正是原定涨价生效日,而且不少第三方定价指南、对比表和成本测算文章仍然按 $3/$15 在列——如果你上个月做预算时抄了其中一份,现在的数字是偏高的。做过年度预估的团队值得回去改一遍。 顺带一个对照:同代的 Sonnet 4.6、4.5 仍是 $3/$15,也就是说 Sonnet 5 比它的前代便宜三分之一,而不是持平。

费率没涨,但账单可能还是变了

比费率更容易被忽略的是分词器。官方文档的另一条说明写得很清楚:Claude 4.7 及之后的模型(以及 Mythos Preview)使用了新分词器,同样的文本大约多产生 30% 的 token,具体幅度取决于内容和负载形态;Sonnet 4.6 及更早的模型用的是旧分词器。 把两件事放一起算:从 Sonnet 4.6($3/$15,旧分词器)迁到 Sonnet 5($2/$10,新分词器),费率降了三分之一,token 数大约涨三成,净效果因负载而异,不能只看单价就下结论。要做迁移决策的话,靠谱的方式是拿一批真实请求跑一遍,比对总账单,而不是比对每百万 token 的价格。 另有独立测试指出,在较高的 effort 设置下 Sonnet 5 会产生大量思考 token,单任务成本可能高于 Opus 4.8——这条来自第三方测试,未经官方确认,但方向上和「按任务算账而不是按单价算账」是一致的。

用云厂商接入的要单独确认

如果你走的是 Amazon Bedrock、Google Cloud Vertex AI 或 Microsoft Foundry,账单由云厂商出,条款也各自独立,官方文档明确让人去各家的定价页确认。另外几条容易踩的:Claude 4.6 及之后的模型指定美国境内推理(inference_geo 设为 us)会有 1.1 倍乘数;Bedrock 和 Google Cloud 的区域端点比全球端点贵 10%。

via: Anthropic 官方定价文档Anthropic:Claude Sonnet 5 发布说明