先把当前价格钉死
按 Anthropic 官方定价文档,Claude Sonnet 5 现在是:输入 $2/百万 token,输出 $10/百万 token;5 分钟缓存写入 $2.50,1 小时缓存写入 $4,缓存命中 $0.20。批处理 API 五折,即 $1/$5。文档里挂着一条专门的说明:发布时标注为「优惠价至 2026 年 8 月 31 日」的 $2/$10 现在就是标准价,原定 2026 年 9 月 1 日上调到 $3/$15 的计划不会发生。 这条值得单独写一篇,是因为时间点:今天正是原定涨价生效日,而且不少第三方定价指南、对比表和成本测算文章仍然按 $3/$15 在列——如果你上个月做预算时抄了其中一份,现在的数字是偏高的。做过年度预估的团队值得回去改一遍。 顺带一个对照:同代的 Sonnet 4.6、4.5 仍是 $3/$15,也就是说 Sonnet 5 比它的前代便宜三分之一,而不是持平。
费率没涨,但账单可能还是变了
比费率更容易被忽略的是分词器。官方文档的另一条说明写得很清楚:Claude 4.7 及之后的模型(以及 Mythos Preview)使用了新分词器,同样的文本大约多产生 30% 的 token,具体幅度取决于内容和负载形态;Sonnet 4.6 及更早的模型用的是旧分词器。 把两件事放一起算:从 Sonnet 4.6($3/$15,旧分词器)迁到 Sonnet 5($2/$10,新分词器),费率降了三分之一,token 数大约涨三成,净效果因负载而异,不能只看单价就下结论。要做迁移决策的话,靠谱的方式是拿一批真实请求跑一遍,比对总账单,而不是比对每百万 token 的价格。 另有独立测试指出,在较高的 effort 设置下 Sonnet 5 会产生大量思考 token,单任务成本可能高于 Opus 4.8——这条来自第三方测试,未经官方确认,但方向上和「按任务算账而不是按单价算账」是一致的。
用云厂商接入的要单独确认
如果你走的是 Amazon Bedrock、Google Cloud Vertex AI 或 Microsoft Foundry,账单由云厂商出,条款也各自独立,官方文档明确让人去各家的定价页确认。另外几条容易踩的:Claude 4.6 及之后的模型指定美国境内推理(inference_geo 设为 us)会有 1.1 倍乘数;Bedrock 和 Google Cloud 的区域端点比全球端点贵 10%。