Claude Opus 5.5 降到 $4/$20,5 小时额度上调 20%,还给了一次可以存着用的额度重置

Anthropic 于 9 月 22 日发布 Claude Opus 5.5,模型 ID 为 claude-opus-5-5,同时上线 AWS、Google Cloud 与 Microsoft Azure。定价为每百万输入 token 4 美元、输出 20 美元,较 Opus 5 的 5 美元与 25 美元下调 20%;缓存读取从每百万 0.50 美元降至 0.20 美元,降幅 60%,五分钟缓存写入从 6.25 美元降至 5 美元,一小时写入为 8 美元,批量请求维持半价。公司的整体主张大于价目表本身:其称测试显示在默认设置下、典型工作负载上的花费比 Opus 5 低 40%,这一数字叠加了更低的单价、每个任务更少的 token 用量以及更少的服务算力。订阅侧,Anthropic 把 Pro、Max、Team 和按席位计费的 Enterprise 计划的五小时用量上限上调 20%,并称由于模型更便宜,五小时与每周额度实际可用得更远约 25%;订阅用户另获得一次可以存起来、自行选择时机使用的额度重置,Claude Code 的五小时会话上限自 9 月 22 日起上调 20%。其他变化包括输出速度比 Opus 5 快 30% 以上,Claude Code 与 Claude 平台上的快速模式最高快 2.5 倍、价格为每百万输入 8 美元、输出 40 美元;自适应思考无法关闭,effort 设置的默认值从 high 改为 medium,Anthropic 称 medium 在编程与知识工作评测上匹配或超过 Opus 5 的 high。公司预计将在未来几周推出 Claude Sonnet 5.5 与 Haiku 5.5。需要注意的边界有两处:安全分类器可能在工作流中途把请求改路由到更旧的模型,网络安全类任务尤为明显,经审核的研究者可申请其网络验证与生命科学验证计划以获得更宽的访问;另有个别报道称五小时上限是被「取消」,而多数报道描述为上调 20%。

这次把两个「涨」分开写了,而上次没有

本站 9 月 17 日写过一条:Anthropic 的公告强调 Claude Code 周额度「永久提升 25%」,但同期让一个临时的 50% 加成到期,两件事叠起来用户手上的实际额度比前一周少了约 17%。当时 X 上的开发者给原帖加了社区注释,公司删帖重发并承认了那个下降。 这次的表述干净得多,值得对照着记:**五小时上限上调 20%,是额度本身涨了;而「五小时与每周额度能用得更远约 25%」,是同样的额度买到的工作量变多了。**这是两件事,Anthropic 这次分开写了。 为什么要强调这个区别?因为后者取决于你的工作负载。**如果只报道那个 25%,读者会以为额度涨了 25%,而实际涨的是 20%,剩下那部分要靠模型变便宜来兑现**——兑现多少,因人而异。

「便宜 40%」是复合主张,可核验的那部分是 20%

价目表是硬的:$5/$25 降到 $4/$20,20%;缓存读取 $0.50 降到 $0.20,60%。 而 40% 是一个复合数字——它叠加了更低的单价、每个任务更少的 token 用量、以及更少的服务算力。后两项不在价目表上,取决于你的任务长什么样。 所以做采购或预算时的稳妥做法是:**按 20% 做保守假设,然后拿自己的任务去测那个复合数字。** 不过有一条能让你提前判断自己会落在哪一端:**降幅取决于缓存命中率。**Anthropic 自己说缓存读取占 agentic 和编程负载成本的大部分,而缓存读取降了 60%。所以长会话、大上下文反复读的场景,实际降幅会明显往 40% 那头走;而短请求、无缓存的一次性调用,就只有 20%。这个比例你自己的账单里查得到。 本站 7 月 13 日写过一轮 token 降价时的判断,在这里依然成立:**能省钱不等于会省钱**——缓存命中、模型分层、用量归因才是账单真降下来的关键。今天这次降价把这句话的分量放大了,因为缓存那一档的降幅是单价降幅的三倍。

最该被工程团队注意的不是降价,是两个默认值变了

第一个:**effort 的默认值从 high 改成了 medium。**Anthropic 说 medium 在编程与知识工作评测上匹配或超过 Opus 5 的 high,这个说法可能成立。但含义是——**你升级之后,同样的调用默认走了不同的推理预算。**加上自适应思考无法关闭,对需要输出稳定、可复现的流水线,这是一个必须专门回归测试的变更,不能当成透明升级。 第二个,也是更硬的一条:**安全分类器可能在工作流中途把请求改路由到更旧的模型**,网络安全类任务尤为明显。也就是说你以为整条链路在跑 5.5,中间某些请求可能不是。对生产系统,这意味着延迟和输出特征都可能在你没察觉时发生变化。经审核的研究者可以申请网络验证与生命科学验证计划拿更宽的访问,但对普通团队来说,值得做的是在日志里记下实际响应的模型标识,而不是假定它等于你请求的那个。

「可存起来的额度重置」是一个新机制,不只是多给点量

订阅用户这次拿到的不只是更高的上限,还有一次可以自己选时机使用的额度重置。 这个机制值得单独说,因为它不是「涨额度」的变体。**它把额度管理的一部分决策权交给了用户**——你可以在赶截止日、做大规模重构、或者临时要跑一批评测的那天把它用掉。对突发型用法,一次自选时点的重置比平均涨 20% 更有用。 代价是责任也一并交出去了:用不用、什么时候用,得你自己判断。这类机制通常会让重度用户受益更多,因为他们更清楚自己的峰值在哪。 最后标两处口径。一是有个别报道称五小时上限是被「取消」,多数报道描述为上调 20%,本站按多数报道采用后者,但这处分歧提醒读者以自己账户里看到的实际上限为准。二是快速模式的定价是 $8/$40,是标准价的两倍——**最高快 2.5 倍,代价是单价翻倍**,这笔账值不值取决于你的时间有多贵。 Sonnet 5.5 与 Haiku 5.5 预计在未来几周发布。同一天 OpenAI 也把 GPT-6 家族往下延伸并降价,本站今天另有一条写这件事——两家在同一天动价格,这不是巧合。

via: Betanews 报道The New Stack 报道Mixed News 报道Quartz 报道