先说会把你现有代码打挂的那条
强制工具调用没了。tool_choice 设成 any 或某个具体工具名,现在直接返回 400 错误。官方给的理由是这个模型的思考始终开启,而强制调用会跳过思考,把推理挤进工具参数里,反而降低参数质量。auto 和 none 仍然支持。 推荐的替代写法是用 auto 配合严格工具使用或结构化输出。如果你的场景确实需要在长对话的当前这一轮强制某个工具,官方给的做法是在最新用户消息之后追加一条 role 为 system 的消息,点名该工具并说明必须调用——这样做的好处是更早的对话轮次保持逐字节不变,提示词缓存不会失效。 有一个网关层面的坑值得单独记:LiteLLM 会把 OpenAI 的 tool_choice: "required" 映射成 Anthropic 的 any,所以一段在 Fable 5 上跑得好好的代码,一行不改换到 5.1 就会失败。 另外两处破坏性变更:更早的模型读不了它的思考块;编辑更早的对话轮次会使思考块失效——后者目前对 2026 年 8 月 31 日及之后创建的 API 账户强制执行,预计未来某个版本会推及所有人。
「便宜 45%」这个数字要拆开看
先看确定的:输入 10 美元、输出 50 美元每百万 token,没变。变的是缓存读取,从 1.00 美元降到 0.25 美元,降 75%——换算成倍率是基础输入价的 0.025 倍,而其他所有 Claude 模型都是 0.1 倍。这是实实在在的结构性变化,对重度依赖长上下文缓存的 agent 负载影响最大。 再看需要打折扣的:25% 和 45% 这两个数字来自 Anthropic 自己 2026 年 8 月四周的用量数据,覆盖 Claude Enterprise、Claude Code 和 API,按默认 effort 统计——是厂商自测,不是第三方基准。而且省的是按 token 计费的部分,订阅制用户看不到这个折扣。 两家第三方的测量还给出了相反的结论。Artificial Analysis 测得在 max effort 下,Fable 5.1 每完成一个任务的成本高于 Fable 5,因为它产出的输出 token 约为 1.7 倍;Cognition 在自己的编码基准上测得反方向——每任务 2.68 美元,低于此前的 5.84 美元。两者不矛盾,只是说明结论强依赖 effort 档位和任务形态。真要算账,还是得拿自己的负载跑一遍。
推理档位和行为变化
档位从三档扩到五档:low、medium、high、xhigh、max,且不能完全关闭思考。默认值随入口不同——Claude Code 里默认 High,Claude Cowork 和 Claude.ai 上默认 Medium。通过一个 beta 头可以按消息切换 effort 而不使提示词缓存失效。 一条容易踩的提示写在官方文档里:不同模型之间,effort 档位的名字不代表同样的思考量,在 Fable 5 上做过的 effort 扫描结果不能直接搬过来。 行为上还有几处需要重新适配:并行工具调用变得更不稳定,原本 Fable 5 会批量发起多个调用的 agent 循环,现在可能变成每轮一个;模型叙述变少,低 effort 下更倾向直接凭记忆作答;改文件时更偏好整文件重写而不是精准局部编辑。另外 Fable 5.1 和 Mythos 5.1 都不支持 Priority Tier,而 Fable 5 支持。
放在这条产品线的历史里
Fable 5 是 6 月 9 日发布的,此后经历过一次全球停用、19 天后于 6 月 30 日恢复——本站当时写过那次「只活了 4 天」的停用。5.1 距 5 只隔三个月。官方这次还提到安全防护的调整:网络安全方向的误报比此前减少 60%,允许漏洞发现但不允许漏洞利用开发。 对读者的实际含义分两类。用订阅版的,能感知到的主要是响应风格变化(话变少、更爱整文件重写),成本上没有直接变化。走 API 的,建议按这个顺序做:先搜代码里有没有 tool_choice 的 any 或具名用法(包括经由 LiteLLM 这类网关的间接映射),再拿真实负载重跑一遍 effort 扫描——旧的档位结论不能沿用,最后才是评估缓存降价能给你省多少。
via: Anthropic 官方公告、Claude 文档:Fable 5.1 有什么新变化、Claude 文档:迁移指南、MarkTechPost