把 claude-fable-5 换成 claude-fable-5-1,第一次请求可能顺利返回;但到了真实环境,你也许才会发现工具路由器失效了,或者可变的对话历史无法继续使用。对于长时间运行、缓存使用频繁的任务,Fable 5.1 更值得作为默认模型;但它并不是完全无风险的即插即用升级:标准价格和各项限制没有变化,API 行为却有三处关键调整。
先说结论:缓存型 Agent 值得升级,但不必所有请求都换
Claude Fable 5.1 是 Claude Fable 5 的当前继任版本,Anthropic 官方文档也建议迁移到新版本以获得更好的性能。实际收益最明显的场景,是 Agent 需要反复读取一段很长的提示词前缀:缓存读取价格从每百万 token $1 降至 $0.25,而标准输入和输出价格仍分别为每百万 token $10 和 $50。(Anthropic 的 Fable 5.1 概览)
| 如果你的工作负载…… | 建议从……开始 | 原因 |
|---|---|---|
| 会重复使用很长的系统提示词、代码库或文档上下文 | Fable 5.1 | 缓存读取便宜 75%,而且 Anthropic 报告称其 Agent 能力更强。 |
使用 tool_choice: {"type":"any"} 等强制工具调用 | 切换前先测试 Fable 5.1 | Fable 5.1 会以 400 错误拒绝强制选择工具。 |
| 需要编辑或重建较早的对话轮次 | 先继续使用 Fable 5,直到历史记录层完成适配 | Fable 5.1 会将思维块与前置提示词、工具和历史记录绑定。 |
| 追求最低的标准 token 价格 | 两款 Fable 都不是首选 | 两者的输入价格都是每百万 token $10,输出价格都是每百万 token $50。 |
| 运行普通、无缓存请求,且现有 Fable 5 集成稳定 | 先做一次评测 | 标准价格并没有下降,基准测试收益也会因任务而异。 |
从 Fable 5 到 Fable 5.1,具体改了什么
Claude Fable 5.1 延续了 Claude Fable 5 的核心容量规格:1-million-token 上下文窗口、128,000-token 最大输出,以及始终开启的自适应思考。官方文档列出的差异主要包括生命周期状态、知识截止时间从 January 2026 更新为 June 2026、更低的缓存读取价格,以及工具和思维块相关的新 API 行为。(Fable 5 旧版概览;Fable 5.1 模型概览)
| 规格 | Claude Fable 5 | Claude Fable 5.1 |
|---|---|---|
| API 模型 ID | claude-fable-5 | claude-fable-5-1 |
| 生命周期 | 活跃,旧版 | 活跃,最新 Fable 模型 |
| 发布日期 | June 9, 2026 | September 1, 2026 |
| 上下文窗口 | 1M tokens | 1M tokens |
| 最大输出 | 128K tokens | 128K tokens |
| 思考 | 自适应,始终开启 | 自适应,始终开启 |
| 默认工作强度 | High | High |
| 可靠知识截止时间 | January 2026 | June 2026 |
| 输入 / 输出价格 | $10 / $50 per MTok | $10 / $50 per MTok |
| 缓存读取价格 | $1 / MTok | $0.25 / MTok |
Fable 5.1 可通过 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 以及 AWS 上的 Claude Platform 使用。Anthropic 列出的 Fable 5 也覆盖相同的平台系列,最早不会在 June 9, 2027 前退役;Fable 5.1 的计划退役时间则不早于 September 1, 2027。(Fable 5.1 的可用性与生命周期;Fable 5 的可用性与生命周期)
真正降价的是缓存读取,不是标准 token 价格
对于普通的新输入和输出 token,Fable 5.1 并没有更便宜。它与 Fable 5 一样,输入价格为每百万 token $10,输出价格为每百万 token $50;差别在于缓存读取从每百万 token $1 降到了 $0.25。(Anthropic 定价文档)
| 使用类型 | Fable 5 | Fable 5.1 | 变化 |
|---|---|---|---|
| 新输入 | $10 / MTok | $10 / MTok | 无变化 |
| 输出 | $50 / MTok | $50 / MTok | 无变化 |
| 5 分钟缓存写入 | $12.50 / MTok | $12.50 / MTok | 无变化 |
| 1 小时缓存写入 | $20 / MTok | $20 / MTok | 无变化 |
| 缓存读取 | $1 / MTok | $0.25 / MTok | 降低 75% |
| 批处理输入 / 输出 | 50% 折扣 | 50% 折扣 | 官方标注的折扣相同 |
举个简单例子:假设一个 Agent 读取一段缓存中的 1-million-token 项目上下文 10 次,然后生成 200,000 个输出 token。缓存读取部分在 Fable 5 上需要 $10,在 Fable 5.1 上只需 $2.50;输出部分两款模型都是 $10。在这个特定假设下,总 token 费用会从 $20 降至 $12.50,降幅为 37.5%。
实际节省多少,还要看缓存命中率、缓存写入、输出长度、重试次数、工具调用和故障转移路由。Anthropic 估计,典型工作负载的成本大约可降低 25%,高度 Agent 化的工作负载最高可降低约 45%。(Anthropic 的 Fable 产品页面)
订阅套餐的使用规则与 API 成本是两回事。Anthropic 帮助中心表示,Fable 5 和 Fable 5.1 目前遵循相同的套餐机制:Max,以及高级 Team 或旧版 Enterprise 席位,可以使用 Fable 模型,但最多占每周使用限额的 50%;Pro 和标准席位则使用按量付费的使用额度。此前针对 Fable 5 的促销活动已于 July 19, 2026 结束,Fable 5.1 不在该活动范围内。(Anthropic 套餐说明)
基准测试显示升级有效,但优势并不均衡
Anthropic 发布的对比数据显示,Fable 5.1 在多项 Agent 和计算机使用类测试中明显领先 Fable 5,但领先幅度从小幅提升到大幅增长不等。以下是厂商公布的结果,测试经过防护并针对特定版本,因此更适合用来判断方向,最终仍应使用自己的提示词进行验证。(Anthropic 的基准测试表)
| 基准测试 | Fable 5.1 | Fable 5 | 差异 |
|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | +27.9 个百分点 |
| Terminal-Bench 4.0 | 55.8% | 42.0% | +13.8 个百分点 |
| GDPval-AA v2 | 1,853 Elo | 1,723 Elo | +130 Elo |
| OSWorld 2.0,partial | 77.9% | 72.9% | +5.0 个百分点 |
| OSWorld 2.0,strict | 41.7% | 36.1% | +5.6 个百分点 |
| Humanity’s Last Exam,无工具 | 60.9% | 57.8% | +3.1 个百分点 |
| Humanity’s Last Exam,使用工具 | 65.0% | 63.8% | +1.2 个百分点 |
| AutomationBench | 31.4% | 17.1% | +14.3 个百分点 |
| CursorBench 3.2.0 | 73.4% | 70.5% | +2.9 个百分点 |
已公布结果中,差距最大的是 Terminal-Bench-Science 0.1:Fable 5.1 的得分超过了 Fable 5 的两倍。AutomationBench 和 Terminal-Bench 4.0 也显示出较明显的提升。而 Humanity’s Last Exam 和 CursorBench 的增幅较小,这说明更准确的结论应该是:Fable 5.1 在部分任务上优势突出,但并非在所有工作类型中都以相同幅度更强。
Anthropic 的表格列出了公开版 Fable 5.1 在 Terminal-Bench 4.0 中取得的 55.8% 成绩,同时将 Mythos 5.1 的 60.9% 单独列出。Mythos 5.1 并不是 Fable 5.1 的普遍可用替代品。(Anthropic 产品页面)
API 迁移:先测试 Fable 5 的三个行为变化
Anthropic 将 Fable 5.1 的迁移描述为大体可以直接替换,但下面三项变化可能导致生产环境报错,或者悄悄改变 Agent 的行为。不要一上来就在所有环境中直接修改模型 ID,先完成针对性测试。(Fable 5.1 迁移指南)
1. 强制选择工具会返回 400 错误
Fable 5.1 支持 tool_choice: {"type":"auto"} 和 tool_choice: {"type":"none"}。但它会拒绝 {"type":"any"} 以及强制指定某个工具的写法,并返回 400 invalid_request_error。这一限制同样适用于 Messages API、Message Batches API 和 token 计数端点。
如果应用需要有效 JSON,可以在支持的地方改用结构化输出,或者将工具选择保持为 auto,同时配合严格 schema 和明确指令。如果某一轮必须调用特定工具,Anthropic 给出的替代方案是追加一条仅对当前轮次生效的系统指令。
2. 思维块会绑定生成它的模型
Fable 5.1 可以读取 Fable 5 以及其他兼容 Claude 模型保留下来的思维块;旧模型则无法读取 Fable 5.1 生成的思维块。如果故障转移将对话发送给旧模型,API 会丢弃这些无法读取的块,之后的模型必须重新规划。
被丢弃的思维块不会作为输入计费,但模型切换后重新规划可能增加延迟,也会提高切换后第一轮的成本。为便于调试,Anthropic 提供了 thinking-binding-controls-2026-08-01 beta 请求头,它会报告 model_binding_mismatch 转换。
3. 修改早期历史记录可能让请求失效
对于较新的 API 账户,Fable 5.1 会检查保留的思维块之前,系统提示词、工具或更早的消息历史是否发生变化。如果编辑、重排、删除或重建这部分前缀,请求可能返回 400 invalid-signature 错误,而不是正常生成响应。
最稳妥的默认方案是采用只追加的历史记录。与其把摘要插入对话记录中间,不如使用服务端压缩或上下文编辑;跨轮次使用的文件也应保持稳定,可以通过 Files API 的 file_id 或完全相同的字节内容来实现。如果客户端本来就能保留完全一致的前缀,可能只需修改模型 ID;但如果每轮都会重新构建消息,就应先增加适配层。
值得采用的新增能力
Fable 5.1 还增加了一些控制项,可以在不完全重写 Agent 的情况下改善长时间运行的任务:
- 按消息设置工作强度:后续轮次可以在
low、medium、high、xhigh或max之间切换,而不会让缓存前缀失效。 - 单轮系统消息:添加只对当前轮次生效的指令,无需修改后再删除早期系统提示词中的文本。
- 进度更新:通过官方文档中的显示设置,在工具调用之间请求可读的进度更新。
- 更低的缓存读取价格:继续复用重复出现的前缀,但迁移后要重新测量缓存命中率。
工作强度名称并不是可跨任务比较的工作量单位。建议先从官方默认的 high 开始,再根据实际任务集,对比 medium 和更高设置下的质量、延迟与总 token 数。
权限、配额与故障转移,都会影响实际体验
Fable 5.1 已在付费 Claude 套餐以及 Anthropic API 和列出的云平台上广泛提供,但拥有套餐权限并不代表包含无限使用量。Pro 用户和标准 Team 席位可能从第一次请求起就需要使用额度;Max 和高级席位则共享每周额度中专门分配给 Fable 的部分。Claude Code 使用 Fable 5.1 需要 2.1.250 或更高版本,而 Fable 5 需要 2.1.170 或更高版本。(Anthropic 套餐与访问指南)
自动切换也可能让你在应用中看到的 Fable 对比结果与 API 中不同。Anthropic 表示,涉及敏感网络安全和生物学内容的请求可能会被路由到 Opus 故障转移模型,而且 Claude 各产品界面默认启用自动切换。在 API 中,开发者必须自行配置故障转移;如果没有增加故障转移处理,请求会以成功的 HTTP 响应返回,但终止原因为拒绝。(Anthropic 故障转移说明)
早期用户反馈只能算个案,但至少提示试点时要测量下面两项成本:
“5.1 感觉还行,但确实更慢。”——u/BeowulfShaeffer,r/ClaudeAI 发布讨论
“我已经用掉 100% 的额度了。”——u/noeyb,r/ClaudeAI 发布讨论
这些评论无法证明普遍存在的性能规律,但足以说明,除了答案质量,还应同时记录实际耗时和配额消耗。
给 Fable 5 用户的选择表
| 使用场景 | 实际建议 |
|---|---|
| 新建 Agent,且会反复读取上下文 | 选择 Fable 5.1,从第一天起记录缓存命中率和延迟 |
| 已有 Fable 5 Agent,历史记录只追加,工具调用为自动选择 | 在有代表性的任务子集中试运行 Fable 5.1 |
| 现有 Agent 会强制指定工具 | 先修复工具选择逻辑,再测试 Fable 5.1 |
| 现有客户端会重写旧消息或系统提示词 | 在重新设计历史记录层期间,保留 Fable 5 作为故障转移选项 |
| 大多数请求都是新提示词,缓存复用很少 | 比较完整任务成本,不要只看 token 价格 |
| 任务可能触发网络安全或生物学安全机制 | 迁移前评估故障转移路径及其 Opus 价格 |
| 需要更低的标准输入/输出价格 | 对比 Anthropic 的其他模型,因为 Fable 5.1 和 Fable 5 的标准价格完全相同 |
实际迁移测试不必一开始就做得很大:重放 20 到 50 个具有代表性的任务,固定相同的工具和提示词,并记录成功率、强制工具调用错误、故障转移次数、缓存读取 token 数、输入/输出 token 总数、延迟、配额消耗以及完整任务成本。只有在质量达到要求,同时没有带来无法接受的兼容性或配额问题时,才应正式推广 Fable 5.1。
用户还在关心什么
为什么 Claude 会从 Fable 5.1 切换到其他模型?
某些网络安全、生物学、推理提取或前沿模型开发请求可能触发安全分类器,进而自动故障转移。在 Claude 应用中,请求可能会在 Opus 模型上重新运行;在 API 中,则必须由开发者自行配置故障转移行为。(Anthropic 故障转移说明)
对于新建的长周期 Agent,以及大量复用缓存的 Fable 5 工作负载,Fable 5.1 是更合适的目标版本。但如果现有集成依赖强制工具调用、会修改消息历史,或者无法承受故障转移和配额方面的不确定性,那么在完成兼容性试点前,继续保留 Fable 5 更稳妥。