AIREITER
API 文档价格
模板
  • AIReiter
  • 博客
  • Fable 5.1 对比 Fable 5:成本、基准测试与 API 变化

Fable 5.1 对比 Fable 5:成本、基准测试与 API 变化

最后更新: 2026-09-02 02:45:05

把 claude-fable-5 换成 claude-fable-5-1,第一次请求可能顺利返回;但到了真实环境,你也许才会发现工具路由器失效了,或者可变的对话历史无法继续使用。对于长时间运行、缓存使用频繁的任务,Fable 5.1 更值得作为默认模型;但它并不是完全无风险的即插即用升级:标准价格和各项限制没有变化,API 行为却有三处关键调整。

先说结论:缓存型 Agent 值得升级,但不必所有请求都换

Claude Fable 5.1 是 Claude Fable 5 的当前继任版本,Anthropic 官方文档也建议迁移到新版本以获得更好的性能。实际收益最明显的场景,是 Agent 需要反复读取一段很长的提示词前缀:缓存读取价格从每百万 token $1 降至 $0.25,而标准输入和输出价格仍分别为每百万 token $10 和 $50。(Anthropic 的 Fable 5.1 概览)

如果你的工作负载……建议从……开始原因
会重复使用很长的系统提示词、代码库或文档上下文Fable 5.1缓存读取便宜 75%,而且 Anthropic 报告称其 Agent 能力更强。
使用 tool_choice: {"type":"any"} 等强制工具调用切换前先测试 Fable 5.1Fable 5.1 会以 400 错误拒绝强制选择工具。
需要编辑或重建较早的对话轮次先继续使用 Fable 5,直到历史记录层完成适配Fable 5.1 会将思维块与前置提示词、工具和历史记录绑定。
追求最低的标准 token 价格两款 Fable 都不是首选两者的输入价格都是每百万 token $10,输出价格都是每百万 token $50。
运行普通、无缓存请求,且现有 Fable 5 集成稳定先做一次评测标准价格并没有下降,基准测试收益也会因任务而异。

从 Fable 5 到 Fable 5.1,具体改了什么

Claude Fable 5.1 延续了 Claude Fable 5 的核心容量规格:1-million-token 上下文窗口、128,000-token 最大输出,以及始终开启的自适应思考。官方文档列出的差异主要包括生命周期状态、知识截止时间从 January 2026 更新为 June 2026、更低的缓存读取价格,以及工具和思维块相关的新 API 行为。(Fable 5 旧版概览;Fable 5.1 模型概览)

规格Claude Fable 5Claude Fable 5.1
API 模型 IDclaude-fable-5claude-fable-5-1
生命周期活跃,旧版活跃,最新 Fable 模型
发布日期June 9, 2026September 1, 2026
上下文窗口1M tokens1M tokens
最大输出128K tokens128K tokens
思考自适应,始终开启自适应,始终开启
默认工作强度HighHigh
可靠知识截止时间January 2026June 2026
输入 / 输出价格$10 / $50 per MTok$10 / $50 per MTok
缓存读取价格$1 / MTok$0.25 / MTok

Fable 5.1 可通过 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 以及 AWS 上的 Claude Platform 使用。Anthropic 列出的 Fable 5 也覆盖相同的平台系列,最早不会在 June 9, 2027 前退役;Fable 5.1 的计划退役时间则不早于 September 1, 2027。(Fable 5.1 的可用性与生命周期;Fable 5 的可用性与生命周期)

真正降价的是缓存读取,不是标准 token 价格

对于普通的新输入和输出 token,Fable 5.1 并没有更便宜。它与 Fable 5 一样,输入价格为每百万 token $10,输出价格为每百万 token $50;差别在于缓存读取从每百万 token $1 降到了 $0.25。(Anthropic 定价文档)

使用类型Fable 5Fable 5.1变化
新输入$10 / MTok$10 / MTok无变化
输出$50 / MTok$50 / MTok无变化
5 分钟缓存写入$12.50 / MTok$12.50 / MTok无变化
1 小时缓存写入$20 / MTok$20 / MTok无变化
缓存读取$1 / MTok$0.25 / MTok降低 75%
批处理输入 / 输出50% 折扣50% 折扣官方标注的折扣相同

举个简单例子:假设一个 Agent 读取一段缓存中的 1-million-token 项目上下文 10 次,然后生成 200,000 个输出 token。缓存读取部分在 Fable 5 上需要 $10,在 Fable 5.1 上只需 $2.50;输出部分两款模型都是 $10。在这个特定假设下,总 token 费用会从 $20 降至 $12.50,降幅为 37.5%。

实际节省多少,还要看缓存命中率、缓存写入、输出长度、重试次数、工具调用和故障转移路由。Anthropic 估计,典型工作负载的成本大约可降低 25%,高度 Agent 化的工作负载最高可降低约 45%。(Anthropic 的 Fable 产品页面)

订阅套餐的使用规则与 API 成本是两回事。Anthropic 帮助中心表示,Fable 5 和 Fable 5.1 目前遵循相同的套餐机制:Max,以及高级 Team 或旧版 Enterprise 席位,可以使用 Fable 模型,但最多占每周使用限额的 50%;Pro 和标准席位则使用按量付费的使用额度。此前针对 Fable 5 的促销活动已于 July 19, 2026 结束,Fable 5.1 不在该活动范围内。(Anthropic 套餐说明)

基准测试显示升级有效,但优势并不均衡

Anthropic 发布的对比数据显示,Fable 5.1 在多项 Agent 和计算机使用类测试中明显领先 Fable 5,但领先幅度从小幅提升到大幅增长不等。以下是厂商公布的结果,测试经过防护并针对特定版本,因此更适合用来判断方向,最终仍应使用自己的提示词进行验证。(Anthropic 的基准测试表)

基准测试Fable 5.1Fable 5差异
Terminal-Bench-Science 0.152.6%24.7%+27.9 个百分点
Terminal-Bench 4.055.8%42.0%+13.8 个百分点
GDPval-AA v21,853 Elo1,723 Elo+130 Elo
OSWorld 2.0,partial77.9%72.9%+5.0 个百分点
OSWorld 2.0,strict41.7%36.1%+5.6 个百分点
Humanity’s Last Exam,无工具60.9%57.8%+3.1 个百分点
Humanity’s Last Exam,使用工具65.0%63.8%+1.2 个百分点
AutomationBench31.4%17.1%+14.3 个百分点
CursorBench 3.2.073.4%70.5%+2.9 个百分点
Fable 5.1 与 Fable 5 官方基准测试对比

已公布结果中,差距最大的是 Terminal-Bench-Science 0.1:Fable 5.1 的得分超过了 Fable 5 的两倍。AutomationBench 和 Terminal-Bench 4.0 也显示出较明显的提升。而 Humanity’s Last Exam 和 CursorBench 的增幅较小,这说明更准确的结论应该是:Fable 5.1 在部分任务上优势突出,但并非在所有工作类型中都以相同幅度更强。

Anthropic 的表格列出了公开版 Fable 5.1 在 Terminal-Bench 4.0 中取得的 55.8% 成绩,同时将 Mythos 5.1 的 60.9% 单独列出。Mythos 5.1 并不是 Fable 5.1 的普遍可用替代品。(Anthropic 产品页面)

API 迁移:先测试 Fable 5 的三个行为变化

Anthropic 将 Fable 5.1 的迁移描述为大体可以直接替换,但下面三项变化可能导致生产环境报错,或者悄悄改变 Agent 的行为。不要一上来就在所有环境中直接修改模型 ID,先完成针对性测试。(Fable 5.1 迁移指南)

1. 强制选择工具会返回 400 错误

Fable 5.1 支持 tool_choice: {"type":"auto"} 和 tool_choice: {"type":"none"}。但它会拒绝 {"type":"any"} 以及强制指定某个工具的写法,并返回 400 invalid_request_error。这一限制同样适用于 Messages API、Message Batches API 和 token 计数端点。

如果应用需要有效 JSON,可以在支持的地方改用结构化输出,或者将工具选择保持为 auto,同时配合严格 schema 和明确指令。如果某一轮必须调用特定工具,Anthropic 给出的替代方案是追加一条仅对当前轮次生效的系统指令。

2. 思维块会绑定生成它的模型

Fable 5.1 可以读取 Fable 5 以及其他兼容 Claude 模型保留下来的思维块;旧模型则无法读取 Fable 5.1 生成的思维块。如果故障转移将对话发送给旧模型,API 会丢弃这些无法读取的块,之后的模型必须重新规划。

被丢弃的思维块不会作为输入计费,但模型切换后重新规划可能增加延迟,也会提高切换后第一轮的成本。为便于调试,Anthropic 提供了 thinking-binding-controls-2026-08-01 beta 请求头,它会报告 model_binding_mismatch 转换。

3. 修改早期历史记录可能让请求失效

对于较新的 API 账户,Fable 5.1 会检查保留的思维块之前,系统提示词、工具或更早的消息历史是否发生变化。如果编辑、重排、删除或重建这部分前缀,请求可能返回 400 invalid-signature 错误,而不是正常生成响应。

最稳妥的默认方案是采用只追加的历史记录。与其把摘要插入对话记录中间,不如使用服务端压缩或上下文编辑;跨轮次使用的文件也应保持稳定,可以通过 Files API 的 file_id 或完全相同的字节内容来实现。如果客户端本来就能保留完全一致的前缀,可能只需修改模型 ID;但如果每轮都会重新构建消息,就应先增加适配层。

值得采用的新增能力

Fable 5.1 还增加了一些控制项,可以在不完全重写 Agent 的情况下改善长时间运行的任务:

  1. 按消息设置工作强度:后续轮次可以在 low、medium、high、xhigh 或 max 之间切换,而不会让缓存前缀失效。
  2. 单轮系统消息:添加只对当前轮次生效的指令,无需修改后再删除早期系统提示词中的文本。
  3. 进度更新:通过官方文档中的显示设置,在工具调用之间请求可读的进度更新。
  4. 更低的缓存读取价格:继续复用重复出现的前缀,但迁移后要重新测量缓存命中率。

工作强度名称并不是可跨任务比较的工作量单位。建议先从官方默认的 high 开始,再根据实际任务集,对比 medium 和更高设置下的质量、延迟与总 token 数。

权限、配额与故障转移,都会影响实际体验

Fable 5.1 已在付费 Claude 套餐以及 Anthropic API 和列出的云平台上广泛提供,但拥有套餐权限并不代表包含无限使用量。Pro 用户和标准 Team 席位可能从第一次请求起就需要使用额度;Max 和高级席位则共享每周额度中专门分配给 Fable 的部分。Claude Code 使用 Fable 5.1 需要 2.1.250 或更高版本,而 Fable 5 需要 2.1.170 或更高版本。(Anthropic 套餐与访问指南)

自动切换也可能让你在应用中看到的 Fable 对比结果与 API 中不同。Anthropic 表示,涉及敏感网络安全和生物学内容的请求可能会被路由到 Opus 故障转移模型,而且 Claude 各产品界面默认启用自动切换。在 API 中,开发者必须自行配置故障转移;如果没有增加故障转移处理,请求会以成功的 HTTP 响应返回,但终止原因为拒绝。(Anthropic 故障转移说明)

早期用户反馈只能算个案,但至少提示试点时要测量下面两项成本:

“5.1 感觉还行,但确实更慢。”——u/BeowulfShaeffer,r/ClaudeAI 发布讨论

“我已经用掉 100% 的额度了。”——u/noeyb,r/ClaudeAI 发布讨论

这些评论无法证明普遍存在的性能规律,但足以说明,除了答案质量,还应同时记录实际耗时和配额消耗。

给 Fable 5 用户的选择表

使用场景实际建议
新建 Agent,且会反复读取上下文选择 Fable 5.1,从第一天起记录缓存命中率和延迟
已有 Fable 5 Agent,历史记录只追加,工具调用为自动选择在有代表性的任务子集中试运行 Fable 5.1
现有 Agent 会强制指定工具先修复工具选择逻辑,再测试 Fable 5.1
现有客户端会重写旧消息或系统提示词在重新设计历史记录层期间,保留 Fable 5 作为故障转移选项
大多数请求都是新提示词,缓存复用很少比较完整任务成本,不要只看 token 价格
任务可能触发网络安全或生物学安全机制迁移前评估故障转移路径及其 Opus 价格
需要更低的标准输入/输出价格对比 Anthropic 的其他模型,因为 Fable 5.1 和 Fable 5 的标准价格完全相同

实际迁移测试不必一开始就做得很大:重放 20 到 50 个具有代表性的任务,固定相同的工具和提示词,并记录成功率、强制工具调用错误、故障转移次数、缓存读取 token 数、输入/输出 token 总数、延迟、配额消耗以及完整任务成本。只有在质量达到要求,同时没有带来无法接受的兼容性或配额问题时,才应正式推广 Fable 5.1。

用户还在关心什么

为什么 Claude 会从 Fable 5.1 切换到其他模型?

某些网络安全、生物学、推理提取或前沿模型开发请求可能触发安全分类器,进而自动故障转移。在 Claude 应用中,请求可能会在 Opus 模型上重新运行;在 API 中,则必须由开发者自行配置故障转移行为。(Anthropic 故障转移说明)

对于新建的长周期 Agent,以及大量复用缓存的 Fable 5 工作负载,Fable 5.1 是更合适的目标版本。但如果现有集成依赖强制工具调用、会修改消息历史,或者无法承受故障转移和配额方面的不确定性,那么在完成兼容性试点前,继续保留 Fable 5 更稳妥。

>_AIReiter 模型目录

快速访问与本指南相关的模型 API

Claude Fable 5.1

Chat

面向长程编程、研究与知识工作的 Mythos 级模型。

Anthropic获取 API Key >

Claude Fable 5

Chat

一款用于深度推理和复杂长篇任务的高级 Claude 模型。

Anthropic获取 API Key >

Claude Opus 4.8

Chat

一款高能力的 Claude 模型,适用于高要求的推理和专业工作。

Anthropic获取 API Key >

Claude Opus 5

Chat

面向复杂推理、编程和长上下文专业工作的高端 Claude 模型。

Anthropic获取 API Key >

Claude Sonnet 5

Chat

适合高级推理、编码和日常工作的均衡型 Claude 模型。

Anthropic获取 API Key >

最新文章

GPT-6 Astra API 评测(2026):为智能体而生,不是即插即用

2026-09-07

Kling API 集成指南:官方平台与聚合商怎么选(2026)

2026-09-07

Suno API Key 怎么获取、多少钱:2026 实用指南

2026-09-07

GPT-6 Astra 评测:$10/$50 的 API 定价值不值?

2026-09-06
AIREITER

有问题?请联系我们
[email protected]

新速率有限公司NEWRATE LIMITED香港九龍花園街 2-16 號好景商業中心 2304 室Room 2304, Haojing Commercial Center, 2-16 Garden Street, Kowloon, Hong Kong

LLM

GPT-6 AstraGemini 3.8 FlashClaude Fable 5.1GLM-5.3 FlashGemini 3.6 Flash

AI 视频

Gemini Omni 1.1 Flash ExtMiniMax H3Kling 3.0 Motion ControlKling 3.0 TurboKling 3.0

AI 图片

Grok Imagine Image 2.0Midjourney V8.1Midjourney V7Z-Image TurboKrea 2 Turbo

博客

查看全部 →

公司

隐私政策服务条款退款政策

© 2026 AIReiter。保留所有权利。