Claude Opus 5 的价格只有 Claude Fable 5 的一半。按 Anthropic 发布时给出的数据,Opus 5 在 max effort 下的 CursorBench 3.2 峰值成绩,与 Fable 5 相差不到 0.5%。
在 OSWorld 2.0 上,Opus 5 的最佳成绩还超过了 Fable 5,单任务成本约为后者的三分之一。两项均为厂商自报数据,尚未有独立复现。即便如此,Fable 5 的所有标价仍然是两倍:
| 每百万 token | Claude Fable 5 | Claude Opus 5 | 倍数 |
|---|---|---|---|
| 输入 | $10 | $5 | 2.0x |
| 输出 | $50 | $25 | 2.0x |
| 缓存写入,5 分钟 | $12.50 | $6.25 | 2.0x |
| 缓存读取 | $1 | $0.50 | 2.0x |
| Batch API | $5 / $25 | $2.50 / $12.50 | 2.0x |
以上价格已于 2026 年 7 月 25 日对照 Anthropic 定价页面核实。Claude Opus 5 vs Fable 5 最终只剩一个问题:你的工作负载要满足什么条件,Fable 5 的 2 倍溢价才能回本?
先说结论:按下文的计算,Fable 5 的成功率必须比 Opus 5 高约 60%,溢价才有经济意义。因此,Opus 5 应该是默认选择,Fable 5 则是少数例外。
标价确实相差 2 倍,但有三种情况会改变局面
不要把 tokenizer 带来的 token 膨胀再叠加到费率差异上。模型概览指出,随 Opus 4.7 引入的 Fable 5 tokenizer,相较于 早于 Opus 4.7 的模型会产生“约多 30% 的 token”。但 Opus 5 同样属于 4.7 及之后的模型,两边受到的影响完全一致,因此差距仍是 2.0x,而不是 2.6x。
不过,以下三种价格情形会直接打破这个比例:
- Opus 5 的 fast mode 定价是 $10 / $50,与 Fable 5 标准费率相同。在相同预算下,你是在 Fable 5 的能力与 Opus 5 高达约 2.5 倍每秒输出 token 速度之间做取舍。仅适用于 Claude API。
- Fable 5 在 Batch API 上的价格为 $5 / $25,正好等于 Opus 5 的标价。对可容忍延迟的任务,你可以按默认模型的同步标价使用前沿模型。若 Batch 对 Batch 比较,2 倍差距依然存在;这属于计费模式套利,并非折扣。
- Fable 5 的缓存读取是 $1,而 Opus 5 是 $0.50。同类比较仍是 2 倍,但 Fable 5 从缓存读取的成本仅为 Opus 5 读取新输入的五分之一,因此缓存密集型循环会缩小绝对成本差额。
四项实测:Fable 5 token 更省,账单却更高
我们在 2026 年 7 月 24 日针对每个模型各运行了一次四项可机械评分的任务:包含两个缺陷的 kth_smallest bug 修复、严格 JSON schema 任务、Frobenius 数问题(7 和 12 的组合,答案为 65),以及无注释重构与验证。两个模型均通过 4 项中的 4 项。
| 任务 | Opus 5 输出 | Fable 5 输出 | 渠道 |
|---|---|---|---|
| 双缺陷 bug 修复 | 36 tok / 4.52s | 69 tok / 5.61s | Claude Code |
| 严格 JSON schema | 94 tok / 4.8s | 86 tok / 4.4s | Gateway |
| Frobenius 数(65) | 407 tok / 6.8s | 358 tok / 7.3s | Gateway |
| 重构,无注释 | 429 tok / 6.93s | 251 tok / 8.09s | Claude Code |
| 合计 | 966 tok / 23.05s | 764 tok / 25.40s | |
| 按标价计算的输出成本 | $0.024 | $0.038 |
Fable 5 的输出 token 少了 21%,但由于输出单价翻倍,单次运行成本仍约为 1.6 倍。更便宜的模型反而更啰嗦;Fable 5 节省的 token 甚至没能抵回自身溢价的一半。
文档将 Fable 5 的速度标为“较慢”,Opus 5 则为“适中”;在本次四项任务中,Fable 5 有三项更慢。
这组数据有三个限制:
- 每个模型—任务组合只跑一次,采用默认 effort,并以机械方式评分。这只是冒烟测试,不是基准测试。
- 仅按官方费率计算输出 token。我们的 gateway 对同一提示词报告了波动极大的 prompt token 数,因此实际账单还会包含输入和缓存成本。
- token 数反映的是 thinking 配置,不等同于质量。Opus 5 默认以
higheffort 开启 thinking;Fable 5 的常开自适应 thinking 则在两项短任务中自动缩减。
汇总数据还混用了渠道:Fable 5 经由我们的 OpenAI 兼容 gateway 处理两项代码任务时,连续三次都返回空 completion,因此这两行数据来自 Claude Code 的官方渠道。这是路由故障,并不能说明 Fable 5 的编程能力;如果你的技术栈中有中转层,值得做一次健康检查。
怎么算盈亏平衡点
只看 token 单价是错误单位,真正该比较的是每个完成任务的预期成本:
expected cost per success = cost per attempt / first-pass success rate
这个公式已经把重试纳入其中:当成功率为 p 时,成功所需的预期尝试次数为 1/p。令两种模型的成本相等,消去共有项后,Claude Opus 5 vs Fable 5 就简化为一个不等式:
success_rate(Fable 5) / success_rate(Opus 5) >= cost_per_attempt(Fable 5) / cost_per_attempt(Opus 5)
若两个模型输出相同数量的 token,右侧为 2.0;按我们的实测输出组合,右侧为 1.58。仅计算输出成本时,可将实际门槛视为 1.6:Fable 5 的成功率必须比 Opus 5 高约 60%,才能收回溢价。输入密集型或缓存密集型工作负载会把这一门槛重新推向 2.0x。
| 若 Opus 5 的首次成功率为 | Fable 5 必须达到 |
|---|---|
| 30% | 47% |
| 40% | 63% |
| 50% | 79% |
| 60% | 95% |
| 63% | 100% |
| 70% | 无法达到 |
决定性的正是最后两行。一旦 Opus 5 的首次成功率超过约 63%,无论 Fable 5 能力提升多少,都无法做到每个成果更便宜,因为 Fable 5 的成功率不可能超过 100%。在普遍的 2.0x 费率差下,这个上限会降至 50%。
换言之,Fable 5 的经济价值只存在于 Opus 5 会失败的任务中。这也是为什么在固定预算下,最适合编程的 Claude 模型通常并不是产品线中最顶端的那一款。这个门槛依赖三个前提,只要其中任意一个不成立,结论就会更偏向 Fable 5:
- 每次尝试相互独立。
- 失败可以低成本识别。
- 一次失败的成本不高于重试一次。
还有一项担忧不在这套算式内:你支付溢价后,买到的会不会是更早被替代的模型?模型弃用页面将两者都列为 Active:
claude-fable-5“不早于 2027 年 6 月 9 日”退役。claude-opus-5“不早于 2027 年 7 月 24 日”退役。
Anthropic 至少会提前 60 天通知,且上述最早日期仅适用于 Anthropic 运营的平台。因此,这应当是一次按成果成本做出的选择,而不是押注谁能存活得更久。
哪些场景值得多花这 2 倍
有三类情况足以支撑这笔溢价:
- 失败无法被低成本发现。有测试套件时,
1/p的计算很诚实;但一项运行 8 小时、在第 6 小时才失败的任务不是,因为账单中还包括浪费的计算资源,以及工程师重建现场的时间。Anthropic 对 Fable 5 的定位正是这一类:“专为要求最高的推理和长周期 agentic 工作打造。” - 交付成果远比 token 贵。R&D World 报道称 Stripe 在一天内迁移了一个 5000 万行的 Ruby 代码库。当成果价值与模型支出的比例达到这个级别,按 token 计价就不再是关键变量。
- 需要有保障的容量。Priority Tier 覆盖 Fable 5 和 Opus 4.8,但不包括 Opus 5,因此在该层级中指定 Opus 5 的请求会校验失败。这是 2 倍价格唯一能买到、而低价模型无法提供的东西,但仅适用于已经持有相关承诺的组织。
不值得的场景,以及两个硬性限制
零数据保留是硬墙,不是价格问题。Fable 5 和 Mythos 5 作为指定 Covered Models,采用 30 天保留政策,且无法在 ZDR 下使用。因此,采用 ZDR 的组织无论预算多少,所有 Fable 5 请求都会收到 400 invalid_request_error。Opus 5 没有这一限制。
安全相关编程反而会为溢价换来更差体验。Anthropic 对随 Fable 5 恢复上线的分类器的描述是:它“代价是,在日常编码和调试任务中会更频繁地标记良性请求”。被拦截的请求会转交给 Opus 4.8;如果在流式响应中途拒绝,已流出的部分仍会计费,但你最终一无所获。两项外部测量量化了这部分代价:
- R&D World 的 Terminal-Bench 分析:20.9% 的试验遭遇安全拒绝,得分为 84.3;采用相同权重的 Mythos 5 得分为 88.0。
- CodeRabbit 的 105 个样本代码审查测试:Fable 5 找到 65 个可操作问题,Opus 4.8 为 66 个,且 Fable 5 的精确率更低。
费率之外,还有三项成本:
- 可用性历史。Anthropic 的重新部署声明记录显示,两个模型曾在 2026 年 6 月 12 日至 7 月 1 日面向所有用户暂停服务,约 18 天完全无法访问。原因是美国出口管制“要求我们限制外国公民访问,无论其身处美国境内还是境外”。
- 集成成本。发布文档要求接入 Fable 5 的开发者规划新的拒绝处理机制、在另一 Claude 模型上进行 fallback 重试,以及新的计费规则。1 倍价格的模型不需要这些额外工作。
- 两项功能反而是 Opus 5 更强。Opus 5 的可靠知识截止日期为 2026 年 5 月,而 Fable 5 为 2026 年 1 月;此外,对话中途更改工具的能力(beta
mid-conversation-tool-changes-2026-07-01)从 Opus 5 开始提供。
Mythos 5 与 Project Glasswing 的位置
Anthropic 仍将 Fable 5 称为“Anthropic 能力最强的广泛发布模型”。“广泛发布”正是限定词,它排除了 Claude Mythos 5(claude-mythos-5):后者具备相同能力,价格也同为 $10 / $50。
Mythos 5 仅通过 Project Glasswing 提供,这是一个受限的防御性网络安全发布计划,没有自助注册入口。两者的差异在于分类器和访问权限,而不是能力:Mythos 5 可以理解为没有安全分类器的 Fable 5,并非更强的模型。
这也重新排列了安全场景的选择。Anthropic 将 Opus 5 在网络安全和生物学能力上置于 Mythos 5 之后,并称其在漏洞利用开发方面“远远落后”,均为厂商自报。安全工作中最强的 Claude 是你买不到的那一个;而你能以 2 倍价格买到的模型,其分类器却可能拦截良性调试请求。Mythos 5 与 Opus 4.8 的实测对比梳理了这一产品脉络。
如何调用这两个模型
模型 ID 与访问渠道
Opus 5 的模型 ID 是 claude-opus-5,也是 Claude Max 的新默认模型。Fable 5 的 ID 是 claude-fable-5,使用同一套 API;在 Claude Code 中,两个模型都可通过 /model 选择。Opus 5 可运行于:
- Claude API、claude.ai、Claude Code 和 Claude Cowork
- Amazon Bedrock,模型 ID 为
anthropic.claude-opus-5 - Google Cloud 和 Microsoft Foundry
两者均支持 100 万 token 上下文窗口和最高 128k 输出,因此上下文不是决胜因素。消费级套餐中,Fable 5 的额度在 7 月 7 日后改为 usage credits;标准 Enterprise 席位则“未包含 Fable 5 额度”。也就是说,没有 credits 的组织根本无法访问 Fable 5。
真正影响支出的控制项
真正影响开销的是 effort 和 thinking 控制。Opus 5 提供 low 到 max,默认值为 high,并且在 high 或更低档位可关闭 thinking。Fable 5 的自适应 thinking 则完全无法关闭,它为输出 token 设下了一条不可调低的底线。
如果你通过 Anthropic 兼容 gateway 调用 Claude,先确认其中是否提供这场对比中的两端模型。
AIReiter 对 Opus 4.8 的定价为 $1.56 / $7.76 每 MTok,而官方为 $5 / $25,约低 69%。截至 7 月 25 日,其 Claude 产品线止于 Fable 5、Sonnet 5、Opus 4.8 和 Opus 4.7,尚未列出 Opus 5。
建议:默认 Opus 5,只有一个真正的例外
默认选择 Opus 5,把 Fable 5 视为需要按任务类别逐一论证的升级选项。Anthropic 自己的建议也是如此:“复杂 agentic 编程和企业工作请从 Claude Opus 5 开始。对于需要当前最高能力的工作负载,请使用 Claude Fable 5。”
有两种情况改变的是计算输入,而不是直接跨过成功率门槛:
- 长时间自主运行的任务:静默失败的成本高于一次重试,且
p不再可测量。 - 任何异步任务:Fable 5 在 Batch 中的价格与 Opus 5 的同步标价相同。
还有一个例外并非满足算式,而是直接凌驾于算式之上:Priority Tier。Fable 5 和 Opus 4.8 属于该层级,而 Opus 5、Sonnet 5 和 Mythos 5 被排除在外。因此,若工作负载需要承诺 99.5% uptime 的吞吐能力,低价一侧无论出多少钱都买不到。
但这项例外要严格理解。Anthropic 表示,这些容量承诺“已不再开放购买”,现有持有者也只能使用到合同结束日期。如果你手上没有现成的承诺,这个例外对你就是关闭的,盈亏平衡计算依然成立。
FAQ
Opus 5 比 Fable 5 更好吗?
在 max effort 下,Opus 5 以每任务一半的成本,达到 Fable 5 在 CursorBench 3.2 峰值成绩 0.5% 以内的水平。这是厂商自报数据,尚未经过独立复现。其知识截止日期也更新:Opus 5 为 2026 年 5 月,Fable 5 为 2026 年 1 月。
Fable 5 仍保有“能力最强的广泛发布模型”这一称号,设计目标也更偏向长周期 agentic 运行。其 Priority Tier 资格仅对已持有相关承诺的组织有意义。
Fable 5 为什么曾从 Claude 中下线,现在回来了吗?
Anthropic 曾在 2026 年 6 月 12 日至 7 月 1 日暂停向所有用户提供两个模型,原因是美国出口管制要求限制外国公民访问。导火索是外部报告发现了一种可诱导 Fable 5 绕过护栏、寻找软件漏洞的方式。目前访问已恢复;经过重新训练的分类器在超过 99% 的案例中可将其拦截,但也会更频繁地误伤良性编程请求。
Claude Fable 5 免费吗?
不免费。其 API 定价为每百万 token $10 / $50。消费级套餐此前可在每周使用上限的最多 50% 范围内使用,直到 7 月 7 日;之后访问改为 usage credits,标准 Enterprise 席位不包含额度。批量使用时,最便宜的路径是价格为 $5 / $25 的 Batch API。
Fable 5 的 tokenizer 会让实际价格差距达到 2.6 倍吗?
不会。两者都使用随 Opus 4.7 引入的 tokenizer,因此约 30% 的 token 膨胀是相对于 Sonnet 4.6 及更早模型而言,不存在于这两个模型之间。按每 token 计算,差距为 2.0x;而在我们的样本中,Fable 5 输出 token 少了 21%,单次成本差距约为 1.6x。
Fable 5 和 Mythos 5 有什么区别?
规格相同,价格也同为 $10 / $50。Mythos 5 具备 Fable 5 的能力但没有安全分类器,仅通过 Project Glasswing 提供,无法自助注册。两者都是 Covered Models,采用 30 天保留政策,也都在同一个 6 月窗口期被暂停服务。
我能关闭 Fable 5 的 thinking 来降低账单吗?
不能。Fable 5 的自适应 thinking 始终开启,因此其输出 token 下限是结构性的。Opus 5 在 effort 为 high 或更低时接受 thinking: {"type": "disabled"};在 xhigh 和 max 下则返回 400。这意味着,只有更便宜的模型能将 effort 当作成本调节旋钮。
记住这一个数字就够了
对绝大多数任务类型而言,一个比例就能决定 Claude Opus 5 vs Fable 5 的选择,而它指向 Opus 5。同样的算法也适用于不同厂商;例如 Opus 5 与 GPT-5.6 系列的比较,变化的只是费率。
- 当你的工作负载满足
success_rate(Fable 5) / success_rate(Opus 5) >= 1.6时达到盈亏平衡。低于这条线,选择 Opus 5 再加一次重试,每个完成任务的成本仍更低。
