Claude Opus 5 vs Fable 5:2 倍价格还值得吗?

最后更新: 2026-07-25 05:33:55

Claude Opus 5 的价格只有 Claude Fable 5 的一半。按 Anthropic 发布时给出的数据,Opus 5 在 max effort 下的 CursorBench 3.2 峰值成绩,与 Fable 5 相差不到 0.5%。

在 OSWorld 2.0 上,Opus 5 的最佳成绩还超过了 Fable 5,单任务成本约为后者的三分之一。两项均为厂商自报数据,尚未有独立复现。即便如此,Fable 5 的所有标价仍然是两倍:

每百万 tokenClaude Fable 5Claude Opus 5倍数
输入$10$52.0x
输出$50$252.0x
缓存写入,5 分钟$12.50$6.252.0x
缓存读取$1$0.502.0x
Batch API$5 / $25$2.50 / $12.502.0x

以上价格已于 2026 年 7 月 25 日对照 Anthropic 定价页面核实。Claude Opus 5 vs Fable 5 最终只剩一个问题:你的工作负载要满足什么条件,Fable 5 的 2 倍溢价才能回本?

先说结论:按下文的计算,Fable 5 的成功率必须比 Opus 5 高约 60%,溢价才有经济意义。因此,Opus 5 应该是默认选择,Fable 5 则是少数例外。

标价确实相差 2 倍,但有三种情况会改变局面

不要把 tokenizer 带来的 token 膨胀再叠加到费率差异上。模型概览指出,随 Opus 4.7 引入的 Fable 5 tokenizer,相较于 早于 Opus 4.7 的模型会产生“约多 30% 的 token”。但 Opus 5 同样属于 4.7 及之后的模型,两边受到的影响完全一致,因此差距仍是 2.0x,而不是 2.6x。

不过,以下三种价格情形会直接打破这个比例:

  • Opus 5 的 fast mode 定价是 $10 / $50,与 Fable 5 标准费率相同。在相同预算下,你是在 Fable 5 的能力与 Opus 5 高达约 2.5 倍每秒输出 token 速度之间做取舍。仅适用于 Claude API。
  • Fable 5 在 Batch API 上的价格为 $5 / $25,正好等于 Opus 5 的标价。对可容忍延迟的任务,你可以按默认模型的同步标价使用前沿模型。若 Batch 对 Batch 比较,2 倍差距依然存在;这属于计费模式套利,并非折扣。
  • Fable 5 的缓存读取是 $1,而 Opus 5 是 $0.50。同类比较仍是 2 倍,但 Fable 5 从缓存读取的成本仅为 Opus 5 读取新输入的五分之一,因此缓存密集型循环会缩小绝对成本差额。

四项实测:Fable 5 token 更省,账单却更高

我们在 2026 年 7 月 24 日针对每个模型各运行了一次四项可机械评分的任务:包含两个缺陷的 kth_smallest bug 修复、严格 JSON schema 任务、Frobenius 数问题(7 和 12 的组合,答案为 65),以及无注释重构与验证。两个模型均通过 4 项中的 4 项。

任务Opus 5 输出Fable 5 输出渠道
双缺陷 bug 修复36 tok / 4.52s69 tok / 5.61sClaude Code
严格 JSON schema94 tok / 4.8s86 tok / 4.4sGateway
Frobenius 数(65)407 tok / 6.8s358 tok / 7.3sGateway
重构,无注释429 tok / 6.93s251 tok / 8.09sClaude Code
合计966 tok / 23.05s764 tok / 25.40s
按标价计算的输出成本$0.024$0.038

Fable 5 的输出 token 少了 21%,但由于输出单价翻倍,单次运行成本仍约为 1.6 倍。更便宜的模型反而更啰嗦;Fable 5 节省的 token 甚至没能抵回自身溢价的一半。

折线图:重复相同四项任务 1、5、10、20、50 次时的累计输出 token 成本,单位为美分;基于实测 token 数,对比每百万输出 token $25 的 Claude Opus 5 与 $50 的 Claude Fable 5

文档将 Fable 5 的速度标为“较慢”,Opus 5 则为“适中”;在本次四项任务中,Fable 5 有三项更慢。

这组数据有三个限制:

  • 每个模型—任务组合只跑一次,采用默认 effort,并以机械方式评分。这只是冒烟测试,不是基准测试。
  • 仅按官方费率计算输出 token。我们的 gateway 对同一提示词报告了波动极大的 prompt token 数,因此实际账单还会包含输入和缓存成本。
  • token 数反映的是 thinking 配置,不等同于质量。Opus 5 默认以 high effort 开启 thinking;Fable 5 的常开自适应 thinking 则在两项短任务中自动缩减。

汇总数据还混用了渠道:Fable 5 经由我们的 OpenAI 兼容 gateway 处理两项代码任务时,连续三次都返回空 completion,因此这两行数据来自 Claude Code 的官方渠道。这是路由故障,并不能说明 Fable 5 的编程能力;如果你的技术栈中有中转层,值得做一次健康检查。

怎么算盈亏平衡点

只看 token 单价是错误单位,真正该比较的是每个完成任务的预期成本:

expected cost per success = cost per attempt / first-pass success rate

这个公式已经把重试纳入其中:当成功率为 p 时,成功所需的预期尝试次数为 1/p。令两种模型的成本相等,消去共有项后,Claude Opus 5 vs Fable 5 就简化为一个不等式:

success_rate(Fable 5) / success_rate(Opus 5)  >=  cost_per_attempt(Fable 5) / cost_per_attempt(Opus 5)

若两个模型输出相同数量的 token,右侧为 2.0;按我们的实测输出组合,右侧为 1.58。仅计算输出成本时,可将实际门槛视为 1.6:Fable 5 的成功率必须比 Opus 5 高约 60%,才能收回溢价。输入密集型或缓存密集型工作负载会把这一门槛重新推向 2.0x。

若 Opus 5 的首次成功率为Fable 5 必须达到
30%47%
40%63%
50%79%
60%95%
63%100%
70%无法达到

决定性的正是最后两行。一旦 Opus 5 的首次成功率超过约 63%,无论 Fable 5 能力提升多少,都无法做到每个成果更便宜,因为 Fable 5 的成功率不可能超过 100%。在普遍的 2.0x 费率差下,这个上限会降至 50%。

换言之,Fable 5 的经济价值只存在于 Opus 5 会失败的任务中。这也是为什么在固定预算下,最适合编程的 Claude 模型通常并不是产品线中最顶端的那一款。这个门槛依赖三个前提,只要其中任意一个不成立,结论就会更偏向 Fable 5:

  • 每次尝试相互独立。
  • 失败可以低成本识别。
  • 一次失败的成本不高于重试一次。

还有一项担忧不在这套算式内:你支付溢价后,买到的会不会是更早被替代的模型?模型弃用页面将两者都列为 Active:

  • claude-fable-5“不早于 2027 年 6 月 9 日”退役。
  • claude-opus-5“不早于 2027 年 7 月 24 日”退役。

Anthropic 至少会提前 60 天通知,且上述最早日期仅适用于 Anthropic 运营的平台。因此,这应当是一次按成果成本做出的选择,而不是押注谁能存活得更久。

哪些场景值得多花这 2 倍

有三类情况足以支撑这笔溢价:

  • 失败无法被低成本发现。有测试套件时,1/p 的计算很诚实;但一项运行 8 小时、在第 6 小时才失败的任务不是,因为账单中还包括浪费的计算资源,以及工程师重建现场的时间。Anthropic 对 Fable 5 的定位正是这一类:“专为要求最高的推理和长周期 agentic 工作打造。”
  • 交付成果远比 token 贵。R&D World 报道称 Stripe 在一天内迁移了一个 5000 万行的 Ruby 代码库。当成果价值与模型支出的比例达到这个级别,按 token 计价就不再是关键变量。
  • 需要有保障的容量。Priority Tier 覆盖 Fable 5 和 Opus 4.8,但不包括 Opus 5,因此在该层级中指定 Opus 5 的请求会校验失败。这是 2 倍价格唯一能买到、而低价模型无法提供的东西,但仅适用于已经持有相关承诺的组织。

不值得的场景,以及两个硬性限制

零数据保留是硬墙,不是价格问题。Fable 5 和 Mythos 5 作为指定 Covered Models,采用 30 天保留政策,且无法在 ZDR 下使用。因此,采用 ZDR 的组织无论预算多少,所有 Fable 5 请求都会收到 400 invalid_request_error。Opus 5 没有这一限制。

安全相关编程反而会为溢价换来更差体验。Anthropic 对随 Fable 5 恢复上线的分类器的描述是:它“代价是,在日常编码和调试任务中会更频繁地标记良性请求”。被拦截的请求会转交给 Opus 4.8;如果在流式响应中途拒绝,已流出的部分仍会计费,但你最终一无所获。两项外部测量量化了这部分代价:

  • R&D World 的 Terminal-Bench 分析:20.9% 的试验遭遇安全拒绝,得分为 84.3;采用相同权重的 Mythos 5 得分为 88.0。
  • CodeRabbit 的 105 个样本代码审查测试:Fable 5 找到 65 个可操作问题,Opus 4.8 为 66 个,且 Fable 5 的精确率更低。

费率之外,还有三项成本:

  • 可用性历史。Anthropic 的重新部署声明记录显示,两个模型曾在 2026 年 6 月 12 日至 7 月 1 日面向所有用户暂停服务,约 18 天完全无法访问。原因是美国出口管制“要求我们限制外国公民访问,无论其身处美国境内还是境外”。
  • 集成成本。发布文档要求接入 Fable 5 的开发者规划新的拒绝处理机制、在另一 Claude 模型上进行 fallback 重试,以及新的计费规则。1 倍价格的模型不需要这些额外工作。
  • 两项功能反而是 Opus 5 更强。Opus 5 的可靠知识截止日期为 2026 年 5 月,而 Fable 5 为 2026 年 1 月;此外,对话中途更改工具的能力(beta mid-conversation-tool-changes-2026-07-01)从 Opus 5 开始提供。

Mythos 5 与 Project Glasswing 的位置

Anthropic Claude Platform Docs 页面截图,标题为 Introducing Claude Fable 5 and Claude Mythos 5,展示恢复访问的提示框,以及列出 claude-fable-5 和 claude-mythos-5 及其说明的模型表

Anthropic 仍将 Fable 5 称为“Anthropic 能力最强的广泛发布模型”。“广泛发布”正是限定词,它排除了 Claude Mythos 5(claude-mythos-5):后者具备相同能力,价格也同为 $10 / $50。

Mythos 5 仅通过 Project Glasswing 提供,这是一个受限的防御性网络安全发布计划,没有自助注册入口。两者的差异在于分类器和访问权限,而不是能力:Mythos 5 可以理解为没有安全分类器的 Fable 5,并非更强的模型。

这也重新排列了安全场景的选择。Anthropic 将 Opus 5 在网络安全和生物学能力上置于 Mythos 5 之后,并称其在漏洞利用开发方面“远远落后”,均为厂商自报。安全工作中最强的 Claude 是你买不到的那一个;而你能以 2 倍价格买到的模型,其分类器却可能拦截良性调试请求。Mythos 5 与 Opus 4.8 的实测对比梳理了这一产品脉络。

如何调用这两个模型

模型 ID 与访问渠道

Opus 5 的模型 ID 是 claude-opus-5,也是 Claude Max 的新默认模型。Fable 5 的 ID 是 claude-fable-5,使用同一套 API;在 Claude Code 中,两个模型都可通过 /model 选择。Opus 5 可运行于:

  • Claude API、claude.ai、Claude Code 和 Claude Cowork
  • Amazon Bedrock,模型 ID 为 anthropic.claude-opus-5
  • Google Cloud 和 Microsoft Foundry

两者均支持 100 万 token 上下文窗口和最高 128k 输出,因此上下文不是决胜因素。消费级套餐中,Fable 5 的额度在 7 月 7 日后改为 usage credits;标准 Enterprise 席位则“未包含 Fable 5 额度”。也就是说,没有 credits 的组织根本无法访问 Fable 5。

真正影响支出的控制项

真正影响开销的是 effort 和 thinking 控制。Opus 5 提供 lowmax,默认值为 high,并且在 high 或更低档位可关闭 thinking。Fable 5 的自适应 thinking 则完全无法关闭,它为输出 token 设下了一条不可调低的底线。

如果你通过 Anthropic 兼容 gateway 调用 Claude,先确认其中是否提供这场对比中的两端模型。

AIReiter 对 Opus 4.8 的定价为 $1.56 / $7.76 每 MTok,而官方为 $5 / $25,约低 69%。截至 7 月 25 日,其 Claude 产品线止于 Fable 5、Sonnet 5、Opus 4.8 和 Opus 4.7,尚未列出 Opus 5。

建议:默认 Opus 5,只有一个真正的例外

默认选择 Opus 5,把 Fable 5 视为需要按任务类别逐一论证的升级选项。Anthropic 自己的建议也是如此:“复杂 agentic 编程和企业工作请从 Claude Opus 5 开始。对于需要当前最高能力的工作负载,请使用 Claude Fable 5。”

有两种情况改变的是计算输入,而不是直接跨过成功率门槛:

  • 长时间自主运行的任务:静默失败的成本高于一次重试,且 p 不再可测量。
  • 任何异步任务:Fable 5 在 Batch 中的价格与 Opus 5 的同步标价相同。

还有一个例外并非满足算式,而是直接凌驾于算式之上:Priority Tier。Fable 5 和 Opus 4.8 属于该层级,而 Opus 5、Sonnet 5 和 Mythos 5 被排除在外。因此,若工作负载需要承诺 99.5% uptime 的吞吐能力,低价一侧无论出多少钱都买不到。

但这项例外要严格理解。Anthropic 表示,这些容量承诺“已不再开放购买”,现有持有者也只能使用到合同结束日期。如果你手上没有现成的承诺,这个例外对你就是关闭的,盈亏平衡计算依然成立。

FAQ

Opus 5 比 Fable 5 更好吗?

max effort 下,Opus 5 以每任务一半的成本,达到 Fable 5 在 CursorBench 3.2 峰值成绩 0.5% 以内的水平。这是厂商自报数据,尚未经过独立复现。其知识截止日期也更新:Opus 5 为 2026 年 5 月,Fable 5 为 2026 年 1 月。

Fable 5 仍保有“能力最强的广泛发布模型”这一称号,设计目标也更偏向长周期 agentic 运行。其 Priority Tier 资格仅对已持有相关承诺的组织有意义。

Fable 5 为什么曾从 Claude 中下线,现在回来了吗?

Anthropic 曾在 2026 年 6 月 12 日至 7 月 1 日暂停向所有用户提供两个模型,原因是美国出口管制要求限制外国公民访问。导火索是外部报告发现了一种可诱导 Fable 5 绕过护栏、寻找软件漏洞的方式。目前访问已恢复;经过重新训练的分类器在超过 99% 的案例中可将其拦截,但也会更频繁地误伤良性编程请求。

Claude Fable 5 免费吗?

不免费。其 API 定价为每百万 token $10 / $50。消费级套餐此前可在每周使用上限的最多 50% 范围内使用,直到 7 月 7 日;之后访问改为 usage credits,标准 Enterprise 席位不包含额度。批量使用时,最便宜的路径是价格为 $5 / $25 的 Batch API。

Fable 5 的 tokenizer 会让实际价格差距达到 2.6 倍吗?

不会。两者都使用随 Opus 4.7 引入的 tokenizer,因此约 30% 的 token 膨胀是相对于 Sonnet 4.6 及更早模型而言,不存在于这两个模型之间。按每 token 计算,差距为 2.0x;而在我们的样本中,Fable 5 输出 token 少了 21%,单次成本差距约为 1.6x。

Fable 5 和 Mythos 5 有什么区别?

规格相同,价格也同为 $10 / $50。Mythos 5 具备 Fable 5 的能力但没有安全分类器,仅通过 Project Glasswing 提供,无法自助注册。两者都是 Covered Models,采用 30 天保留政策,也都在同一个 6 月窗口期被暂停服务。

我能关闭 Fable 5 的 thinking 来降低账单吗?

不能。Fable 5 的自适应 thinking 始终开启,因此其输出 token 下限是结构性的。Opus 5 在 effort 为 high 或更低时接受 thinking: {"type": "disabled"};在 xhighmax 下则返回 400。这意味着,只有更便宜的模型能将 effort 当作成本调节旋钮。

记住这一个数字就够了

对绝大多数任务类型而言,一个比例就能决定 Claude Opus 5 vs Fable 5 的选择,而它指向 Opus 5。同样的算法也适用于不同厂商;例如 Opus 5 与 GPT-5.6 系列的比较,变化的只是费率。

  • 当你的工作负载满足 success_rate(Fable 5) / success_rate(Opus 5) >= 1.6 时达到盈亏平衡。低于这条线,选择 Opus 5 再加一次重试,每个完成任务的成本仍更低。