將 claude-fable-5 改成 claude-fable-5-1,第一次請求或許會順利回傳;但正式上線後,才可能發現工具路由或可變動的對話歷史失效。若是長時間運行、重度使用快取的工作,Fable 5.1 是更好的預設選擇;不過它不是零風險的直接替換。模型的牌價與限制不變,但有三項 API 行為改了。
先講結論:快取型 Agent 值得升級,其他情況先別急
Claude Fable 5.1 是 Claude Fable 5 的現行後繼版本,Anthropic 也建議使用者遷移,以取得更好的效能。若 Agent 會反覆讀取大型提示前綴,升級的效益尤其明顯:快取讀取價格從每百萬 tokens $1 降至 $0.25;一般輸入與輸出的費率則維持每百萬 tokens $10 與 $50。(Anthropic 的 Fable 5.1 概覽)
| 你的工作負載如果是… | 建議從…開始 | 原因 |
|---|---|---|
| 重複使用很長的 system prompt、程式碼庫或文件脈絡 | Fable 5.1 | 快取讀取便宜 75%,而且 Anthropic 報告的 Agent 表現更強。 |
使用強制工具呼叫,例如 tool_choice: {"type":"any"} | 切換前先測試 Fable 5.1 | Fable 5.1 會拒絕強制選擇工具,並回傳 400 錯誤。 |
| 會編輯或重建較早的對話回合 | 在修正歷史紀錄層前,先保留 Fable 5 | Fable 5.1 會將 thinking blocks 綁定在前面的提示、工具與歷史紀錄上。 |
| 需要最低的一般 token 單價 | 兩個 Fable 模型都不是答案 | 兩者的每百萬輸入 tokens 都是 $10、輸出 tokens 都是 $50。 |
| 使用一般、未快取的提示,且現有 Fable 5 整合已經穩定 | 先跑評估 | 牌價節省可能有限,基準測試的提升幅度也會隨任務而異。 |
Fable 5.1 相較 Fable 5,到底改了哪些地方?
Claude Fable 5.1 保留了 Claude Fable 5 的主要能力規格:1 百萬 token context window、128,000 tokens 的最大輸出量,以及永遠啟用的 adaptive thinking。文件列出的差異包括產品生命週期狀態、知識截止日從 January 2026 改為 June 2026、更便宜的快取讀取,以及工具與 thinking blocks 相關的新 API 行為。(Fable 5 舊版概覽;Fable 5.1 模型概覽)
| 規格 | Claude Fable 5 | Claude Fable 5.1 |
|---|---|---|
| API model ID | claude-fable-5 | claude-fable-5-1 |
| 生命週期 | Active,legacy | Active,最新 Fable 模型 |
| 發布日期 | June 9, 2026 | September 1, 2026 |
| Context window | 1M tokens | 1M tokens |
| 最大輸出 | 128K tokens | 128K tokens |
| Thinking | Adaptive,永遠啟用 | Adaptive,永遠啟用 |
| 預設 effort | High | High |
| 可靠知識截止日 | January 2026 | June 2026 |
| 輸入/輸出價格 | $10 / $50 per MTok | $10 / $50 per MTok |
| 快取讀取價格 | $1 / MTok | $0.25 / MTok |
Fable 5.1 可透過 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 與 AWS 上的 Claude Platform 使用。Anthropic 也將 Fable 5 列為可在相同平台系列上使用,且不會早於 June 9, 2027 退役;Fable 5.1 則不會在 September 1, 2027 前退役。(Fable 5.1 的可用性與生命週期;Fable 5 的可用性與生命週期)
省錢關鍵在快取讀取,不在基本牌價
對一般全新輸入或輸出 token 而言,Fable 5.1 並沒有更便宜。它和 Fable 5 一樣,輸入每百萬 tokens 收費 $10、輸出每百萬 tokens 收費 $50;差別在於快取讀取從每百萬 tokens $1 降到 $0.25。(Anthropic 定價文件)
| 用量類別 | Fable 5 | Fable 5.1 | 變化 |
|---|---|---|---|
| 全新輸入 | $10 / MTok | $10 / MTok | 無 |
| 輸出 | $50 / MTok | $50 / MTok | 無 |
| 5 分鐘快取寫入 | $12.50 / MTok | $12.50 / MTok | 無 |
| 1 小時快取寫入 | $20 / MTok | $20 / MTok | 無 |
| 快取讀取 | $1 / MTok | $0.25 / MTok | 低 75% |
| Batch 輸入/輸出 | 50% 折扣 | 50% 折扣 | 標示折扣相同 |
舉個簡單例子:假設某個 Agent 對一份已快取的 1 百萬 token 專案脈絡讀取十次,接著產生 200,000 tokens 的輸出。Fable 5 的快取讀取部分成本是 $10,Fable 5.1 則是 $2.50;兩個模型的輸出成本都為 $10。在這些有限假設下,token 帳單會從 $20 降至 $12.50,也就是降低 37.5%。
實際節省幅度取決於快取命中率、寫入次數、輸出長度、重試、工具呼叫與備援路由。Anthropic 估計,典型工作負載的成本約可降低 25%,高度 agentic 的工作負載則最高約可降低 45%。(Anthropic 的 Fable 產品頁面)
訂閱方案的用量和 API 成本是兩回事。Anthropic 說明中心指出,Fable 5 與 Fable 5.1 遵循相同的現行方案機制:Max 以及 premium Team 或 legacy Enterprise 席次,最多可將每週用量限制的 50% 用於 Fable 模型;Pro 與 standard 席次則使用隨用隨付的 usage credits。先前的 Fable 5 優惠已在 July 19, 2026 結束,Fable 5.1 並未包含在該活動中。(Anthropic 方案說明)
基準測試確實進步,但不是每項任務都同樣明顯
Anthropic 公開的比較數據顯示,Fable 5.1 在多項 Agent 與電腦操作評測中明顯領先 Fable 5;不過領先幅度從小幅到極大都有。這些是廠商針對具防護措施、特定版本評測所公布的結果,適合用來判斷方向,實際上線前仍應以自家提示與任務驗證。(Anthropic 的基準測試表)
| Benchmark | Fable 5.1 | Fable 5 | 差異 |
|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | +27.9 points |
| Terminal-Bench 4.0 | 55.8% | 42.0% | +13.8 points |
| GDPval-AA v2 | 1,853 Elo | 1,723 Elo | +130 Elo |
| OSWorld 2.0,partial | 77.9% | 72.9% | +5.0 points |
| OSWorld 2.0,strict | 41.7% | 36.1% | +5.6 points |
| Humanity’s Last Exam,無工具 | 60.9% | 57.8% | +3.1 points |
| Humanity’s Last Exam,使用工具 | 65.0% | 63.8% | +1.2 points |
| AutomationBench | 31.4% | 17.1% | +14.3 points |
| CursorBench 3.2.0 | 73.4% | 70.5% | +2.9 points |
已公布結果中,差距最大的是 Terminal-Bench-Science 0.1:Fable 5.1 的報告分數超過 Fable 5 的兩倍。AutomationBench 與 Terminal-Bench 4.0 的提升也相當可觀。相較之下,Humanity’s Last Exam 與 CursorBench 的增幅較小,所能得出的結論也應更收斂:Fable 5.1 並非在每一類工作上都以同樣幅度領先。
Anthropic 的表格將公開版 Fable 5.1 的 Terminal-Bench 4.0 成績列為 55.8%,並另外列出 Mythos 5.1 的 60.9%。Mythos 5.1 並不是可普遍取得、用來取代 Fable 5.1 的模型。(Anthropic 的產品頁面)
API 遷移前,先驗證這三個 Fable 5 行為
Anthropic 將 Fable 5.1 的遷移描述為大致可直接替換,但有三項改動可能造成正式環境故障,或在不易察覺的情況下改變 Agent 行為。把所有環境的 model ID 一口氣改掉前,務必先測這幾項。(Fable 5.1 遷移指南)
1. 強制選擇工具會回傳 400
Fable 5.1 接受 tool_choice: {"type":"auto"} 與 tool_choice: {"type":"none"},但會拒絕 {"type":"any"} 和指定名稱的強制工具選擇,並回傳 400 invalid_request_error。這個限制適用於 Messages API、Message Batches API 與 token-counting endpoint。
應用程式若需要有效 JSON,請在可用時使用 structured outputs,或維持 auto 工具選擇,搭配嚴格 schema 與明確指令。若某一回合必須使用特定工具,Anthropic 文件建議改用附加的、僅限該回合的 system instruction。
2. Thinking blocks 會綁定產生它的模型
Fable 5.1 可以讀取 Fable 5 與更早、相容 Claude 模型所保留的 thinking blocks。舊模型無法讀取 Fable 5.1 的 thinking blocks;如果備援機制將對話送往舊模型,API 會捨棄無法讀取的 blocks,備援模型也必須重新規劃。
被捨棄的 blocks 不計入輸入費用,但重新規劃可能提高模型切換後的延遲與第一回合成本。若要除錯,Anthropic 文件提供 thinking-binding-controls-2026-08-01 beta header,會回報 model_binding_mismatch transformation。
3. 修改較早的歷史內容,可能讓請求失效
對較新的 API 帳戶,Fable 5.1 會檢查已保留 thinking block 前方的 system prompt、工具或早期訊息歷史是否被變更。若編輯、重排、刪除或重建這段前綴,請求可能不會產生回應,而是回傳 400 invalid-signature error。
最安全的預設做法是 append-only 歷史紀錄。不要把摘要插入逐字稿中間,應改用 server-side compaction 或 context editing;跨回合檔案也應保持穩定,使用 Files API 的 file_id 或完全相同的 bytes。若客戶端本來就能保留完全一致的前綴,可能只需更換 model ID;若每一回合都會重建 messages,則應先建立 adapter。
值得採用的新增能力
Fable 5.1 也加入一些控制項,不必全面重寫,就能改善長時間運行的 Agent:
- 逐訊息調整 effort:可在後續回合改為
low、medium、high、xhigh或max,不會讓已快取的前綴失效。 - 僅限單回合的 system messages:加入一次性的指令,不必在早期 system prompt 中插入再刪除文字。
- 進度更新:透過文件定義的 display settings,要求模型在工具呼叫之間提供可讀的更新訊息。
- 更低的快取讀取價格:保留重複使用的前綴,但遷移後應重新測量快取命中率。
effort 名稱並不是可跨模型比較的工作量單位。請先使用文件中的預設 high,再針對實際任務集比較 medium 及更高設定的品質、延遲與總 token 數。
存取權、配額與備援路由,也會影響實際結果
Fable 5.1 在付費 Claude 方案、Anthropic API 與列出的雲端平台上都已廣泛提供,但有方案存取權不等於有無限內含用量。Pro 使用者與 standard Team 席次可能從第一個請求起就需要 usage credits;Max 與 premium 席次則共用每週池中專屬於 Fable 的一部分。Claude Code 使用 Fable 5.1 需要 2.1.250 或更新版本;Fable 5 則需要 2.1.170 或更新版本。(Anthropic 的方案與存取指南)
自動切換也可能讓你在 App 中看到的 Fable 比較結果,和 API 內不同。Anthropic 表示,敏感的資安與生物學請求可能會被路由至 Opus 備援模型,且 Claude 各介面預設已啟用自動切換。API 則需要開發者自行設定備援;如果沒有加入備援處理,拒絕請求會以成功的 HTTP 回應傳回,並帶有 refusal stop reason。(Anthropic 的備援說明)
早期使用者回報僅屬軼聞,但指出試行時應衡量兩項成本:
「5.1 看起來沒問題,但感覺確實比較慢。」— u/BeowulfShaeffer,r/ClaudeAI 發布討論
「我的用量已經到 100% 了。」— u/noeyb,r/ClaudeAI 發布討論
這些留言不足以證明普遍的效能趨勢,但很值得在記錄回答品質的同時,一併記錄實際耗時與配額消耗。
Fable 5 使用者的實務決策表
| 情境 | 實務選擇 |
|---|---|
| 新的 Agent,且會重複讀取脈絡 | Fable 5.1,從第一天起記錄快取命中率與延遲 |
| 既有 Fable 5 Agent,採 append-only 歷史紀錄與自動工具選擇 | 在具代表性的任務切片上試行 Fable 5.1 |
| 既有 Agent 會強制指定工具 | 先修正工具選擇機制,再測試 Fable 5.1 |
| 既有客戶端會重寫舊訊息或 system prompts | 重新設計歷史紀錄層期間,保留 Fable 5 作為備援 |
| 多半是全新提示,幾乎不重複使用快取 | 比較每項完成任務的成本,不要只看 token 費率 |
| 工作內容可能觸發資安或生物學防護機制 | 先為備援路徑建模,並在遷移前納入 Opus 定價 |
| 需要更低的一般輸入/輸出費率 | 比較其他 Anthropic 模型,因為 Fable 5.1 與 Fable 5 的牌價完全相同 |
實際遷移測試不需要做得很大:重播 20 到 50 個具代表性的任務,固定使用相同工具與提示,並記錄成功率、強制工具錯誤、備援次數、快取讀取 tokens、總輸入/輸出 tokens、延遲、配額消耗與每項完成任務成本。只有在 Fable 5.1 通過品質門檻,且未造成不可接受的相容性或配額問題時,才應正式升級。
採購前仍常見的問題
為什麼 Claude 會從 Fable 5.1 切換出去?
防護分類器可能會讓部分資安、生物學、推理萃取或前沿模型開發請求觸發自動備援。在 Claude App 中,請求可能會交由 Opus 模型重新執行;在 API 中,備援行為則必須由開發者設定。(Anthropic 的備援說明)
對於新的長週期 Agent,以及大量重複使用快取的 Fable 5 工作負載,Fable 5.1 是較好的目標模型。若整合會強制使用工具、修改訊息歷史,或無法承受備援與配額的不確定性,則應在相容性試行期間保留 Fable 5。