AIREITER
API 文件價格
範本
  • AIReiter
  • 部落格
  • Fable 5.1 vs 5:成本、基準測試與 API 變更

Fable 5.1 vs 5:成本、基準測試與 API 變更

最近更新: 2026-09-02 02:46:56

將 claude-fable-5 改成 claude-fable-5-1,第一次請求或許會順利回傳;但正式上線後,才可能發現工具路由或可變動的對話歷史失效。若是長時間運行、重度使用快取的工作,Fable 5.1 是更好的預設選擇;不過它不是零風險的直接替換。模型的牌價與限制不變,但有三項 API 行為改了。

先講結論:快取型 Agent 值得升級,其他情況先別急

Claude Fable 5.1 是 Claude Fable 5 的現行後繼版本,Anthropic 也建議使用者遷移,以取得更好的效能。若 Agent 會反覆讀取大型提示前綴,升級的效益尤其明顯:快取讀取價格從每百萬 tokens $1 降至 $0.25;一般輸入與輸出的費率則維持每百萬 tokens $10 與 $50。(Anthropic 的 Fable 5.1 概覽)

你的工作負載如果是…建議從…開始原因
重複使用很長的 system prompt、程式碼庫或文件脈絡Fable 5.1快取讀取便宜 75%,而且 Anthropic 報告的 Agent 表現更強。
使用強制工具呼叫,例如 tool_choice: {"type":"any"}切換前先測試 Fable 5.1Fable 5.1 會拒絕強制選擇工具,並回傳 400 錯誤。
會編輯或重建較早的對話回合在修正歷史紀錄層前,先保留 Fable 5Fable 5.1 會將 thinking blocks 綁定在前面的提示、工具與歷史紀錄上。
需要最低的一般 token 單價兩個 Fable 模型都不是答案兩者的每百萬輸入 tokens 都是 $10、輸出 tokens 都是 $50。
使用一般、未快取的提示,且現有 Fable 5 整合已經穩定先跑評估牌價節省可能有限,基準測試的提升幅度也會隨任務而異。

Fable 5.1 相較 Fable 5,到底改了哪些地方?

Claude Fable 5.1 保留了 Claude Fable 5 的主要能力規格:1 百萬 token context window、128,000 tokens 的最大輸出量,以及永遠啟用的 adaptive thinking。文件列出的差異包括產品生命週期狀態、知識截止日從 January 2026 改為 June 2026、更便宜的快取讀取,以及工具與 thinking blocks 相關的新 API 行為。(Fable 5 舊版概覽;Fable 5.1 模型概覽)

規格Claude Fable 5Claude Fable 5.1
API model IDclaude-fable-5claude-fable-5-1
生命週期Active,legacyActive,最新 Fable 模型
發布日期June 9, 2026September 1, 2026
Context window1M tokens1M tokens
最大輸出128K tokens128K tokens
ThinkingAdaptive,永遠啟用Adaptive,永遠啟用
預設 effortHighHigh
可靠知識截止日January 2026June 2026
輸入/輸出價格$10 / $50 per MTok$10 / $50 per MTok
快取讀取價格$1 / MTok$0.25 / MTok

Fable 5.1 可透過 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 與 AWS 上的 Claude Platform 使用。Anthropic 也將 Fable 5 列為可在相同平台系列上使用,且不會早於 June 9, 2027 退役;Fable 5.1 則不會在 September 1, 2027 前退役。(Fable 5.1 的可用性與生命週期;Fable 5 的可用性與生命週期)

省錢關鍵在快取讀取,不在基本牌價

對一般全新輸入或輸出 token 而言,Fable 5.1 並沒有更便宜。它和 Fable 5 一樣,輸入每百萬 tokens 收費 $10、輸出每百萬 tokens 收費 $50;差別在於快取讀取從每百萬 tokens $1 降到 $0.25。(Anthropic 定價文件)

用量類別Fable 5Fable 5.1變化
全新輸入$10 / MTok$10 / MTok無
輸出$50 / MTok$50 / MTok無
5 分鐘快取寫入$12.50 / MTok$12.50 / MTok無
1 小時快取寫入$20 / MTok$20 / MTok無
快取讀取$1 / MTok$0.25 / MTok低 75%
Batch 輸入/輸出50% 折扣50% 折扣標示折扣相同

舉個簡單例子:假設某個 Agent 對一份已快取的 1 百萬 token 專案脈絡讀取十次,接著產生 200,000 tokens 的輸出。Fable 5 的快取讀取部分成本是 $10,Fable 5.1 則是 $2.50;兩個模型的輸出成本都為 $10。在這些有限假設下,token 帳單會從 $20 降至 $12.50,也就是降低 37.5%。

實際節省幅度取決於快取命中率、寫入次數、輸出長度、重試、工具呼叫與備援路由。Anthropic 估計,典型工作負載的成本約可降低 25%,高度 agentic 的工作負載則最高約可降低 45%。(Anthropic 的 Fable 產品頁面)

訂閱方案的用量和 API 成本是兩回事。Anthropic 說明中心指出,Fable 5 與 Fable 5.1 遵循相同的現行方案機制:Max 以及 premium Team 或 legacy Enterprise 席次,最多可將每週用量限制的 50% 用於 Fable 模型;Pro 與 standard 席次則使用隨用隨付的 usage credits。先前的 Fable 5 優惠已在 July 19, 2026 結束,Fable 5.1 並未包含在該活動中。(Anthropic 方案說明)

基準測試確實進步,但不是每項任務都同樣明顯

Anthropic 公開的比較數據顯示,Fable 5.1 在多項 Agent 與電腦操作評測中明顯領先 Fable 5;不過領先幅度從小幅到極大都有。這些是廠商針對具防護措施、特定版本評測所公布的結果,適合用來判斷方向,實際上線前仍應以自家提示與任務驗證。(Anthropic 的基準測試表)

BenchmarkFable 5.1Fable 5差異
Terminal-Bench-Science 0.152.6%24.7%+27.9 points
Terminal-Bench 4.055.8%42.0%+13.8 points
GDPval-AA v21,853 Elo1,723 Elo+130 Elo
OSWorld 2.0,partial77.9%72.9%+5.0 points
OSWorld 2.0,strict41.7%36.1%+5.6 points
Humanity’s Last Exam,無工具60.9%57.8%+3.1 points
Humanity’s Last Exam,使用工具65.0%63.8%+1.2 points
AutomationBench31.4%17.1%+14.3 points
CursorBench 3.2.073.4%70.5%+2.9 points
Fable 5.1 與 Fable 5 的官方基準測試比較

已公布結果中,差距最大的是 Terminal-Bench-Science 0.1:Fable 5.1 的報告分數超過 Fable 5 的兩倍。AutomationBench 與 Terminal-Bench 4.0 的提升也相當可觀。相較之下,Humanity’s Last Exam 與 CursorBench 的增幅較小,所能得出的結論也應更收斂:Fable 5.1 並非在每一類工作上都以同樣幅度領先。

Anthropic 的表格將公開版 Fable 5.1 的 Terminal-Bench 4.0 成績列為 55.8%,並另外列出 Mythos 5.1 的 60.9%。Mythos 5.1 並不是可普遍取得、用來取代 Fable 5.1 的模型。(Anthropic 的產品頁面)

API 遷移前,先驗證這三個 Fable 5 行為

Anthropic 將 Fable 5.1 的遷移描述為大致可直接替換,但有三項改動可能造成正式環境故障,或在不易察覺的情況下改變 Agent 行為。把所有環境的 model ID 一口氣改掉前,務必先測這幾項。(Fable 5.1 遷移指南)

1. 強制選擇工具會回傳 400

Fable 5.1 接受 tool_choice: {"type":"auto"} 與 tool_choice: {"type":"none"},但會拒絕 {"type":"any"} 和指定名稱的強制工具選擇,並回傳 400 invalid_request_error。這個限制適用於 Messages API、Message Batches API 與 token-counting endpoint。

應用程式若需要有效 JSON,請在可用時使用 structured outputs,或維持 auto 工具選擇,搭配嚴格 schema 與明確指令。若某一回合必須使用特定工具,Anthropic 文件建議改用附加的、僅限該回合的 system instruction。

2. Thinking blocks 會綁定產生它的模型

Fable 5.1 可以讀取 Fable 5 與更早、相容 Claude 模型所保留的 thinking blocks。舊模型無法讀取 Fable 5.1 的 thinking blocks;如果備援機制將對話送往舊模型,API 會捨棄無法讀取的 blocks,備援模型也必須重新規劃。

被捨棄的 blocks 不計入輸入費用,但重新規劃可能提高模型切換後的延遲與第一回合成本。若要除錯,Anthropic 文件提供 thinking-binding-controls-2026-08-01 beta header,會回報 model_binding_mismatch transformation。

3. 修改較早的歷史內容,可能讓請求失效

對較新的 API 帳戶,Fable 5.1 會檢查已保留 thinking block 前方的 system prompt、工具或早期訊息歷史是否被變更。若編輯、重排、刪除或重建這段前綴,請求可能不會產生回應,而是回傳 400 invalid-signature error。

最安全的預設做法是 append-only 歷史紀錄。不要把摘要插入逐字稿中間,應改用 server-side compaction 或 context editing;跨回合檔案也應保持穩定,使用 Files API 的 file_id 或完全相同的 bytes。若客戶端本來就能保留完全一致的前綴,可能只需更換 model ID;若每一回合都會重建 messages,則應先建立 adapter。

值得採用的新增能力

Fable 5.1 也加入一些控制項,不必全面重寫,就能改善長時間運行的 Agent:

  1. 逐訊息調整 effort:可在後續回合改為 low、medium、high、xhigh 或 max,不會讓已快取的前綴失效。
  2. 僅限單回合的 system messages:加入一次性的指令,不必在早期 system prompt 中插入再刪除文字。
  3. 進度更新:透過文件定義的 display settings,要求模型在工具呼叫之間提供可讀的更新訊息。
  4. 更低的快取讀取價格:保留重複使用的前綴,但遷移後應重新測量快取命中率。

effort 名稱並不是可跨模型比較的工作量單位。請先使用文件中的預設 high,再針對實際任務集比較 medium 及更高設定的品質、延遲與總 token 數。

存取權、配額與備援路由,也會影響實際結果

Fable 5.1 在付費 Claude 方案、Anthropic API 與列出的雲端平台上都已廣泛提供,但有方案存取權不等於有無限內含用量。Pro 使用者與 standard Team 席次可能從第一個請求起就需要 usage credits;Max 與 premium 席次則共用每週池中專屬於 Fable 的一部分。Claude Code 使用 Fable 5.1 需要 2.1.250 或更新版本;Fable 5 則需要 2.1.170 或更新版本。(Anthropic 的方案與存取指南)

自動切換也可能讓你在 App 中看到的 Fable 比較結果,和 API 內不同。Anthropic 表示,敏感的資安與生物學請求可能會被路由至 Opus 備援模型,且 Claude 各介面預設已啟用自動切換。API 則需要開發者自行設定備援;如果沒有加入備援處理,拒絕請求會以成功的 HTTP 回應傳回,並帶有 refusal stop reason。(Anthropic 的備援說明)

早期使用者回報僅屬軼聞,但指出試行時應衡量兩項成本:

「5.1 看起來沒問題,但感覺確實比較慢。」— u/BeowulfShaeffer,r/ClaudeAI 發布討論

「我的用量已經到 100% 了。」— u/noeyb,r/ClaudeAI 發布討論

這些留言不足以證明普遍的效能趨勢,但很值得在記錄回答品質的同時,一併記錄實際耗時與配額消耗。

Fable 5 使用者的實務決策表

情境實務選擇
新的 Agent,且會重複讀取脈絡Fable 5.1,從第一天起記錄快取命中率與延遲
既有 Fable 5 Agent,採 append-only 歷史紀錄與自動工具選擇在具代表性的任務切片上試行 Fable 5.1
既有 Agent 會強制指定工具先修正工具選擇機制,再測試 Fable 5.1
既有客戶端會重寫舊訊息或 system prompts重新設計歷史紀錄層期間,保留 Fable 5 作為備援
多半是全新提示,幾乎不重複使用快取比較每項完成任務的成本,不要只看 token 費率
工作內容可能觸發資安或生物學防護機制先為備援路徑建模,並在遷移前納入 Opus 定價
需要更低的一般輸入/輸出費率比較其他 Anthropic 模型,因為 Fable 5.1 與 Fable 5 的牌價完全相同

實際遷移測試不需要做得很大:重播 20 到 50 個具代表性的任務,固定使用相同工具與提示,並記錄成功率、強制工具錯誤、備援次數、快取讀取 tokens、總輸入/輸出 tokens、延遲、配額消耗與每項完成任務成本。只有在 Fable 5.1 通過品質門檻,且未造成不可接受的相容性或配額問題時,才應正式升級。

採購前仍常見的問題

為什麼 Claude 會從 Fable 5.1 切換出去?

防護分類器可能會讓部分資安、生物學、推理萃取或前沿模型開發請求觸發自動備援。在 Claude App 中,請求可能會交由 Opus 模型重新執行;在 API 中,備援行為則必須由開發者設定。(Anthropic 的備援說明)

對於新的長週期 Agent,以及大量重複使用快取的 Fable 5 工作負載,Fable 5.1 是較好的目標模型。若整合會強制使用工具、修改訊息歷史,或無法承受備援與配額的不確定性,則應在相容性試行期間保留 Fable 5。

>_AIReiter 模型目錄

快速存取與本指南相關的模型 API

Claude Fable 5.1

Chat

Mythos-class model for long-horizon coding, research, and knowledge work.

Anthropic取得 API Key >

Claude Fable 5

Chat

一款適合深度推理與複雜長篇工作的高級 Claude 模型。

Anthropic取得 API Key >

GLM-5.3 Flash

Chat

用於高頻聊天、圖像理解與抽取的多模態 1M-context 模型。

Zhipu取得 API Key >

Claude Opus 4.8

Chat

一款具備高能力的 Claude 模型,適用於高難度推理與專業工作。

Anthropic取得 API Key >

Claude Opus 5

Chat

適用於複雜推理、程式撰寫與長上下文專業工作的高階 Claude 模型。

Anthropic取得 API Key >

最新文章

GPT-6 Astra API 評測(2026):為代理打造,不是即插即用

2026-09-07

Kling API 串接指南:官方平台與聚合服務怎麼選(2026)

2026-09-07

Suno API Key 怎麼取得、費用多少?(2026)

2026-09-07

GPT-6 Astra 評測:$10/$50 API 定價值得嗎?

2026-09-06
AIREITER

有問題?請聯絡我們
[email protected]

新速率有限公司NEWRATE LIMITED香港九龍花園街 2-16 號好景商業中心 2304 室Room 2304, Haojing Commercial Center, 2-16 Garden Street, Kowloon, Hong Kong

LLM

GPT-6 AstraGemini 3.8 FlashClaude Fable 5.1GLM-5.3 FlashGemini 3.6 Flash

AI 影片

Gemini Omni 1.1 Flash ExtMiniMax H3Kling 3.0 Motion ControlKling 3.0 TurboKling 3.0

AI 圖片

Grok Imagine Image 2.0Midjourney V8.1Midjourney V7Z-Image TurboKrea 2 Turbo

部落格

查看全部 →

公司

隱私政策服務條款退款政策

© 2026 AIReiter。保留所有權利。