在 Claude Fable 5 裡,該選 high 還是 max effort?結論其實很直接:絕大多數情況維持 high 就好;碰上棘手的程式任務或 agentic 工作,再升到 xhigh;max 應視為極少數情境才動用的最後手段。多數任務下,max 的成本大約會翻倍,品質提升卻不容易量化,甚至可能因為想得太多而表現失準。許多人忽略的是,high 與 max 中間其實還有一檔 xhigh;當你想知道 effort 是否該往上調時,它通常才是正解。
Fable 5 的 effort 設定實際改變了什麼?
Effort(output_config.effort)共分五級:low、medium、high、xhigh、max。Fable 5 預設為 high;根據 Anthropic 的 effort 文件,明確設定 high 與完全不傳此參數,效果相同。
有兩件事常讓人意外。第一,effort 不只是控制推理深度的旋鈕,它會影響所有 token 用量:可見的輸出文字、extended thinking,以及 agentic 迴圈中的工具呼叫。較低 effort 代表工具呼叫較少且更集中、前言更少、確認訊息更精簡;較高 effort 則代表更多呼叫、更完整的規劃過程,以及更長的摘要。第二,Fable 5 的 thinking 永遠開啟,無法關閉(thinking: {type: "disabled"} 會報錯),因此 effort 就是控制其推理深度的方式。在 high、xhigh 與 max 下,Claude 幾乎都會進行深度思考;而在 low 與 medium 下,面對簡單問題時則可能跳過思考。
不是 high 對 max,而是三段式選擇
所謂「high 與 max 怎麼選」,實際上是三段式問題,因為中間還有 xhigh,提供更細緻的推理深度與延遲取捨。Anthropic 工程師 Boris Cherny 形容它是「介於 high 和 max 之間的新級別」。目前只有 Fable 5、Mythos 5、Opus 4.8、Opus 4.7 與 Sonnet 5 支援這一級;較舊的 Opus 4.6 和 Sonnet 4.6,則會直接從 high 跳到 max。
以下是完整的 effort 階梯,以及 Anthropic 為各級別定義的用途:
| 級別 | Anthropic 建議用途 |
|---|---|
low | 追求最快速度與最低成本的簡單任務,例如 subagents |
medium | 在速度、成本與效能之間取平衡的 agentic 任務 |
high | 複雜推理、困難程式開發與 agentic 任務,也是預設值 |
xhigh | 長時間執行的 agentic/程式任務(30+ 分鐘),token 預算可達數百萬 |
max | 最深度的推理,內部 effort 不設上限,但輸出仍受 max_tokens 限制 |
因此,當有人問 Fable 5 是否該開到 max,更誠實的第一個問題應該是:你試過 xhigh 了嗎?針對最困難的程式與 agentic 工作,建議優先升到 xhigh,而不是直接使用 max。
你拿成本與延遲換到了什麼?
提高 effort 不會改變每 token 的單價。Fable 5 在所有級別下,輸入皆為每百萬 token $10、輸出皆為每百萬 token $50;成本上升純粹是因為模型產生了更多 token。
這張圖僅用於說明,並非實測數據。它將下文所述取捨的趨勢視覺化,並以 max 在兩個軸向皆為 1.0 進行標準化。品質在 high 時已接近上限,但成本隨著級別提高仍持續大致翻倍。
從 xhigh 升到 max,往往就是投入報酬開始失衡的地方。軟體工程師 Ishu Agarwal 在 2026 年 7 月 11 日的分享中指出,high → xhigh 的品質提升「通常可能不到 3%」,成本卻會增加「30% 到 100%」,而模型在較高 effort 下傾向「過度思考」。另一篇在 7 月 14 日廣泛流傳的貼文則宣稱,Fable 5 在 max 與 xhigh 得到完全相同的分數:「89.0 對 89.0,成本大約卻是兩倍。」這些是具方向性的社群觀察,並非受控 benchmark;不過其結論與 Anthropic 的說法一致:max「以顯著成本換取相對有限的品質提升」,而在某些結構化輸出或對智慧要求較低的任務上,甚至可能導致過度思考。
延遲的趨勢也相同。產品經理 Pawel Huryn 在 2026 年 6 月 11 日測試各 effort 級別後發現,「在 max 以下,完成時間幾乎不太變動」,但實際工作中,「從 xhigh 往上,完成時間會明顯跳升」。還有一個容易忽略的陷阱:Fable 5 與最新一代 Opus 共用 tokenizer,同樣文字所計出的 token 數可能比舊版 Claude 高出最多約 ~35%,因此若你拿先前模型的成本作基準,實際成本會顯得偏低。
high、xhigh、max 的實用選擇規則
| 任務類型 | 建議 effort | 何時升級 |
|---|---|---|
| 例行程式工作、聊天、資料擷取、subagents | low / medium | 輸出品質明顯下降時 |
| 大多數推理、日常程式開發、agentic 工作 | high(預設) | 困難任務卡住,或需要更深入規劃時 |
| 最困難的程式/agentic 工作、長期執行、重度工具使用 | xhigh | xhigh 確實無法解決時 |
前沿問題,或 xhigh 也無法修正的 bug,且正確性優先於成本 | max | (最高級別) |
high 是品質與 token 效率最平衡的甜蜜點;xhigh 能為最困難的工作帶來真正更充分的推敲;而 max 則是在 xhigh 已經失敗後,成功機率不高的一次加碼。很多時候,往下調反而更明智:依 Anthropic 的說法,Fable 5 在較低 effort 下依然表現出色,且「經常超越舊模型的 xhigh 表現」。CTO Morgan Linton 說得很直接:「從程式開發角度來看,我大約 95% 的工作只需要 Fable 5 Low 和 Medium。」當 Low 或 Medium 已能給出相同結果,卻一律使用 high,只會更快耗盡方案額度。
如果真正的問題在於模型本身不適合這項工作,調整 effort 也無濟於事——那是模型選擇問題,而非 effort 問題。
關於 Fable 5 effort,最常見的三個誤解
更高 effort 不代表模型更聰明。 Effort 決定 Claude 在回答前要投入多少工作量,包括更多思考與更多工具呼叫,而不是決定模型能力。low 與 max 的回答都來自同一個模型;若任務超出模型能力,max 只會花更多資源得到相同結果。
Claude Code 的預設值不同於 API。 Claude Code 預設為 xhigh,API 預設則是 high。這正好解釋了許多「為什麼同一模型在這裡表現不同」的疑問:Claude Code 因為預設值較高,看起來更周詳,成本也更高。若希望 API 的行為與其一致,請明確設定 xhigh。
ultracode 不是 effort 級別。 它會出現在 Claude Code 的選單中,但 API 僅接受從 low 到 max 的級別。Ultracode 是把 xhigh 與可隨時啟動多代理工作流程的權限結合在一起;它很吃 token,且無法作為參數傳給 API。
如何設定 effort,以及 max_tokens 注意事項
Effort 設定放在 output_config 中,不需要 beta header。由於 Fable 5 的 thinking 永遠開啟,請完全省略 thinking 參數:
import anthropic
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-fable-5",
max_tokens=64000, # give room at xhigh/max (see note below)
output_config={"effort": "xhigh"}, # low | medium | high | xhigh | max
messages=[{"role": "user", "content": "Refactor this module and add tests."}],
)
max_tokens 是總輸出的硬上限,包含 thinking 與回應文字。在 xhigh 或 max 下,thinking 可能消耗其中大部分預算;因此請設定充足額度,建議從約 64,000 開始,否則回答可能在思考中途遭截斷。Fable 5 支援 1M-token context 與 128K output tokens。
常見問題
Fable 5 的 high 與 max effort 有何差異?
high 是預設值,會投入足夠資源來取得優異結果;max 則移除所有限制,以進行最深度的推理。不過,從 high 往上調時,通常真正有意義的升級是介於兩者之間的 xhigh。
Fable 5 的 max effort 值得用嗎?
很少值得。相較於 xhigh,它的成本約翻倍,卻幾乎沒有可量測的提升,還可能過度思考。只有在前沿問題,或 xhigh 也無法解決的 bug 上,才建議保留給 max。
如何更改 effort 級別?
設定 output_config: {"effort": "..."},可填入 low、medium、high、xhigh 或 max。在 Claude Code 中,則使用其 effort 選單。
預設 effort 級別是什麼?
API 的預設值為 high,與不傳此參數相同。Claude Code 則預設為 xhigh。
更高 effort 的每 token 成本會更高嗎?
不會,費率固定。更高 effort 之所以更貴,只是因為模型會產生更多 token。
Fable 5 的 effort 與 Sonnet 或 Opus 的 effort 級別相同嗎?
參數與名稱相同,但 xhigh 僅存在於 Fable 5、Mythos 5、Opus 4.8、Opus 4.7 與 Sonnet 5,各模型的建議預設值也不同。如果你正在兩者之間選擇,可參考 Sonnet 5 versus Fable 5。