Claude Opus 5 正式登場。Anthropic 在 2026 年 7 月 24 日推出 claude-opus-5,API 每百萬 token 的輸入/輸出價格維持 $5/$25,與 Opus 4.8 相同。此前兩週,這個模型曾以代號短暫現身程式碼編輯器,隨即消失,之後又在錯誤對話框中洩露名稱。爆料最終猜對了名稱,卻沒猜中發布日期。
截至 2026 年 7 月 24 日(UTC)的狀態:
是否已發布? 已發布,日期為 2026 年 7 月 24 日。API ID 為
claude-opus-5,固定快照版本不帶日期後綴。價格: 每百萬輸入/輸出 token 為 $5/$25,與 Opus 4.8 相同,僅為 Fable 5 $10/$50 的一半。
規格: 1M-token context,預設值即為上限;最大輸出 128k;effort 級別一路到
max;預設開啟 thinking;知識截止於 2026 年 5 月。可用平台: Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry,以及 claude.ai、Claude Code 與 Cowork。它是 Claude Max 的新預設模型,也是 Claude Pro 可用的最強模型。
切換前要注意兩項破壞性變更: thinking 現在預設開啟;在
xhigh或maxeffort 下使用thinking: {"type": "disabled"},會回傳 400 錯誤。

Claude Opus 5:API 定價與核心規格
Anthropic 將 Opus 級別維持在 $5/$25,卻將這次更新稱為相較 4.8 的「跨越式變化」。在 max effort 下,Opus 5 的 CursorBench 3.2 最高分與 Fable 5 相差不到 0.5%,單一任務成本卻只有一半;因此,Fable 5 $10/$50 的價格理由如今更為有限。
Claude Opus 5 | Claude Opus 4.8 | |
|---|---|---|
API ID |
|
|
價格/MTok | 輸入 $5,輸出 $25 | 輸入 $5,輸出 $25 |
Batch API/MTok | 輸入 $2.50,輸出 $12.50 | 輸入 $2.50,輸出 $12.50 |
快取命中/5 分鐘寫入 | $0.50/$6.25 | $0.50/$6.25 |
Context | 1M(預設值 = 上限) | 1M |
最大輸出 | 128k | 128k |
Effort 級別 | low → medium → high → xhigh → max | 最高至 xhigh |
Thinking | 預設開啟 | 未主動啟用時為關閉 |
可快取 prompt 最低長度 | 512 tokens | 1,024 tokens |
知識截止日期 | 2026 年 5 月 | 2026 年 1 月 |
Fast mode | $10/$50,速度約 2.5×,僅限 Claude API | $10/$50 |
上述費率來自 Anthropic 的價格頁面;規格則依據 What's new in Claude Opus 5。
Anthropic 公開的結果均為與其他模型的相對比較,並非絕對分數,目前也都尚未獲得獨立重現,因此應視為廠商自行報告。包括:在 Frontier-Bench v0.1 上,Opus 5「以更低的單任務成本,效能超過 Opus 4.8 的兩倍」;ARC-AGI 3 成績是第二名模型的三倍;OSWorld 2.0 的結果超越 Fable 5 最佳成績,成本僅略高於三分之一;Zapier AutomationBench 的通過率約是次佳模型的 1.5 倍,而單任務成本相同。在內部生命科學評測中,它在有機化學與光譜項目比 4.8 高出 10.2 分,在蛋白質任務高出 7.7 分;Anthropic 的不一致行為稽核得分為 2.3,也是近期模型中最低。Frontier-Bench 的數字來自 Anthropic 使用 mini-SWE-agent 自行執行的測試,每個任務取五次嘗試的平均值。
官方也明確列出兩項限制。Opus 5 在網路安全與生物學方面落後於 Mythos 5;在 OSS-Fuzz 上,它發現漏洞的能力大致與 Mythos 5 相當,但在 exploit 開發方面則「遠遠落後」。Mythos 5 目前仍只能透過Project Glasswing受邀使用,因此對多數團隊而言,這更像是說明 Opus 5 的定位並非針對這類任務。
公告另引述客戶數據,但未公開方法論:Box 表示 Opus 5 整體比 4.8 高 8%,其中資料分析提升 11%、盡職調查提升 17%;一名未具名的法律合作夥伴則稱,在 max reasoning 下平均少用了 26% token。
我們自己的 smoke test只驗證可用性,不測能力。2026 年 7 月 24 日 19:20 UTC,我們透過 Claude Code 2.1.219 headless(claude -p "<prompt>" --model <id> --output-format json,預設 effort 為 high,各跑一次),詢問兩個模型 1–1000 中數字 7 出現幾次。兩者皆正確回答 300:Opus 5 花 6.76 秒、輸出 261 token;claude-opus-4-8 花 7.37 秒、輸出 239 token。由於兩次執行的快取狀態不同,未列出成本。這只是發布日的一個 prompt,能證明新 ID 可解析並正常回應,不能證明它更快。
傳聞與事實逐一核對
以下是 7 月各項說法的最終結果:
說法 | 狀態 | 依據 |
|---|---|---|
Claude Opus 5 於 2026 年 7 月 24 日以 | 已證實 | |
每 MTok $5/$25,與 Opus 4.8 相同 | 已證實 | |
1M context、effort 最高到 | 已證實 | What's new in Opus 5 |
| 已證實 | What's new in Opus 5——「breaking change from Claude Opus 4.8」 |
可透過 API、Bedrock、Google Cloud、Foundry、claude.ai、Claude Code 使用 | 已證實 | What's new in Opus 5;AWS 公告 |
相較 Opus 4.8 的 benchmark 進步,以及接近 Fable 5 的表現 | 已證實(廠商測試) | Anthropic 公告;目前尚無獨立第三方重現 |
Fable 5 是 Anthropic 已發布模型中能力最強者 | 已證實 | 模型總覽——Opus 5 是建議的預設選項,Fable 5 則是能力上限 |
會在 2026 年 7 月 20–21 日或 7 月 23 日發布 | 未發生 | 實際於 7 月 24 日推出 |
Opus 都在週四發布 | 規律失效 | 4.6、4.7、4.8 都在週四發布;2026 年 7 月 24 日是週五 |
Opus 5 比 Opus 4.8 便宜 | 錯誤 | 兩者費率相同;「半價」說法是與 Fable 5 比較 |
Opus 4.8 即將退役 | 錯誤 | Opus 4.8 仍在所有平台提供,且是預設安全 fallback |
「Honeycomb EAP」曾出現在 Cursor,後來被移除 | 已有報導 | 開發者截圖;The New Stack |
Honeycomb = Claude Opus 5 | 推論 | 規格吻合;Anthropic 從未公開確認該代號 |
現在該選哪個模型?首日如何使用 Opus 5
Opus 5 以與 Opus 4.8 相同的價格推出後,預設選擇也隨之調整:
Opus 5($5/$25):適合複雜 agentic coding、長週期任務與企業工作負載,也是 Anthropic 自己建議的起點。
Fable 5($10/$50):當你需要能力上限,且 CursorBench 的差距值得付出兩倍 token 成本時選它。
Sonnet 5($3/$15,8 月 31 日前優惠價 $2/$10):適合大量、高成本敏感度的工作。
Opus 4.8:僅在必須固定使用它時才保留,例如已有驗證過的 eval suite,或整合流程需要在高 effort 下關閉 thinking。
切換本身只要改 model ID,但還有兩件事必須檢查:
Thinking 現在預設開啟。
max_tokens同時計入 thinking 與回應文字,因此原本在 4.8 不開 thinking 的工作負載,需要重新檢視 token 上限。關閉 thinking 的條件更嚴格。
thinking: {"type": "disabled"}只接受high或以下的 effort;若搭配xhigh或max,請求會回傳 400。
實際上,現在無效與有效的組合如下:
// 400 error on Opus 5: thinking cannot be disabled above effort "high"
{ "model": "claude-opus-5", "max_tokens": 64000,
"output_config": { "effort": "max" },
"thinking": { "type": "disabled" } }
// Valid: keep max effort and drop the thinking field
{ "model": "claude-opus-5", "max_tokens": 64000,
"output_config": { "effort": "max" } }
// Also valid: keep thinking disabled and lower effort to "high" or below
{ "model": "claude-opus-5", "max_tokens": 8000,
"output_config": { "effort": "high" },
"thinking": { "type": "disabled" } }Anthropic 的遷移說明還提到兩項即使不改程式碼也會出現的行為變化:回應與書面交付內容會更長,模型也會主動驗證自己的工作。因此,沿用的「最後請加入驗證步驟」之類指令,現在可能造成過度驗證,建議從 prompt 中移除。
至於可用性,Claude API 採版本定址,新模型會以新的 ID 上線,而非取代既有 ID。Anthropic、雲端平台及相容 Anthropic 的 gateway 各自有不同上架時程,因此同一個新 ID 可能先在某個 endpoint 可用。Gateway 對相同 ID 也會自行訂價:AIReiter列出的 Opus 4.8 價格是每 MTok $1.56/$7.76,官方則為 $5/$25,低約 69%。不過截至 7 月 24 日,其 Claude 清單只到 Fable 5、Sonnet 5、Opus 4.8 與 4.7;如果你在驗證 Opus 5 期間仍固定使用 4.8,這點值得知道,但它目前還不是使用 Opus 5 的途徑。
從發布節奏看 Opus 5 的上線時間

Opus 4.6 在 2026 年 2 月 5 日推出,70 天後是 Opus 4.7,再過 42 天推出 4.8;Opus 5 則在其後 57 天到來,落在先前間隔所勾勒的範圍內。不過,星期幾的推測完全失準:4.6、4.7、4.8 都在週四發布,因此市場猜測集中在 7 月 23 日與 7 月 30 日,結果 Opus 5 在週五上線。換句話說,版本間隔大致能將時間窗縮至約兩週,但連續三次的星期規律仍猜錯了日期。Anthropic 不會預先公布發布資訊,因此最早出現新版本的地方,仍是模型文件與新聞頁面。
真正洩露的是什麼?Cursor 裡的 Honeycomb 線索
回頭看這條早於公告浮現的線索:大約在 7 月 8 日,AI 程式碼編輯器 Cursor 裡短暫出現一個名為 "Honeycomb EAP 1M Extra High" 的項目。開發者 @chetaslua 分享了截圖,The New Stack 也進行報導,該項目隨後便被移除。其中三個細節都與正式版相符:1M-token context window、「extra high effort」設定(Opus 5 更往上增加了 max 級別),以及安全 fallback。後者在發布公告中被描述為:claude.ai、Claude Code 與 Cowork 對標記請求會回退至 Opus 4.8;API 則可自行選擇是否啟用。
這張截圖在兩週內幾乎就是全部證據。7 月 24 日、正式公告前數小時,X 上的截圖顯示 Cursor 的錯誤對話框直接點出模型名稱:「The model 'claude-opus-5-thinking-high' requires Max Mode to be enabled」;這是字串 claude-opus-5 首度出現在已上線產品中。部署追蹤者則早了一天判斷它開始 rollout,@M1Astra 在 7 月 23 日稱模型「正在跨供應商推出」,但 Anthropic 直到 24 日才正式發聲。
Honeycomb 就是「Claude Opus 5」嗎?
從產品層面來說,答案已經確定:正式產品是 Claude Opus 5,API ID 是 claude-opus-5。不過 Anthropic 從未將它與 Honeycomb 這個代號連結起來——所有發布資料都沒有提到 Honeycomb,因此兩者的關係仍屬推論,儘管證據相當充分。先前有人擔心 Anthropic 在 6 月 9 日推出 Fable 與 Mythos 級別後,已放棄 Opus 5 這個名稱;如今看來並非如此。目前產品陣容是 Opus 5 作為 agentic coding 預設選項、Fable 5 提供能力上限、Sonnet 5 主打速度與成本,而 Mythos 5 則是僅限受邀使用的安全級別。
這已是第二次出現類似情況:Sonnet 5 正式發布前,Google Vertex AI 日誌中曾出現 claude-sonnet-5 識別字,代號為 Fennec。這表示第三方工具裡的發布前字串,對判斷「會推出什麼」是可靠訊號,對判斷「何時推出」卻不可靠。
FAQ
Claude Opus 5 已經推出了嗎?
是。Anthropic 已於 2026 年 7 月 24 日發布 Claude Opus 5,並立即以 claude-opus-5 的名稱在 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry、claude.ai、Claude Code 和 Cowork 提供服務。
Claude Opus 5 的價格是多少?
每百萬輸入 token 為 $5,每百萬輸出 token 為 $25,與 Opus 4.8 相同。Batch API 價格減半至 $2.50/$12.50;快取命中讀取每 MTok 為 $0.50;fast mode 是僅限 Claude API 的研究預覽,以約 2.5× 預設速度提供服務,價格為 $10/$50。
Claude Opus 5 比 Opus 4.8 便宜嗎?
不便宜,兩者的每 token 費率完全相同。發布時流傳的「半價」說法,是將 Opus 5 與每 MTok $10/$50 的Fable 5比較。Anthropic 所說的單任務成本差異,來自 benchmark 執行中 Opus 5 完成相同工作所需 token 或輪次較少;若單純以相同 token 數量比較,Opus 5 與 Opus 4.8 的計費一致。
Claude Opus 5 比 Fable 5 好嗎?
要看評估面向。Fable 5 仍是 Anthropic 已發布模型中能力最強的一款,但 Opus 5 在 max effort 下,以一半單任務成本達到距 Fable 5 最高 CursorBench 3.2 分數不到 0.5% 的表現,也以約三分之一成本擊敗 Fable 5 在 OSWorld 2.0 的最佳結果。Fable 5 的費率是 $10/$50,Opus 5 則為 $5/$25。
Honeycomb 和 Claude Opus 5 是同一個模型嗎?
幾乎可以確定是,但 Anthropic 從未明說。7 月初出現在 Cursor 的 Honeycomb 項目,與 Opus 5 的 1M context window、xhigh effort 設定及 Opus 4.8 安全 fallback 都相符,但所有發布資料均未提及這個代號。
Claude Opus 5 會免費提供嗎?
API 不會免費。在 claude.ai 上,它是 Claude Max 訂閱者的預設模型,也是 Claude Pro 可使用的最強模型;免費方案對 Opus 級模型的存取一向設有上限。
我應該從 Opus 4.8 升級到 Opus 5 嗎?
若用於 agentic 或程式開發工作,答案大概是肯定的:價格相同,且廠商公開的結果更好,遷移也只需要更換 model ID。不過這些結果尚未有獨立重現,因此在將正式流量切過去前,仍應先用既有 eval suite 測試 Opus 5,並確認兩件事:thinking 預設開啟且會計入 max_tokens;在 xhigh 或 max effort 下關閉 thinking 會失敗。