截至 2026 年 7 月,Claude API 的價格從 每百萬 tokens 1 美元(Haiku 4.5 輸入)到 每百萬 50 美元(Fable 5 輸出)不等,而在所有現行模型中都有一個規則:輸出 tokens 的成本是輸入 tokens 的 5 倍。但標示價格只是最簡單的部分。新的 tokenizer、僅限美國的路由、快速模式,以及多數人從未注意到的計費陷阱,都夾在價目表和你實際收到的帳單之間——而且還有一種方法,可以用遠低於標價的價格買到相同的模型。
以下每個數字都來自 Anthropic 的 官方定價頁面;在您確定預算之前,請先查閱,因為模型費率會變動。
2026 年 Claude API 定價:所有模型
以下為目前每百萬 token 費率,已依據 Anthropic 2026 年 7 月的定價進行核實(官方來源)。Opus 4.8 於 2026 年 5 月 28 日推出,費率與 4.7 相同。
模型 | 輸入 / 1M | 輸出 / 1M | 上下文 |
|---|---|---|---|
Claude Fable 5 | $10.00 | $50.00 | 1M |
Claude Opus 4.8 | $5.00 | $25.00 | 1M |
Claude Opus 4.7 | $5.00 | $25.00 | 1M |
Claude Opus 4.6 | $5.00 | $25.00 | 1M |
Claude Sonnet 4.6 | $3.00 | $15.00 | 1M |
Claude Haiku 4.5 | $1.00 | $5.00 | 200K |
很多舊指南常搞錯的兩件事。Fable 5——Anthropic 最強大的模型——位於 Opus 等級之上,定價為 $10/$50,而整個 Opus 4.x 系列(4.6、4.7、4.8)維持在 $5/$25。這個 $5 本身就是一段故事:Opus 4.1 的價格是 $15/$75,而在 4.6 發布時降到 $5/$25,這對這款旗艦模型來說是67% 的削減,而且此後經歷三個版本仍一直維持如此。
舊版與預算選項
如果您不需要最新的模型,較舊的模型仍然可用:Sonnet 4.5($3/$15)、Opus 4.5($5/$25,200K context)、Haiku 3.5($0.80/$4)、以及 Haiku 3($0.25/$1.25),適合最重視成本、且高用量的工作。
一個被低估的細節:Opus 4.6/4.7/4.8、Sonnet 4.6 和 Fable 5 都包含完整的 1M-token 上下文視窗,且採用標準定價——沒有長上下文加價。900K-token 的請求與 9K 的請求按相同的每 token 費率計費,而多家競爭對手會在超過某個長度門檻後收取溢價。
價格卡上沒有列出的成本
費率表是大多數定價文章停留的地方,也是驚喜開始的地方——因為有幾件事會在不改變每 token 單價的情況下,影響你的實際帳單。
悄悄新增 token 的 tokenizer
Opus 4.7(以及共享其 tokenizer 的 Opus 4.8)改變了文字如何被拆分為 token。同樣的輸入,在 Opus 4.6 上相比,可能會產生最多約 35% 更多的 token——而每個 token 的費率完全相同。程式碼、結構化資料(JSON/XML)以及非英文文字受影響最大,因為費率沒有變,但 token 數量變了。不要盲信 35% 這個數字:在你信任舊預算之前,請先將你實際的 prompts 重新透過新模型的 token-counting endpoint 跑一次,並加以比較。
思考、快速模式與僅限美國路由
根據 Anthropic 的 定價文件:
延伸思考 tokens 會以輸出計費,即使你從未顯示它們也是如此。高推理需求的請求會悄悄增加帳單中的輸出費用。
快速模式(僅限 Opus 4.8/4.7)可讓同一模型的執行速度最高快 2.5 倍,但價格為標準定價的 2 倍。
僅限美國的推理(資料駐留)會對輸入和輸出加收1.1 倍係數;AWS Bedrock 或 Vertex 區域端點則會在此基礎上再增加約 10%。
伺服器端工具
在 Anthropic 端執行的工具會依據相同的定價文件另行計費:網頁搜尋每 1,000 次搜尋為 $10,外加處理結果所需的 token,而程式碼執行在每月額度內免費,之後每個容器約為 $0.05/小時。(請在定價頁面確認目前數字——伺服器工具費率會變動。)
讓 Claude Code 使用者中招的計費陷阱
這個不在任何價格方案內。如果你在 shell 中設定了 ANTHROPIC_API_KEY,Claude Code 會透過 按 token 計費的 API 來收費,而不是透過你的訂閱方案。原本預期每月固定 $20–$200 的人,正因為這個原因而被計量費用打了個措手不及。在進行長時間使用前,請先檢查你的環境設定。
Claude 實際上會花你多少錢?
費率在映射到工作負載之前幾乎沒有意義。以下是以目前價格計算的三個範例,皆為每天 10,000 次請求(每次 2,000 個輸入 + 500 個輸出 token——每天 2,000 萬個輸入 + 500 萬個輸出 token):
Haiku 4.5 上的支援聊天機器人($1/$5):20M × $1 + 5M × $5 = $45/天,約 $1,350/月。
Sonnet 4.6 上的編碼代理($3/$15):$60 + $75 = $135/天,最佳化前約 $4,050/月。
Opus 4.8 上的高上下文 RAG 應用程式($5/$25),其中檢索到的文件會大幅推高輸入量,因為輸入量占主導,月費會攀升到 數千到數萬美元的高位。
相同的用量,三種模型——僅模型選擇就會讓 Haiku 和 Sonnet 之間的費用相差約 3 倍。
這些不是假設性的上限。r/ClaudeAI 的一則討論串追蹤了 31 位 Claude Code 使用者,若依 API 費率計算,他們的使用量每月大約會花費80,000 美元/月,其中最高的單一使用者接近 18,000 美元——這是對他們訂閱用量若按計量式 API 收費時的估算,並不是實際帳單。高強度的自主工作負載才是帳單真正變得驚人的地方,而這正是下面這些最佳化能發揮作用之處。
速率限制與使用層級
價格並不是唯一的限制——你能以多快的速度花完它,也是分級的。新的 API 帳戶一開始會有較保守的每分鐘請求數(RPM)和每分鐘 tokens 數(TPM)限制,這些限制會隨著帳戶使用時間增加以及累計支出成長而自動提高(Tier 1 → 4)。新帳戶還可獲得5 美元的免費額度用於測試,無需信用卡。除了吞吐量之外,Anthropic 還提供在可用性與價格之間取捨的服務等級:標準等級(預設)、保證可用性的優先等級,以及下方享有 50% 非同步折扣的批次等級。在為大規模架構設計之前,請先查看你的等級在 rate-limits 文件中的確切數值——足以支援試點流量的配額,在正式上線時可能需要提升等級。
Claude 訂閱 vs API:哪個更便宜?
最常見的現實世界問題,而答案是一個門檻,而不是一個裁決。
Claude Pro 為每月 $20;Max 為每月 $100 或 $200。這些方案涵蓋 Claude apps 和 Claude Code,並包含使用額度——沒有按 token 計費。
The API 採純按用量付費,沒有每月最低消費,也沒有使用上限。
交叉點落在每月低數百萬 tokens 的範圍內——以中階模型(Sonnet)計算,大約是 3–4M,前提是輸入/輸出比例平衡,而且你原本會維持在 Pro 的使用額度內。到了 Haiku 會往上移,在 Opus 則會往下移,所以應把它視為一個範圍,而不是固定值。低於這個用量時,訂閱通常更便宜也更簡單。高於這個用量時——尤其是 production traffic 或大量 agentic coding——API 的按 token 計價更划算,而且你還能獲得方案沒有提供的控制能力(rate limits、monitoring、multi-key billing)。就全天候 coding 而言,開發者估計 Max 方案可能會比在 Opus 上按 token 計費的同樣工作便宜得多。
實際規則:原型與個人使用 → 訂閱;規模化產品流量 → API。而且要注意上面的 ANTHROPIC_API_KEY 陷阱,否則你會兩邊都付費。
如何降低 Claude API 的費用
有三個槓桿可以在不更換模型的情況下降低標準費用。
1. 提示快取(重複上下文最高可享 90% 折扣)
快取一個穩定的前綴——長篇系統提示詞、擷取的文件、few-shot 範例——而且快取讀取的成本僅為輸入費率的 0.1×,相當於 90% 的折扣。關鍵在於寫入:5 分鐘的快取寫入成本為 1.25×,一次讀取後就能回本;1 小時的寫入成本為 2×,兩次後就能回本。對於任何帶有大量固定前言、且會反覆命中的內容,這是單一最大的槓桿。(快取文件。)
2. 批次 API(五折,雙向)
對於任何不需要即時回覆的情況,Batch API 會將輸入與輸出費用各降 50%,並在 24 小時內返回。Sonnet 4.6 降至 $1.50/$7.50;Haiku 4.5 降至 $0.50/$2.50。快取與批次處理可疊加,將實際成本大幅壓低至遠低於標示費率的一半。
3. 模型路由與輸出上限
不要讓每個請求都跑在 Opus 上。將分類、摘要和路由邏輯交給 Haiku,把 Sonnet 保留給中間層,只有在任務真正需要時才呼叫 Opus —— 單靠這一點通常就能減少 40–60% 的成本。而且由於輸出的價格是輸入的 5 倍,限制 max_tokens 是你最具槓桿效益的調整之一:把一百萬次呼叫中的平均輸出從 800 個 token 降到 500 個 token,每個月都能省下實際可觀的金額。
官方 API 與中繼平台:能付得更少嗎?
還有第四種方式,官方文件不會提到:透過轉接服務購買相同的 Claude 模型。API 轉接器(或聚合器)位於你和 Anthropic 之間,提供與 Anthropic 相容的端點,並收取自己的費率。
為什麼 relay 會更便宜? 主要有三個原因:relay 會以承諾使用量採購,因而享有個人帳戶無法達到的折扣;它們會在不同區域與供應商之間進行高效率路由;而且許多 relay 以很薄的利潤率(甚至虧本促銷)來吸引開發者。但這麼深的折扣總得來自某個地方——在依賴一個平台之前,先了解它的商業模式。
折扣差異很大。以下是三種方案在相同 Claude 模型上的比較:
平台 | 相較 Anthropic 官方價目表的折扣 | 模型覆蓋範圍 | 備註 |
|---|---|---|---|
官方 Anthropic API | —(基準) | 全部,包括 Fable 5 / Opus 4.8 | 快取、批次處理、所有功能 |
約等於價目表(按供應商價格轉嫁) | 多種模型,多供應商 | 彙總平台;重便利而非節省 | |
EvoLink | 約 10% 折扣 | 最高至 Opus 4.7 | 相容 OpenAI 的端點 |
約 80% 折扣 | 最高至 Opus 4.6 | 相容 Anthropic;快取可透傳 |
AIReiter 位於較激進的一端。以下是標題所述約 80% 對應到每個模型的結果:
模型 | 官方(輸入 / 輸出) | AIReiter(輸入 / 輸出) | 您節省 |
|---|---|---|---|
Claude Haiku 4.5 | $1 / $5 | $0.20 / $1.00 | 80% |
Claude Sonnet 4.6 | $3 / $15 | $0.60 / $3.00 | 80% |
Claude Opus 4.6 | $5 / $25 | $1.00 / $5.00 | 80% |
整合可即插即用:AIReiter 的端點與 Anthropic Messages API 相容,因此官方 anthropic SDK 只需修改兩行即可運作——將 base_url 指向 https://aireiter.com/api,並更換金鑰:
client = anthropic.Anthropic(
api_key="YOUR_AIREITER_KEY",
base_url="https://aireiter.com/api",
)
串流、多輪、視覺,以及 cache_control 都會被傳遞,因此上方 90% 的快取折扣會疊加在較低的基礎費率之上。
常見問題
為什麼 Claude API 這麼昂貴?
通常問題不在於每個 token 的費率,而是在於工作流程設計。最大的成本驅動因素包括:在 Haiku 或 Sonnet 就足夠時卻把所有東西都跑在 Opus 上、未快取的重複上下文、無上限的輸出,以及你被收費但從未看見的推理 tokens。修正這些通常比標價更重要。
是否有免費的 Claude API 層級?
沒有永久免費的正式版方案,但新帳戶可獲得 5 美元免費額度(無需信用卡)用於測試。之後則採按量計費。
Claude API 與 ChatGPT 定價 — 哪個更便宜?
這取決於您比較的方案等級。大致上,每百萬 token(輸入 / 輸出):
Claude | 相當的 OpenAI |
|---|---|
Haiku 4.5 — $1 / $5 | GPT mini 層級 — 低個位數 |
Sonnet 4.6 — $3 / $15 | 中階層級 — 相當 |
Opus 4.8 — $5 / $25 | GPT-5.5 — 約 $5 / $30 |
我如何計算我的每月 Claude API 帳單?
可估算為:(requests × avg input tokens ÷ 1,000,000 × input rate) + (requests × avg output tokens ÷ 1,000,000 × output rate)。請使用token-counting endpoint來針對您的實際提示詞取得準確的計數——通用的 tokenizer 在 Claude 上可能會有 15–35% 的誤差。
結論
對大多數團隊來說,這是三分法:原型開發或個人使用 → Pro 或 Max 訂閱(在每月約 3–4M tokens 以下更簡單、更便宜);使用最新旗艦模型進行生產環境(Opus 4.8、Fable 5)→ 使用啟用 caching、batching 和 routing 的官方 API;當 Sonnet 4.6 或 Opus 4.6 已足夠應付生產環境 → 像 AIReiter 這樣信譽良好的 relay 可透過直接替換 SDK,將同一筆帳單最多降低 80%。
無論你選哪一個,大多數團隊的超支都不是因為選錯方案,而是因為跳過了最佳化;所以在你開始擔心費率表之前,先把這些調整選項開啟。