Anthropic 在 2026 年 8 月 10 日取消了 Claude Sonnet 5 原定於 9 月 1 日生效的價格調漲。每 100 萬個輸入 token $2、每 100 萬個輸出 token $10,現在不再是上市優惠,而是永久標準價格。如果你的第四季 API 預算,是按照 6 月上市報導中的 $3/$15 編列,現在只需要改動一行;至於那些先留在 Sonnet 4.6、等待「真正價格」揭曉的人,答案也已經不同了。
Claude Sonnet 5 目前怎麼收費?完整價格表一次看
在 Anthropic 第一方 API 上,Claude Sonnet 5 的價格是每 100 萬個輸入 token $2、每 100 萬個輸出 token $10,所有優惠方案都以這組價格為基準。Claude Platform 定價文件截至 2026 年 8 月 16 日的內容寫得很明白:「原先排定的調漲……不會發生。」
| 項目 | 每 100 萬 token 價格 | 相對基本輸入價格 |
|---|---|---|
| 基本輸入 | $2.00 | 1.0 倍 |
| 基本輸出 | $10.00 | 輸入的 5 倍 |
| 5 分鐘快取寫入 | $2.50 | 1.25 倍 |
| 1 小時快取寫入 | $4.00 | 2 倍 |
| 快取讀取(命中) | $0.20 | 0.1 倍 |
| 批次輸入 | $1.00 | 折扣 50% |
| 批次輸出 | $5.00 | 折扣 50% |
同一份文件裡,還有三個不太可能出現在標題上的細節。完整的 1M token context window,仍按照相同的每 token 價格計費;900k token 的請求和 9k token 的請求,每個 token 的單價相同,沒有長上下文附加費。若使用 inference_geo: "us" 將推理鎖定在美國,輸入、輸出與快取價格都會乘上 1.1 倍。另外,伺服器端網頁搜尋會在一般 token 費用之外,按每 1,000 次搜尋 $10 計費。
原定 9 月 1 日調漲,最後並沒有發生
Claude Sonnet 5 於 2026 年 6 月 30 日推出時,$2/$10 明確標示為上市優惠價格,原本預計在 2026 年 9 月 1 日恢復至 $3/$15,也就是 Sonnet 4.6 的價格。這正是許多 7 月初發布的價格表仍在沿用的數字。2026 年 8 月 10 日,上市公告的更新紀錄補上一行說明:上市優惠價格改為永久價格;TechCrunch 的上市報導也已加入反映現行價格的更新註記。
因此,凡是仍把 $3/$15 說成即將生效,或寫成「8 月 31 日之後」價格的表格,都代表它是在 8 月 10 日之前整理的資料;這類說法會讓兩項標準價格都高估 50%。除了這個時間點之外,價格架構沒有其他變化:Sonnet 5 以 $2/$10 位於 Sonnet 4.6 的 $3/$15 之下,輸入價格低了 33%。
Sonnet 5 對比 Sonnet 4.6:遷移計算結果反轉了
過去之所以建議先觀望,關鍵在 tokenizer。Sonnet 5 採用與 Opus 4.7 同時推出的新 tokenizer 家族。Anthropic 的上市公告指出,相同文字在不同內容類型下,token 數倍率介於 1.0 倍到 1.35 倍;平台文件則表示,典型增幅接近 30%。按照原本的計畫,若標準價格升至 $3/$15,相同提示詞相較於 Sonnet 4.6 的 $3/$15,輸入成本最高會變成每 100 萬 token $4.05,輸出則是 $20.25。
但在永久 $2/$10 的價格下,最壞情況反而顛倒過來。即使 token 數增加到最高 1.35 倍,相同文字的成本也只是每 100 萬個輸入 token $2.70、輸出 token $13.50,兩者都低於 Sonnet 4.6;而且這還沒算進 Sonnet 5 在上市比較表上的優勢:SWE-bench Pro 為 63.2% 對 58.1%、Terminal-Bench 2.1 為 80.4% 對 67.0%,OSWorld-Verified 則是 81.2% 對 78.5%。
但有一個反方觀點仍值得留意:真正該看的不只是每個 token 的價格,還包括解決一個問題的成本。由 eesel AI 引述的 Artificial Analysis 測試,Sonnet 5 在 Intelligence Index 上每項任務約 $2.29;測試也發現,如果沒有促銷價格,Sonnet 5 每項任務的成本可能高於 Opus 4.8,原因是高 effort 執行會消耗大量 thinking token,而這些 token 按輸出價格計費。社群的結論相當直接:
「簡單說:Sonnet 5 每個 token 比較便宜,但每個完成的問題反而更貴,而且整體智慧仍落後 Opus 4.8。」——u/Chubby,r/accelerate
固定價格改變的是這道算式的輸入值,而不是它要提醒你的重點:effort 設定與每項任務消耗的 token 數,依然決定最後帳單。至於能力面是否值得遷移,我們的 Sonnet 5 與 Sonnet 4.6 比較有完整整理。
標價相同,帳單可能不同:effort 與快取才是關鍵
有兩個因素,對 Sonnet 5 帳單的影響往往比任何一次價格公告都大。第一是 effort 設定。Sonnet 5 提供 low、medium、high、xhigh 與 max 五個等級;上市公告宣稱 medium effort 的成本效率大幅提升,而上市報導將其解讀為:Sonnet 5 使用 medium 時,大致等同 Sonnet 4.6 使用 high。對你的工作負載來說,值得實測低一級的 effort 是否仍能維持必要品質。第二是 prompt caching。5 分鐘快取寫入價格為 $2.50,只要之後成功讀取一次就能回本;1 小時寫入價格 $4.00,讀取兩次後回本。之後每次快取讀取只要 $0.20,輸入價格直接省下 90%。依照平台文件,快取與批次的倍率可以疊加。
在基本價格永久固定後,批次價格更值得單獨看。每 100 萬 token $1/$5 的非同步 Sonnet 5 處理,結果會在 24 小時內提供,價格正好等同 Haiku 4.5 的標準隨選價格,但模型在 SWE-bench Pro 的成績是 63.2%。對於不要求低延遲的獨立評測、資料回填與文件處理,批次通常是最便宜的選擇。
同一個模型,不同平台可能收到不同帳單
Sonnet 5 的價格表,在提供該模型的七家服務商之間並不完全一致。CloudPrice 的供應商價格表顯示,Anthropic 直連、Amazon Bedrock、Azure AI Foundry、Google Vertex AI、OpenRouter 與 Vercel AI Gateway 都是 $2.00/$10.00;Snowflake 則收取 $2.40/$12.00,比標準價格高 20%。另外,根據平台文件,有兩項加價不論選哪家供應商都要注意:Bedrock 與 Vertex 的區域或多區域端點,比全球端點約貴 10%;僅限美國的推理則會套用 1.1 倍倍率。
| 供應商 | 輸入/每 100 萬 | 輸出/每 100 萬 | 備註 |
|---|---|---|---|
| Anthropic API | $2.00 | $10.00 | 批次 $1/$5,完整快取價格 |
| Amazon Bedrock | $2.00 | $10.00 | 區域端點加價 10% |
| Google Vertex AI | $2.00 | $10.00 | 區域端點加價 10% |
| Azure AI Foundry | $2.00 | $10.00 | 提供 US Data Zone 部署 |
| OpenRouter | $2.00 | $10.00 | 批次版本 $1/$5 |
| Vercel AI Gateway | $2.00 | $10.00 | - |
| Snowflake | $2.40 | $12.00 | 比標準價格高 20% |
跨目錄比價時,還有一個容易踩到的陷阱:有些列表把 Sonnet 5 寫成「$1.00/$5.00 起」,那是批次方案,不是隨選價格。同一個目錄將 Sonnet 4.6 列為 $1.50/$7.50,這其實是 Sonnet 4.6 的批次價格,不是它的標準 $3/$15。
$2/$10 成為永久價格後,API 預算該怎麼安排?
現在需要做的決定,已經回到模型選擇本身,而不是趕在某個日期前調整。根據上市公告,Sonnet 5 是 Claude Free 與 Pro 方案的預設模型,也包含在 Max、Team 與 Enterprise 方案中;訂閱用戶不會碰到這些 API 價格,而Claude API 定價指南則整理了訂閱方案與 API 之間的損益交界。至於 API 使用者,可以先這樣判斷:
| 使用情境 | 建議 |
|---|---|
| 正式環境 agent、重視延遲 | Sonnet 5 $2/$10,系統提示詞使用 5 分鐘快取 |
| 夜間資料回填、評測、批次處理 | Sonnet 5 Batch $1/$5 |
| 最困難的程式設計任務(根據 Anthropic 上市比較表,Opus 4.8 在 SWE-bench Pro 為 69.2%,Sonnet 5 為 63.2%) | Opus 4.8 $5/$25 |
| 分類、路由、摘要 | Haiku 4.5 $1/$5 |
| 正式環境仍在使用 Sonnet 4.6 | 先進行遷移試點——Anthropic 文件所述 1.0 至 1.35 倍 tokenizer 範圍,換算後每個等價 token 仍低於 4.6;但應先用真實流量驗證品質與每項任務的 token 用量 |
在 xhigh 與 max 設定下,按每 100 萬 token $10 計費的 thinking token,仍會讓帳單隨問題難度上升。Artificial Analysis 發現,高 effort 的 Sonnet 5 執行,每項任務的成本可能高於採用舊 $3/$15 價格的 Opus 4.8;永久降價讓這個底線降低三分之一,卻沒有讓問題消失。編列季度預算前,先量測每項任務消耗多少 token。建議讓正式環境的真實流量,以實際 effort 設定跑過Claude API endpoint一週,評估整體工作負載的價格,而不是只看每 100 萬 token 要花多少錢。
延伸閱讀:Claude Sonnet 5 與 Sonnet 4.6 - Claude API Pricing Guide 2026 - Claude Sonnet 5 Guide