AIREITER

DeepSeek API 漲價:舊費率與新費率完整比較(2026 年 8 月)

最近更新: 2026-08-16 19:04:46

對 DeepSeek API 使用者來說,這次帳單會漲多少,關鍵不只是你用 Flash 還是 Pro,而是 prompt cache 的命中率。DeepSeek 已在 2026 年 8 月 16 日調漲 API 價格,deepseek-v4-flash 與 deepseek-v4-pro 都從原本固定的 per-token 費率,改為尖峰/離峰分時收費。離峰時段的未命中輸入與輸出價格,已是舊價的 1.5× 至 2.4×;尖峰更再翻倍。快取命中輸入的漲幅尤其明顯,離峰為 2.5× 至 6.1×,尖峰最高達 12.1×。

2026 年 8 月 16 日:DeepSeek 計價制度改了什麼?

根據 r/DeepSeek 的公告討論串與650 次呼叫稽核,新制在 8 月 16 日星期日 16:00 UTC 上線,也就是北京時間 8 月 17 日午夜。官方的 Models & Pricing 頁面目前也已列出新價目表,這不是單純預告,而是已經生效的計費調整。

DeepSeek 現在將 API 計費拆成尖峰與離峰;尖峰價格固定為離峰的 2×。每日尖峰時段為 01:00–04:00 UTC 與 06:00–10:00 UTC,合計 7 小時尖峰、17 小時離峰。至於模型版本(DeepSeek-V4-Flash-0731、DeepSeek-V4-Pro-0813)、API 相容性與公開規格,在同一官方頁面上均未變動;這次改的是帳務,不是模型。

DeepSeek API 最新價格一覽

以下皆為每 1M tokens 的美元價格,資料來自 2026 年 8 月 16 日的官方定價頁面。

V4 Flash離峰尖峰
輸入,快取命中$0.007$0.014
輸入,快取未命中$0.22$0.44
輸出$0.66$1.32
V4 Pro離峰尖峰
輸入,快取命中$0.022$0.044
輸入,快取未命中$0.66$1.32
輸出$1.98$3.96
DeepSeek 官方 API 定價頁面,顯示 2026 年 8 月 16 日起新的尖峰與離峰費率

除了價格外,計費機制其餘部分維持不變:請求會依實際執行當下的有效費率計價;DeepSeek 也明確保留日後再次調價的權利。

這次實際漲了多少?新舊 DeepSeek API 費率對照

第三方追蹤網站確認,截至 2026 年 7 月 31 日,舊制為固定費率:Flash 的未命中輸入、快取命中與輸出分別為 $0.14、$0.0028、$0.28;Pro 則為 $0.435 / $0.003625 / $0.87(TLDL、BenchLM)。將新舊價格並列後如下:

每 1M tokens舊固定費率新離峰費率新尖峰費率離峰相較舊價尖峰相較舊價
Flash 輸入,快取命中$0.0028$0.007$0.0142.5×5.0×
Flash 輸入,快取未命中$0.14$0.22$0.441.57×3.14×
Flash 輸出$0.28$0.66$1.322.36×4.71×
Pro 輸入,快取命中$0.003625$0.022$0.0446.07×12.14×
Pro 輸入,快取未命中$0.435$0.66$1.321.52×3.03×
Pro 輸出$0.87$1.98$3.962.28×4.55×
DeepSeek V4 API 價格比較:舊固定費率、新離峰與新尖峰費率,每百萬 tokens 美元計價

Reddit 上流傳的「漲價 1,114%」並非錯誤,但只適用於很特定的情境:V4 Pro 的快取命中輸入在尖峰時段,從 $0.003625 漲到 $0.044。若工作負載完全沒有快取命中,離峰實際漲幅更接近 1.5–2.3×。你的用量落在哪個區間,幾乎完全取決於快取命中比例。

快取命中率越高,漲幅為何反而越痛?

快取命中價格上漲 2.5× 至 12×,未命中輸入與輸出則上漲 1.5× 至 4.7×。因此,過去越依賴超低價快取命中通道的工作負載,百分比漲幅就越大。一名 r/DeepSeek 使用者以新舊價目表重算 650 次真實 API 呼叫,涵蓋 16 個 session、155.9M prompt tokens、98.09% 快取命中率,並將結果與 DeepSeek console 帳單核對,差距在 2% 以內:

「今天快取效果越好,你的漲幅就越大」——u/Swimming-Soup-1173,r/DeepSeek 650 次 API 呼叫稽核

該使用者的 agent 工作負載,在離峰重估後變成原本的 2.7×;同一工作負載若完全沒有快取命中,則是 1.5×。另有使用者模擬長上下文工作負載,離峰從 $33 增至 $100,尖峰則達 $200,相當於 3× 至 6×。批次作業、RAG pipeline,以及使用靜態 system prompt 的 agent 都是這波受影響最明顯的類型;相較之下,一次性的摘要流量更接近離峰 1.5–2.3× 的最低漲幅。

換算成你的時區:哪些時間算尖峰?

官方頁面只標示 UTC 時段。換算為 8 月、日光節約時間生效期間的當地時間如下:

時區尖峰時段(當地時間)你的朝九晚五
北京(UTC+8)09:00–12:00、14:00–18:00午休 12:00–14:00 外皆為尖峰
中歐(UTC+2)03:00–06:00、08:00–12:00上午為尖峰
倫敦(UTC+1)02:00–05:00、07:00–11:00上午為尖峰
美國東部(UTC-4)21:00–00:00、02:00–06:00完整工作日皆為離峰
美國西部(UTC-7)18:00–21:00、23:00–03:00完整工作日皆為離峰

尖峰時段幾乎覆蓋中國工作日,只扣除午休時間;北京時間 12:00–14:00 是離峰。美國團隊則可在整個工作日享有離峰價格。歐洲團隊若在上午跑批次工作,會遇上雙倍費率,尤其 08:00–12:00 CEST 屬於尖峰,較適合改到下午或夜間執行。

Prompt caching 還值得繼續用嗎?

答案明確是值得。折扣縮水了,但沒有消失。過去 Flash 的快取命中輸入約比未命中便宜 50×,Pro 約便宜 120×;現在兩個模型都約為 30×,離峰 Flash 為 31×、Pro 為 30×,也就是 $0.007 對 $0.22、$0.022 對 $0.66。即使是測得成本增加 2.7× 的稽核作者,結論仍是:

「快取仍然絕對值得使用」——同一份 r/DeepSeek 稽核

在其工作負載中,快取相較於每次都不快取地傳送相同上下文,成本仍可降低約 15×。快取命中採 best-effort,沒有保證命中率;未使用的項目通常會在數小時到數天後清除(BenchLM)。因此,編預算前最好先量測,依照 BenchLM 的建議記錄 usage object 中的 prompt_cache_hit_tokens 與 prompt_cache_miss_tokens 欄位,算出自己的實際命中占比。

漲價後,DeepSeek 還是低價選項嗎?

離峰時段是;但到了尖峰,Flash 等級相對 GPT-5.6 的價格優勢幾乎消失。以下是標準費率下、每 1M tokens 的輸出價格比較:

模型輸入輸出備註
DeepSeek V4 Flash(離峰)$0.22$0.661M context
DeepSeek V4 Flash(尖峰)$0.44$1.32輸出價格高於 Luna
GPT-5.6 Luna$0.20$1.207 月 30 日降價 80%
DeepSeek V4 Pro(離峰)$0.66$1.98仍比 Terra 低約 6×
DeepSeek V4 Pro(尖峰)$1.32$3.96比 Terra 低約 3×
GPT-5.6 Terra$2$12
Claude Sonnet 5$2$10優惠價至 8 月 31 日,之後為 $3/$15

離峰時,V4 Flash 的 $0.66 輸出價格比 GPT-5.6 Luna 低 45%,更比 Terra 低 18×;對高輸出量工作而言,DeepSeek 仍是最便宜的選項。尖峰時則不同,Luna 的輸出 $1.20、輸入 $0.20,都低於 Flash 的標準費率。當然,根據 AI Price Index changelog,Luna 的 cache-read 價格為 $0.02/M,任何時段都比 Flash 的快取命中通道更貴;而 Flash 在官方規格表上仍提供 1M-token context 與 2,500 concurrency。正如公告串中一位留言者所說:「DS4 很好,但前提是便宜。」

這週可以採取的 5 個做法

  1. 先重算自家帳單,不要急著恐慌。 拉出上個月的用量紀錄,按以下方式計算:快取命中輸入 × 命中率 × 命中價格 + 快取未命中輸入 × 未命中率 × 未命中價格 + 輸出 × 輸出價格;每筆請求還要套用其執行時間所在的尖峰或離峰費率。稽核結果可作為範圍參考:零快取命中重估為 1.5×,98% 命中率則為 2.7×。
  2. 可排程的工作一律避開尖峰。Cron job、評測、文件處理,只要不是使用者正在等待的任務,都可放到 17 小時的離峰時段。美國團隊幾乎不用特別調整,因為工作日原本就是離峰;歐洲團隊則可將上午批次作業移至下午。
  3. 持續維持快取命中。只要既有 prompt 結構能產生快取命中,就應繼續沿用;快取命中通道目前仍比未命中輸入低約 30×。
  4. 例行呼叫可測試降級至 Flash。Pro 全面約為 Flash 的 3×,快取命中則為 3.1×。若你自 0731 post-training 更新後還沒有重新測試 Flash,可先將部分日常流量導向它;模型選擇的取捨可參考我們的 V4 Flash vs V4 Pro 比較。
  5. 若要遷移,實際改動可能很小。對採用 OpenAI-compatible client 的使用者,可能只需更換 base URL 與 model ID。第三方託管商與中繼平台依各自價目表計費;DataLLM Lab曾記錄某些託管商在本次漲價前,V4 Pro 報價已約為每 1M $1.74/$3.48。因此應比較實際有效費率,而非只看表面標價。

一張表快速判斷:

你的使用情境建議
美國時區、快取密集的 agent 流量繼續使用——離峰費率加上約 30× 的快取通道,仍能讓快取密集流量的輸入成本維持最低
歐洲時區、上午跑批次作業繼續使用,但調整排程——尖峰曝險是可避免的
只在尖峰使用、重視品質的 Pro 程式開發工作重新評估——Pro 尖峰輸出 $3.96 仍低於 Terra 的 $12,但價差已變成 3×,不再是 8 月 16 日前的 14×
零快取、一次性工作負載繼續使用——離峰 1.5–2.3× 是表中最小的漲幅

常見問題

DeepSeek 新價格究竟何時生效?

依據 r/DeepSeek 的公告討論串與650 次呼叫稽核,新價格於 2026 年 8 月 16 日 16:00 UTC 生效,即北京時間 8 月 17 日午夜。官方定價頁面也在同一天更新為新價目表。

我的 DeepSeek 帳單會增加多少?

零快取工作負載在離峰重估約為 1.5×;一個實測快取命中率 98% 的工作負載則為 2.7×。尖峰時段會將這些數字再翻倍,Pro 的快取命中輸入最高可達 12×。上方倍率表列出了所有價格組合。

美國時區的尖峰時段是哪些?

美國東部時間為 21:00–00:00 與 02:00–06:00;美國太平洋時間為 18:00–21:00 與 23:00–03:00。一般美國工作時間完全落在離峰時段。

deepseek-chat 和 deepseek-reasoner 還能使用嗎?

不能。根據 BenchLM 的 model-ID 歷史紀錄,這兩個舊 alias 已在 2026 年 7 月 24 日達到退役期限;新的整合應改用 deepseek-v4-flash 或 deepseek-v4-pro。

DeepSeek 現在還是比 GPT-5.6 和 Claude 便宜嗎?

離峰時是。Flash 輸出比 GPT-5.6 Luna 低 45%,更比 Terra 低 18×。但尖峰時 Luna 的 $1.20/M 輸出低於 Flash 的 $1.32/M,因此最終答案取決於你的流量運行時間。