接下來值得關注的 DeepSeek 新動向不是 R2 或 V5,而是 V4 的正式發布本身。多家媒體報導,DeepSeek 目標將在 2026 年 7 月中旬推出正式版;而且不同於只是形式上的「GA」標記,這次會帶來兩項你可以納入預算考量的變化:尖峰時段 API 定價與更強的 agentic、數學與程式碼表現。你今天可以呼叫的 deepseek-v4-pro 和 deepseek-v4-flash,仍然是 4 月 24 日的預覽版;截至 2026 年 7 月 20 日,正式版還沒有出現在 DeepSeek 的 變更記錄中。本文將探討正式版會改變什麼、何時上線,以及現在就開發還是等待比較好。
官方 DeepSeek V4 將帶來哪些改變
即將發布的正式版與自四月以來一直上線的預覽版有兩個差異。兩者都是具體變更,並非行銷話術。
尖峰時段定價是重點。 在前沿 LLM API 仍屬罕見的做法中,DeepSeek 準備依一天中的時段來計費 V4。根據 InfoWorld 和 Let's Data Science 的報導,北京商業尖峰時段(09:00–12:00 與 14:00–18:00)的呼叫費用將是離峰費率的 兩倍,而離峰價格則維持現狀。報導中的數字顯示,V4-Pro 在離峰時段的輸出為每百萬 token ¥6,而尖峰時段為 ¥12;V4-Flash 則為 ¥2 與 ¥4。DeepSeek 將此表述為為了穩定性而分散負載,而非全面漲價,但實際效果相同:互動式的白天流量變得更昂貴,而可容忍延遲或在離峰時段執行的批次作業則仍然便宜。按時段定價在電力與雲端 spot 市場很常見;看到它出現在 LLM API 上,意味著推理需求而非訓練,現在已成為 DeepSeek 的關鍵瓶頸。
效能提升了。 同一份報告指出,正式版在預覽版的基礎上擴展了更強的 agentic、數學與程式碼生成能力,並讓 1M-token context window 成為整個產品線的標準配置。在獨立基準測試出爐之前,請將具體幅度視為未經驗證,但方向上是在相同兩個 model ID 的基礎上進一步提升能力,而不是新家族。
哪些不會改變:模型仍然是 open-weight,而且你仍然可以呼叫 deepseek-v4-pro 或 deepseek-v4-flash。因此,正式發布是一個關於定價與品質的事件,而不是遷移事件。
官方版本什麼時候推出?
簡短答案:有報導指出,針對 2026 年 7 月中旬的時間窗,但尚未確認已正式推出。截至 2026 年 7 月 20 日,該時間窗已到或剛過,而在官方變更紀錄中,最新有日期的條目仍是 2026 年 4 月 24 日的預覽版。因此,「V4 於 7 月推出」的說法只對了一半:雖然有報導稱已有正式版本,但在文件中尚未上線。
有兩個可靠的信號可以告訴你官方版本真的已正式上線,而不只是另一則傳聞:一則新的有日期的變更紀錄項目,以及官方定價頁面上的更新數字。當這些內容有變動時,就表示它已發布。 在那之前,你看到的仍是預覽版。
V4 目前的費用,以及正式推出後的費用
定價是官方發布最有感的地方,所以先了解目前的基準很值得。許多文章仍引用 DeepSeek-V4-Pro 每百萬輸出 tokens 價格為 $3.48。那是上市時的價格,早已不復存在。
以下是 DeepSeek 的官方定價頁面目前的價格,已於 2026 年 7 月 20 日驗證(皆為每 1M tokens,USD):
| 模型 | 輸入(快取命中) | 輸入(快取未命中) | 輸出 |
|---|---|---|---|
| deepseek-v4-flash | $0.0028 | $0.14 | $0.28 |
| deepseek-v4-pro | $0.003625 | $0.435 | $0.87 |
Pro 之所以是 $0.87 而不是 $3.48:75% 的上市折扣將其降至原始價格的四分之一,而當促銷於 2026 年 5 月 31 日結束時,DeepSeek 將這個較低價格保留為新的標準,而不是讓它回復原價。
現在把正式版發布加進來看。一旦尖峰時段定價上線,今天的 $0.87 會變成 Pro 的離峰下限,而營業時間內的呼叫成本大約會翻倍。對於一個服務 9 點到 5 點使用者的聊天機器人來說,這是實質性的漲幅;但對於整夜運行的批次處理管線來說,幾乎沒有影響。要讓支出維持不變,有兩個槓桿:把可容忍延遲的工作排到離峰時段,並善用快取命中輸入定價;在 Pro 上,這大約比快取未命中便宜 50 倍。如果你正在建模真實工作負載,部署 DeepSeek 的企業成本動態,更取決於快取行為、尖峰時段與吞吐量限制,而不是標價本身。
已經確定的 7 月 24 日截止日期
一項有日期的變更不是傳聞:在 2026 年 7 月 24 日,UTC 15:59,舊版模型名稱 deepseek-chat 和 deepseek-reasoner 將停止使用。如果你的程式碼仍然呼叫它們,之後就會失效。
這次遷移很小,而且現在就做也能讓你使用官方版本將會採用的模型 ID:
- 將
model參數更改為deepseek-v4-flash或deepseek-v4-pro。 - 保留相同的
base_url(https://api.deepseek.com);它不會變更。 - 這兩個模型都可透過 OpenAI ChatCompletions 介面和 Anthropic 介面使用,因此您的客戶端程式庫無需變更。
在過渡期間,舊名稱會映射到 deepseek-v4-flash 的非思考與思考模式,因此你其實已經等同於在使用 V4——只是別名會被移除。如果你透過聚合器路由 DeepSeek,模型名稱的變更也是相同的;像 AIReiter 這樣的平台會透過相同的 Anthropic 相容端點提供 V4 ID。
現在就基於預覽版開發,還是等待正式版本?
對大多數團隊來說,答案是 現在就打造——並將正式發布成本計入其中。
這個預覽版已經足夠穩定可用於生產環境,而且在離峰時每百萬個輸出 token 僅需 $0.87,價格相當便宜。V4-Pro 在其最高推理設定(DeepSeek 將此模式標記為 Pro-Max)下,據報在 SWE-bench Verified 上約達 80.6%,接近最強的閉源模型;這些數據是自我報告或第三方提供,並非我們自己的測試,因此請相應地看待其權重。在成本方面,一篇 Reddit 討論串將其吸引力總結為「比其他地方人們所支付的價格便宜 17 倍」。
等待正式版本可以換來效能提升,但也會附帶尖峰時段加價,並延後針對一項截至 7 月 20 日仍尚未發佈到變更日誌的上線作業。務實的做法是:先在預覽版上推出,為互動流量預留尖峰定價的預算,並在正式數據公布後重新測試。
該選哪個模型?Reddit 上的開發者將 Flash 稱為「超便宜的工人」,適合範圍明確的任務,而在前沿級推理方面則會選用 Pro;Flash 與 Pro 的取捨正是取決於這種分工。無論選哪個版本,都有兩點注意事項:V4-Pro 的吞吐量受容量限制(DeepSeek 也已明確表示),因此在高負載下 Pro 可能會更慢;另外,V4 也僅支援文字——圖片、音訊和影片則屬於 DeepSeek 其他獨立產品線(Janus、DeepSeek-VL2、DeepSeek-OCR),官方發布也預計不會改變這一點。
R2 和 V5 怎麼樣?
兩者都不是短期內的故事,儘管搜尋量很高。R2 仍未發布,也沒有確認日期;DeepSeek 已否認具體時間窗口,而且外流的「規格」彼此矛盾(其中一份外流稱為約 1.2T 的 MoE 模型,另一份則稱為 32B 的稠密模型)。V5 的說法更薄弱:那個瘋傳的「7 月 24 日 V5」說法,其實是把舊別名停用日期誤讀了。真正可信的下一個里程碑,是本文所討論的那個——正式的 V4——而不是新一代。
常見問題
官方 DeepSeek V4 什麼時候推出?
多個媒體報導指出 2026 年 7 月中旬有一個發布窗口,但截至 2026 年 7 月 20 日,API 變更記錄中仍未出現。請留意變更記錄與定價頁面,以確認它是否真的已推出。
官方 V4 與預覽版有什麼新內容?
兩件事:尖峰時段 API 定價(營業時間的呼叫費率大約是離峰時段的兩倍),以及更強的 agentic、數學與程式碼表現,並且全系列標準支援 1M context。模型 ID 和開放權重授權維持不變。
官方 DeepSeek V4 會花多少錢?
離峰時段定價預計將與目前費率相同:V4-Pro 每 100 萬個輸出 tokens 為 $0.87,V4-Flash 為 $0.28。尖峰時段的呼叫費用則約為其兩倍。兩者的快取命中輸入成本都便宜得多。
DeepSeek V4 現在可以使用嗎?
是。V4-Pro 和 V4-Flash 自 2026 年 4 月 24 日起已公開、開放權重(採用 MIT 授權,位於 DeepSeek 的 Hugging Face 組織),並且可供呼叫。你不必等到正式發布才開始基於它們開發。
我是否需要在 2026 年 7 月 24 日之前完成遷移?
僅當您的程式碼仍在呼叫 deepseek-chat 或 deepseek-reasoner 時。請在 2026 年 7 月 24 日 15:59 UTC 之前將模型名稱改為 deepseek-v4-flash 或 deepseek-v4-pro;您的請求中其他內容都不變。
