DeepSeek V4 官方发布:将有哪些变化,以及何时发布

最后更新: 2026-07-20 06:08:59

接下来值得关注的 DeepSeek 不是 R2 或 V5,而是 V4 的正式发布 本身。多家媒体报道称,DeepSeek 计划在 2026 年 7 月中旬推出正式版;不同于仅仅一个表面的“GA”标记,它带来了两项你可以据此规划预算的变化:高峰时段 API 定价以及更强的 agentic、数学和代码性能。你今天可以调用的 deepseek-v4-prodeepseek-v4-flash 仍然是 4 月 24 日的 preview 版本,而截至 2026 年 7 月 20 日,正式版尚未出现在 DeepSeek 的 change log 中。本文将探讨正式版带来了哪些变化、何时上线,以及现在就构建还是等待更合适。

官方 DeepSeek V4 将带来哪些变化

即将到来的正式发布与自四月以来一直在线的预览版有两点不同。这两点都是实实在在的,不是营销话术。

峰时定价是头条。 对于前沿 LLM API 来说,这一做法仍然罕见,DeepSeek 计划按一天中的时段对 V4 计费。根据 InfoWorldLet's Data Science 的报道,北京工作日高峰时段(09:00–12:00 和 14:00–18:00)的调用费用将是非高峰时段的 两倍,而非高峰价格则维持现状。报道称,V4-Pro 的输出价格为非高峰每百万 tokens ¥6、高峰 ¥12,V4-Flash 则分别为 ¥2 和 ¥4。DeepSeek 将此表述为为了稳定性而进行的负载分散,而不是统一涨价,但实际效果是一样的:白天的交互式流量会更贵,而可容忍延迟或在非高峰运行的批处理任务仍然便宜。按时段定价在电力和云抢占式市场中很常见;将其引入 LLM API 说明如今 DeepSeek 面临的关键约束已经是推理需求,而非训练。

性能提升。 同一份报告还称,正式版在预览版基础上增强了 agentic、数学和代码生成能力,并将 1M-token 上下文窗口在整个产品线中设为标准配置。在独立基准测试结果出来之前,具体提升幅度仍应视为未证实,但总体方向是在相同的两个模型 ID 之上进行能力升级,而不是推出一个新系列。

什么*没有变化:这些模型仍然是开放权重的,你仍然调用 deepseek-v4-prodeepseek-v4-flash。因此,正式发布是一个定价与质量事件,而不是迁移事件。

官方版本什么时候发布?

简短回答:有消息称其计划在 2026 年 7 月中旬的窗口发布,但尚未确认已正式上线。截至 2026 年 7 月 20 日,这个时间窗口已经到期或刚刚过去,而在官方更新日志中,最新的带日期条目仍然是 2026 年 4 月 24 日,也就是预览版。所以“V4 将于 7 月发布”的说法只说对了一半:据报已有官方构建版本,但它在文档中仍未正式上线。

DeepSeek API Change Log showing the April 24, 2026 V4 entry as the latest update, with the July 24 legacy-model deprecation notice

有两个可靠的信号能告诉你官方版本确实已经正式上线,而不是又一个谣言:一个新的带日期的更新日志条目,以及官方定价页面上的更新数字。当这些发生变化时,就说明它已经发布了。在那之前,你看到的仍是预览版。

V4 目前的价格,以及正式发布后的价格

定价正是官方版本让人感到“肉疼”的地方,所以先了解当前的基准价很有必要。许多文章仍然引用 DeepSeek-V4-Pro 每百万输出 token 3.48 美元的价格。那是发布时的价格,早已不再适用。

以下是 DeepSeek 的 官方定价页面 上的当前价格,已于 2026 年 7 月 20 日核实(均为每 100 万 token,USD):

模型输入(缓存命中)输入(缓存未命中)输出
deepseek-v4-flash$0.0028$0.14$0.28
deepseek-v4-pro$0.003625$0.435$0.87

Pro 定价为 $0.87 而不是 $3.48 的原因是:75% 的上线折扣将其降至原价的四分之一,而在 2026 年 5 月 31 日促销结束后,DeepSeek 维持了这一较低费率作为新的标准,而不是让其恢复原价。

Bar chart comparing DeepSeek V4 output token price at launch versus current, showing V4-Pro dropping from $3.48 to $0.87 while V4-Flash holds at $0.28

现在把正式发布的内容叠加上去。一旦高峰时段定价落地,今天的 $0.87 将成为 Pro 的非高峰下限,而工作时间内的调用价格大约会翻倍。对于一个在朝九晚五服务用户的聊天机器人来说,这是真实的上涨;对于一个通宵批处理流水线来说,几乎没什么变化。有两个杠杆可以让支出保持不变:把可延后工作安排到非高峰时段,以及依赖缓存命中输入定价——它比 Pro 上的缓存未命中便宜大约 50 倍。如果你在模拟真实工作负载,运行 DeepSeek 的企业成本动态更多取决于缓存行为、高峰窗口和吞吐量限制,而不是标价。

已确定的 7 月 24 日截止日期

一个已确定的变更不是谣言:在 2026年7月24日,15:59 UTC,旧版模型名称 deepseek-chatdeepseek-reasoner 将停用。如果你的代码仍在调用它们,那么之后就会出错。

迁移很小,而且现在进行迁移也会让您使用官方发布将采用的模型 ID:

  • model 参数更改为 deepseek-v4-flashdeepseek-v4-pro
  • 保持相同的 base_urlhttps://api.deepseek.com);它不会改变。
  • 这两个模型都可通过 OpenAI ChatCompletions 接口和 Anthropic 接口使用,因此你的客户端库无需更改。

在过渡期间,旧名称会映射到 deepseek-v4-flash 的非思考和思考模式,因此你实际上已经在使用 V4——只是别名消失了。如果你通过聚合器路由 DeepSeek,模型名称的更改也是一样的;像 AIReiter 这样的平台会通过同一个 Anthropic 兼容端点提供 V4 ID。

现在基于预览版构建,还是等待正式版?

对于大多数团队,答案是现在构建——把正式发布的成本也考虑进去。

这个预览版已经足够稳定,适合用于生产环境,而且在非高峰时段每百万输出 tokens 仅需 $0.87,价格很便宜。V4-Pro 在其最高推理设置下(DeepSeek 将这种模式标记为 Pro-Max)据称在 SWE-bench Verified 上得分约 80.6%,接近最强的闭源模型;这些数据是自述或第三方提供的,并非我们自己的测试,因此请相应看待其权重。在成本方面,一条 Reddit 讨论串 将其吸引力概括为“比人们在其他地方支付的便宜 17 倍”。

等待官方构建会让你获得性能提升,但也会带来高峰时段附加费,而且还会推迟一个发版的工作;截至 7 月 20 日,该发版尚未发布到变更日志。务实的做法是:先用预览版上线,为交互式流量的高峰定价做好预算,并在官方数据发布后重新测试。

选哪个模型?Reddit 上的开发者把 Flash 描述为“超级便宜的工人”,适用于范围明确的任务,而在前沿级推理上则会选择 Pro;Flash 与 Pro 的权衡正是基于这种分工。无论选择哪一个,都有两个注意事项:V4-Pro 的吞吐量受容量限制(DeepSeek 已明确表示过这一点),因此在负载较高时 Pro 可能更慢,而且 V4 仅支持纯文本——图像、音频和视频分别属于 DeepSeek 其他产品线(Janus、DeepSeek-VL2、DeepSeek-OCR),官方发布预计也不会改变这一点。

那 R2 和 V5 呢?

两者都不是近期的故事,尽管搜索量很高。R2 尚未发布,且没有确认日期;DeepSeek 已否认具体时间窗口,而泄露的“规格”彼此矛盾(一次泄露称是一个约 1.2T 的 MoE 模型,另一次则称是一个 32B 的稠密模型)。V5 更是如此:那条病毒式传播的“7 月 24 日发布 V5”说法,是对旧别名退役日期的误读。可信的下一个里程碑是本文所讨论的那个——官方 V4——而不是新一代。

常见问题

官方 DeepSeek V4 什么时候发布?

多家媒体报道称发布时间窗口为 2026 年 7 月中旬,但截至 2026 年 7 月 20 日,它尚未出现在 API 变更日志中。请关注变更日志和定价页面,以确认它是否已经真正上线。

官方 V4 与预览版相比有哪些新内容?

两点:高峰时段 API 定价(工作时间调用费率大约是非高峰时段的两倍)以及更强的 agentic、数学和代码性能,同时全系列标配 1M context。模型 ID 和开源权重许可保持不变。

官方 DeepSeek V4 的价格是多少?

非高峰定价预计与今天的费率一致:V4-Pro 每 100 万输出 token 为 $0.87,V4-Flash 为 $0.28。高峰时段调用的成本大约是这个的两倍。两者的缓存命中输入都便宜得多。

DeepSeek V4 现在可以使用吗?

是的。V4-Pro 和 V4-Flash 自 2026 年 4 月 24 日起就已公开、开放权重(MIT 许可,位于 DeepSeek 的 Hugging Face 组织 中),并且可供调用。你不必等到正式发布后再基于它们进行开发。

我是否需要在 2026 年 7 月 24 日之前迁移?

仅当你的代码仍在调用 deepseek-chatdeepseek-reasoner 时。请在 2026 年 7 月 24 日 15:59 UTC 之前将模型名称切换为 deepseek-v4-flashdeepseek-v4-pro;你的请求中其他内容无需更改。