Lanzamiento oficial de DeepSeek V4: qué cambia y cuándo

Última actualización: 2026-07-20 06:08:00

Lo próximo a observar de DeepSeek no es R2 ni V5. Es el lanzamiento oficial de V4 en sí. Varios medios informan que DeepSeek apunta a un lanzamiento a mediados de julio de 2026 para la versión oficial y, a diferencia de un sello "GA" meramente cosmético, trae dos cambios para los que puedes presupuestar: precios de API en horas punta y mejor rendimiento agentic, matemático y de código. Lo que puedes llamar hoy, deepseek-v4-pro y deepseek-v4-flash, sigue siendo la vista previa del 24 de abril, y al 20 de julio de 2026 la versión oficial no ha aparecido en el registro de cambios de DeepSeek. Este artículo analiza qué cambia con la versión oficial, cuándo llegará y si conviene construir ahora o esperar.

Qué cambiará el DeepSeek V4 oficial

Dos cosas separan la próxima versión oficial de la vista previa que ha estado activa desde abril. Ambas son concretas, no de marketing.

La tarificación en horas punta es el titular. En una medida que sigue siendo poco común para una API de LLM de frontera, DeepSeek tiene previsto tarificar V4 según la hora del día. Según InfoWorld y Let's Data Science, las llamadas durante las horas punta de negocio en Pekín (09:00–12:00 y 14:00–18:00) costarán el doble de la tarifa valle, mientras que los precios valle se mantienen donde están hoy. Las cifras informadas sitúan la salida de V4-Pro en ¥6 por millón de tokens en valle frente a ¥12 en punta, y V4-Flash en ¥2 frente a ¥4. DeepSeek lo plantea como una forma de repartir la carga para ganar estabilidad, en lugar de una subida plana, pero el efecto práctico es el mismo: el tráfico interactivo diurno se encarece, y los trabajos por lotes o tolerantes a la latencia que se ejecutan en valle siguen siendo baratos. La tarificación según la hora del día es normal en la electricidad y en los mercados spot de la nube; verla en una API de LLM indica que la demanda de inferencia, no el entrenamiento, es ahora la restricción principal de DeepSeek.

El rendimiento aumenta. El mismo informe señala que la compilación oficial amplía la vista previa con una capacidad más sólida en tareas agentivas, matemáticas y de generación de código, y convierte la ventana de contexto de 1M tokens en un estándar en toda la línea. Considere la magnitud exacta como no verificada hasta que lleguen benchmarks independientes, pero la tendencia apunta a una mejora de capacidades sobre los mismos dos IDs de modelo, no a una nueva familia.

Lo que *no* está cambiando: los modelos siguen siendo open-weight, y todavía llamas a deepseek-v4-pro o deepseek-v4-flash. Así que el lanzamiento oficial es un evento de precios y calidad, no un evento de migración.

¿Cuándo llegará la versión oficial?

La respuesta breve: se informó para una ventana de mediados de julio de 2026, pero aún no se ha confirmado su lanzamiento. A fecha de 20 de julio de 2026, esa ventana ya está llegando a su fin o acaba de pasar, y en el registro oficial de cambios la entrada fechada más reciente sigue siendo la del 24 de abril de 2026, la vista previa. Así que el rumor de que "V4 se lanza en julio" es solo medio cierto: se informa de una versión oficial, pero todavía no está activa en la documentación.

DeepSeek API Change Log showing the April 24, 2026 V4 entry as the latest update, with the July 24 legacy-model deprecation notice

Dos señales fiables te indicarán que la versión oficial está realmente en vivo, y no es otro rumor: una nueva entrada de registro de cambios con fecha y cifras actualizadas en la página de precios oficial. Cuando eso cambie, se habrá lanzado. Hasta entonces, estás en la vista previa.

Cuánto cuesta V4 hoy y después del lanzamiento oficial

El precio es donde la versión oficial duele, así que vale la pena entender primero la base actual. Muchos artículos todavía citan DeepSeek-V4-Pro a $3.48 por millón de tokens de salida. Ese fue el precio de lanzamiento y ya quedó atrás.

Aquí está la tarifa actual en la página oficial de precios de DeepSeek, verificada el 20 de julio de 2026 (todo por 1M tokens, USD):

ModeloEntrada (acierto de caché)Entrada (fallo de caché)Salida
deepseek-v4-flash$0.0028$0.14$0.28
deepseek-v4-pro$0.003625$0.435$0.87

La razón por la que Pro cuesta $0.87 y no $3.48: un descuento de lanzamiento del 75% lo redujo a una cuarta parte de su nivel original, y cuando la promoción terminó el 31 de mayo de 2026, DeepSeek mantuvo esa tarifa más baja como el nuevo estándar en lugar de dejar que volviera al nivel anterior.

Bar chart comparing DeepSeek V4 output token price at launch versus current, showing V4-Pro dropping from $3.48 to $0.87 while V4-Flash holds at $0.28

Ahora incorpora la versión oficial encima. Una vez que llegue la tarificación en horas punta, los $0.87 de hoy se convierten en el suelo fuera de horas punta para Pro, y las llamadas en horario laboral se duplican aproximadamente. Para un chatbot que atiende a los usuarios de 9 a 5, eso supone un aumento real; para una canalización por lotes nocturna, casi no cambia nada. Dos palancas mantienen el gasto plano: programar el trabajo tolerante fuera de horas punta y apoyarse en la tarificación de entrada con acierto de caché, que es aproximadamente 50 veces más barata que un fallo de caché en Pro. Si estás modelando una carga de trabajo real, la dinámica de costes empresariales de ejecutar DeepSeek depende más del comportamiento de la caché, las ventanas de máxima demanda y los límites de rendimiento que del precio de lista.

La fecha límite del 24 de julio que ya está fijada

Un cambio fechado no es un rumor: el 24 de julio de 2026, 15:59 UTC, los nombres de modelo heredados deepseek-chat y deepseek-reasoner se retiran. Si tu código todavía los llama, dejará de funcionar después de eso.

La migración es pequeña, y hacerla ahora también te pone en los IDs de modelo que usará la versión oficial:

  • Cambie el parámetro model a deepseek-v4-flash o deepseek-v4-pro.
  • Conserve el mismo base_url (https://api.deepseek.com); no cambia.
  • Ambos modelos funcionan a través de la interfaz OpenAI ChatCompletions y la interfaz Anthropic, así que su biblioteca cliente permanece igual.

Durante la transición, los nombres antiguos se asignan a los modos sin razonamiento y con razonamiento de deepseek-v4-flash, así que ya estás efectivamente en V4 — simplemente desaparecen los alias. Si enrutas DeepSeek a través de un agregador, el cambio de nombre del modelo es el mismo; plataformas como AIReiter exponen los IDs de V4 a través del mismo endpoint compatible con Anthropic.

¿Construir sobre la versión preliminar ahora, o esperar la versión oficial?

Para la mayoría de los equipos, la respuesta es construir ahora — con la versión oficial ya incluida en el precio.

La versión preliminar es lo suficientemente estable para producción y, a $0.87 por millón de tokens de salida fuera de hora punta, barata. V4-Pro en su ajuste máximo de razonamiento (un modo que DeepSeek etiqueta como Pro-Max) se ha informado en torno al 80.6% en SWE-bench Verified, cerca de los modelos cerrados más potentes; esas cifras son autoinformadas o de terceros, no nuestras propias pruebas, así que tómelas en consecuencia. En cuanto al costo, un hilo de Reddit resumió el atractivo como "17x más barato" que lo que la gente estaba pagando en otros lugares.

Esperar a la versión oficial le da una mejora de rendimiento, pero también el recargo de hora punta, y retrasa el trabajo para un lanzamiento que, a fecha de 20 de julio, aún no se ha publicado en el registro de cambios. La opción pragmática: lanzar en la vista previa, presupuestar la tarificación de hora punta para el tráfico interactivo y volver a probar cuando se publiquen las cifras oficiales.

¿Qué modelo? Los desarrolladores en Reddit describen Flash como un "trabajador súper barato" para tareas bien definidas y recurren a Pro para razonamiento de nivel frontera; las compensaciones entre Flash y Pro se reducen a esa división. Hay dos advertencias en cualquier caso: el rendimiento de V4-Pro está limitado por la capacidad (DeepSeek lo ha dicho así), por lo que Pro puede ser más lento bajo carga, y V4 es solo texto — imagen, audio y video viven en líneas separadas de DeepSeek (Janus, DeepSeek-VL2, DeepSeek-OCR), y no se espera que la versión oficial cambie eso.

¿Qué pasa con R2 y V5?

Ninguno de los dos es la historia a corto plazo, a pesar del volumen de búsqueda. R2 no ha sido lanzado y no hay una fecha confirmada; DeepSeek ha negado ventanas específicas, y las "especificaciones" filtradas se contradicen entre sí (un modelo MoE de ~1.2T en una filtración, un modelo denso de 32B en otra). V5 es aún más débil: la afirmación viral de "V5 el 24 de julio" es una mala interpretación de la fecha de retirada del alias heredado. El próximo hito creíble es el que trata este artículo — el V4 oficial — no una nueva generación.

Preguntas frecuentes

¿Cuándo saldrá oficialmente DeepSeek V4?

Varios medios informaron de una ventana a mediados de julio de 2026, pero no había aparecido en el registro de cambios de la API hasta el 20 de julio de 2026. Vigile el registro de cambios y la página de precios para confirmar que realmente se ha lanzado.

¿Qué hay de nuevo en la versión oficial V4 frente a la vista previa?

Dos cosas: precios de API en horas punta (las llamadas en horario laboral cuestan aproximadamente el doble que la tarifa fuera de horas punta) y un rendimiento más sólido en agentes, matemáticas y código, con 1M de contexto estándar en toda la gama. Los IDs de modelo y la licencia de pesos abiertos permanecen igual.

¿Cuánto costará el DeepSeek V4 oficial?

Se espera que el precio fuera de hora punta coincida con la tarifa actual: $0.87 por 1M tokens de salida para V4-Pro, $0.28 para V4-Flash. Se prevé que las llamadas en hora punta cuesten aproximadamente el doble de eso. La entrada con acierto de caché es mucho más barata en ambos.

¿Se puede usar DeepSeek V4 ahora mismo?

Sí. V4-Pro y V4-Flash han sido públicos, de peso abierto (con licencia MIT, en la organización de Hugging Face de DeepSeek), y se pueden invocar desde el 24 de abril de 2026. No tiene que esperar al lanzamiento oficial para construir sobre ellos.

¿Necesito migrar antes del 24 de julio de 2026?

Solo si tu código todavía llama a deepseek-chat o deepseek-reasoner. Cambia el nombre del modelo a deepseek-v4-flash o deepseek-v4-pro antes del 24 de julio de 2026, 15:59 UTC; nada más en tu solicitud cambia.