AIREITER

Subida de precios de la API de DeepSeek: tarifas antiguas frente a nuevas (ago. de 2026)

Última actualización: 2026-08-16 19:01:25

La subida de precios de la API de DeepSeek entró en vigor el 16 de agosto de 2026 y sustituyó las tarifas planas por token por una facturación diferenciada entre horas punta y horas valle en deepseek-v4-flash y deepseek-v4-pro. En horas valle, las entradas sin acierto de caché y las salidas cuestan ahora entre 1,5 y 2,4 veces más que antes; en horas punta, el doble. Las entradas con acierto de caché suben entre 2,5 y 6,1 veces en horas valle y hasta 12,1 veces en horas punta. La cifra que realmente determina el impacto para cada proyecto es la tasa de aciertos de la caché de prompts.

Qué cambió el 16 de agosto de 2026

El cambio se aplicó a las 16:00 UTC del domingo 16 de agosto —medianoche del 17 de agosto en Pekín—, según el hilo del anuncio y la auditoría de 650 llamadas publicada en r/DeepSeek. La página oficial de Modelos y precios ya muestra las nuevas tablas, así que no se trata solo de un anuncio: las tarifas están activas.

DeepSeek ha dividido la facturación en franjas punta y valle, con tarifas punta exactamente 2 veces superiores a las de las horas valle. Las dos franjas punta son de 01:00 a 04:00 UTC y de 06:00 a 10:00 UTC: siete horas punta al día frente a diecisiete horas valle. Las versiones de los modelos (DeepSeek-V4-Flash-0731, DeepSeek-V4-Pro-0813), la compatibilidad de la API y las especificaciones publicadas permanecen sin cambios en esa misma página. Es un cambio de facturación, no de modelos.

Las nuevas tarifas de la API de DeepSeek

Todos los precios siguientes están expresados en USD por cada millón de tokens y proceden directamente de la página oficial de precios a fecha del 16 de agosto de 2026.

V4 FlashHoras valleHoras punta
Entrada, acierto de caché$0.007$0.014
Entrada, fallo de caché$0.22$0.44
Salida$0.66$1.32
V4 ProHoras valleHoras punta
Entrada, acierto de caché$0.022$0.044
Entrada, fallo de caché$0.66$1.32
Salida$1.98$3.96
Página oficial de precios de la API de DeepSeek con las nuevas tarifas punta y valle, 16 de agosto de 2026

El funcionamiento de la facturación no cambia por lo demás: cada solicitud se cobra según la tarifa vigente en el momento de su ejecución y DeepSeek se reserva explícitamente el derecho a volver a modificar los precios.

Cuánto ha encarecido realmente la API de DeepSeek

Los precios planos anteriores fueron verificados por rastreadores independientes hasta el 31 de julio de 2026: Flash costaba $0.14 por entrada sin acierto de caché, $0.0028 por entrada con acierto de caché y $0.28 por salida; Pro, $0.435 / $0.003625 / $0.87 (TLDL, BenchLM). Al poner ambas tablas una junto a la otra:

Por cada millón de tokensAntigua planaNueva en horas valleNueva en horas puntaValle frente a la anteriorPunta frente a la anterior
Entrada Flash, acierto de caché$0.0028$0.007$0.0142.5×5.0×
Entrada Flash, fallo de caché$0.14$0.22$0.441.57×3.14×
Salida Flash$0.28$0.66$1.322.36×4.71×
Entrada Pro, acierto de caché$0.003625$0.022$0.0446.07×12.14×
Entrada Pro, fallo de caché$0.435$0.66$1.321.52×3.03×
Salida Pro$0.87$1.98$3.962.28×4.55×
Precios de la API de DeepSeek V4: tarifa plana anterior frente a la nueva tarifa valle y la nueva tarifa punta, en USD por millón de tokens

El titular de una «subida del 1.114 %» que circula por Reddit es real, pero se refiere a un caso muy concreto: la entrada con acierto de caché de V4 Pro en horas punta, que pasa de $0.003625 a $0.044. En horas valle, una carga de trabajo sin caché se acerca más a una subida de entre 1,5 y 2,3 veces. El resultado final depende por completo del punto intermedio en el que se encuentre cada proyecto.

Por qué las cargas de trabajo que usan mucho la caché son las más perjudicadas

Los precios de las entradas con acierto de caché suben entre 2,5 y 12 veces, mientras que las entradas sin acierto y las salidas aumentan entre 1,5 y 4,7 veces. Por eso, cuanto mayor fuera el volumen de entradas que circulaba por la baratísima vía de aciertos de caché, mayor será el salto porcentual. Un usuario de r/DeepSeek recalculó el precio de 650 llamadas reales a la API —16 sesiones, 155,9 millones de tokens de prompt y una tasa de aciertos de caché del 98,09 %— con las dos tablas y contrastó el resultado con la facturación de la consola de DeepSeek, con una diferencia inferior al 2 %:

«Cuanto mejor funcione la caché para ti hoy, mayor será la subida» — u/Swimming-Soup-1173, auditoría de 650 llamadas de API en r/DeepSeek

Al recalcular su carga de trabajo con agentes, el coste resultó ser 2,7 veces mayor en horas valle, frente a 1,5 veces más para la misma carga sin aciertos de caché. Otro usuario modeló una carga con contexto largo que pasaba de $33 a $100 en horas valle o a $200 en horas punta: un salto de 3 a 6 veces. Los trabajos por lotes, las canalizaciones RAG y los agentes con prompts de sistema estáticos son los perfiles más presionados. En comparación, el tráfico de resúmenes puntuales se mantiene más cerca del mínimo de 1,5–2,3 veces en horas valle.

Horas punta convertidas a tu zona horaria

La página oficial solo muestra las franjas en UTC. Estas son las conversiones para agosto, con el horario de verano activo:

ZonaFranjas punta (hora local)Tu jornada de 9 a 17
Pekín (UTC+8)09:00–12:00, 14:00–18:00Horas punta salvo la pausa de 12:00 a 14:00
Europa Central (UTC+2)03:00–06:00, 08:00–12:00Las mañanas son horas punta
Londres (UTC+1)02:00–05:00, 07:00–11:00Las mañanas son horas punta
Este de EE. UU. (UTC-4)21:00–00:00, 02:00–06:00Todo el horario laboral queda fuera de las horas punta
Oeste de EE. UU. (UTC-7)18:00–21:00, 23:00–03:00Todo el horario laboral queda fuera de las horas punta

Las franjas punta cubren la jornada laboral china, salvo la pausa para comer: de 12:00 a 14:00, hora de Pekín, las tarifas son de valle. Los equipos estadounidenses trabajan durante toda su jornada con precios de valle. En Europa, en cambio, los lotes de la mañana se cobran al doble —de 08:00 a 12:00 CEST es hora punta—, así que conviene trasladarlos a la tarde o a la noche.

¿Sigue compensando la caché de prompts?

Sí, sin ninguna duda: el descuento se ha reducido, pero no ha desaparecido. Antes, las entradas con acierto de caché eran unas 50 veces más baratas que las entradas sin acierto en Flash y 120 veces más baratas en Pro. Ahora son unas 30 veces más baratas en ambos modelos: 31 veces en Flash y 30 veces en Pro durante las horas valle ($0.007 frente a $0.22 y $0.022 frente a $0.66). El autor de la auditoría que calculó la subida de 2,7 veces llegó a la misma conclusión:

«La caché sigue compensando absolutamente» — la misma auditoría de r/DeepSeek

En su carga de trabajo, la caché seguía reduciendo los costes aproximadamente 15 veces frente a enviar el mismo contexto sin caché. Eso sí, la caché funciona como un mecanismo de mejor esfuerzo y no garantiza una tasa de aciertos concreta. Además, las entradas no utilizadas suelen eliminarse al cabo de horas o días (BenchLM). Antes de preparar el presupuesto, mide tu caso: registra los campos prompt_cache_hit_tokens y prompt_cache_miss_tokens del objeto de uso, tal como recomienda BenchLM, y calcula tu proporción real de aciertos.

¿Sigue siendo DeepSeek la opción barata tras la subida?

En horas valle, sí. En horas punta, la ventaja frente a GPT-5.6 desaparece en la gama Flash. Precios estándar de salida por cada millón de tokens:

ModeloEntradaSalidaNotas
DeepSeek V4 Flash (horas valle)$0.22$0.66Contexto de 1 millón
DeepSeek V4 Flash (horas punta)$0.44$1.32Supera el precio de salida de Luna
GPT-5.6 Luna$0.20$1.20Precio reducido un 80 % el 30 de julio
DeepSeek V4 Pro (horas valle)$0.66$1.98Sigue unas 6 veces por debajo de Terra
DeepSeek V4 Pro (horas punta)$1.32$3.96Unas 3 veces por debajo de Terra
GPT-5.6 Terra$2$12
Claude Sonnet 5$2$10Tarifa introductoria hasta el 31 de agosto; después, $3/$15

En horas valle, la salida de V4 Flash, a $0.66, es un 45 % más barata que la de GPT-5.6 Luna y 18 veces más barata que la de Terra. DeepSeek sigue siendo la opción más económica para trabajos de gran volumen. En horas punta, Luna —$1.20 por salida y $0.20 por entrada— supera a Flash en ambas tarifas estándar. Sin embargo, su tarifa de lectura de caché —$0.02/M en el historial del AI Price Index— es más cara que la vía de aciertos de caché de Flash a cualquier hora. Además, Flash mantiene un contexto de 1 millón de tokens y una concurrencia de 2.500 en la tabla oficial de especificaciones. Como resumió un comentarista en el hilo del anuncio: «DS4 es bueno, pero ¿cuándo sale barato?»

Qué hacer esta semana

  1. Recalcula tu propia factura antes de alarmarte. Extrae los registros de uso del último mes y calcula: entradas con acierto de caché × tasa de aciertos × precio de acierto + entradas con fallo de caché × tasa de fallos × precio de fallo + salidas × precio de salida. Aplica la tarifa punta o valle vigente en la franja de cada solicitud. Los dos extremos de la auditoría sirven como referencia: sin aciertos de caché, el coste sube 1,5 veces; con una tasa de aciertos del 98 %, sube 2,7 veces.
  2. Mueve los trabajos por lotes fuera de las horas punta. Tareas programadas, evaluaciones y procesamiento de documentos —todo lo que no tenga a un usuario esperando— puede ejecutarse durante las 17 horas valle. Para los equipos de EE. UU. esto es prácticamente automático, porque su jornada ya queda fuera de las horas punta; los equipos europeos deberían pasar los lotes de la mañana a la tarde.
  3. Sigue generando aciertos de caché. Mantén la estructura de prompts que ya te esté dando aciertos: esta vía sigue costando unas 30 veces menos que las entradas sin acierto de caché.
  4. Prueba a bajar a Flash en las llamadas rutinarias. Pro cuesta 3 veces más que Flash en todos los apartados, y 3,1 veces más en las entradas con acierto de caché. Si no has vuelto a probar Flash desde la actualización de postentrenamiento 0731, dirige una parte del tráfico rutinario al modelo. Las diferencias y compromisos de elegir modelo están explicados en nuestra comparativa entre V4 Flash y V4 Pro.
  5. Si te marchas, la migración puede ser pequeña. En clientes compatibles con OpenAI, cambiar de proveedor puede reducirse a modificar la URL base y el ID del modelo. Los hosts externos y las plataformas de relay aplican sus propias tarifas: DataLLM Lab documentó hosts que ofrecían V4 Pro por unos $1.74/$3.48 por cada millón de tokens incluso antes de esta subida. Compara la tarifa efectiva, no el precio del escaparate.

La decisión, resumida en una tabla:

Tu perfilRecomendación
Zona horaria de EE. UU. y tráfico de agentes con mucho uso de cachéQuédate: las tarifas valle y la vía de caché, unas 30 veces más barata, mantienen el coste de entrada al mínimo
Zona horaria europea y trabajos por lotes matinalesQuédate y cambia el horario: la exposición a las horas punta es evitable
Trabajo de programación sensible a la calidad, solo en horas punta y con ProReplantéatelo: la salida de Pro en horas punta ($3.96) sigue por debajo de Terra ($12), pero la diferencia es ahora de 3 veces, no de las 14 veces que había antes del 16 de agosto
Cargas sin caché y de una sola interacciónQuédate: el aumento de 1,5–2,3 veces en horas valle es el menor de toda la tabla

Preguntas frecuentes

¿Cuándo entraron exactamente en vigor los nuevos precios de DeepSeek?

El 16 de agosto de 2026 a las 16:00 UTC —medianoche del 17 de agosto en Pekín—, según el hilo del anuncio y la auditoría de 650 llamadas de r/DeepSeek. La página oficial de precios ya mostraba las nuevas tablas ese mismo día.

¿Cuánto aumentará mi factura de DeepSeek?

Una carga sin caché pasa a costar aproximadamente 1,5 veces más en horas valle, mientras que una carga medida con una tasa de aciertos del 98 % sube 2,7 veces. En horas punta, esas cifras se duplican, hasta llegar a 12 veces más en las entradas Pro con acierto de caché. La tabla de multiplicadores anterior incluye todas las parejas de tarifas.

¿Qué horas son punta en Estados Unidos?

Este de EE. UU.: 21:00–00:00 y 02:00–06:00. Costa oeste de EE. UU.: 18:00–21:00 y 23:00–03:00. El horario laboral estadounidense normal queda completamente dentro de las franjas valle.

¿Siguen disponibles deepseek-chat y deepseek-reasoner?

No. Los alias heredados llegaron a su fecha límite de retirada el 24 de julio de 2026, según el historial de ID de modelos de BenchLM. Las nuevas integraciones deben llamar a deepseek-v4-flash o deepseek-v4-pro.

¿DeepSeek sigue siendo más barato que GPT-5.6 y Claude?

En horas valle, sí: la salida de Flash cuesta un 45 % menos que la de GPT-5.6 Luna y 18 veces menos que la de Terra. En horas punta, la salida de Luna cuesta $1.20/M, por debajo de los $1.32/M de Flash. La respuesta depende, por tanto, de cuándo se ejecute tu tráfico.