Si el presupuesto manda, elegiría DeepSeek V4 Pro; si lo prioritario es la latencia, Grok. Esa división se mantuvo en las siete tareas que ejecuté mediante ambas API. Hay una salvedad importante: la propia página de precios de DeepSeek avisa de una subida considerable, que reduciría buena parte de la ventaja de coste sobre la que se apoya esta recomendación.
Qué modelos estás comparando realmente en agosto de 2026
Los dos modelos cambiaron de identidad durante la semana previa a esta comparativa. Grok 4.6 ocupa ahora la posición Latest en la documentación de modelos de xAI, donde se presenta como el buque insignia «para código y todo lo demás». DeepSeek V4 Pro, por su parte, se sirve actualmente como el snapshot DeepSeek-V4-Pro-0813. Ninguno de esos cambios aparece en el ID del modelo de la API.
La cadena de versión de DeepSeek solo figura en la fila MODEL VERSION de su página de precios. La API continúa respondiendo al identificador simple deepseek-v4-pro, sin sufijo de fecha. Por tanto, una petición enviada hoy y otra enviada en julio pueden verse idénticas en tus registros aunque estén llegando a pesos distintos.
Esta es la comparativa completa de especificaciones y precios, obtenida de la página de precios de xAI y la página de precios de DeepSeek el 13 de agosto de 2026:
| Grok 4.6 | DeepSeek V4 Pro (0813) | |
|---|---|---|
| Ventana de contexto | 500K | 1M |
| Salida máxima | No publicada | 384K |
| Entrada / 1M | $2.00 | $0.435 |
| Entrada en caché / 1M | $0.50 | $0.003625 |
| Salida / 1M | $6.00 | $0.87 |
| Tarifa por contexto largo | 2x en todas las tarifas con prompts de ≥200K | Ninguna |
| Entrada de imagen | Sí | No |
| Llamadas a herramientas | Sí | Sí |
| Razonamiento | Configurable | Thinking / non-thinking |
| Fecha de corte de conocimientos | 1 de febrero de 2026 | No publicada |
Grok 4.6 mantiene sin cambios las tarifas principales de Grok 4.5: $2.00 de entrada y $6.00 de salida. El único precio que se ha movido es el de la entrada en caché: la misma tabla de xAI indica $0.30 para Grok 4.5 y $0.50 para Grok 4.6, lo que encarece la reutilización de caché un 67% en el modelo nuevo.
Los gateways de terceros aún sirven Grok 4.5
Que esté disponible en la documentación de xAI no implica que puedas obtenerlo en cualquier plataforma donde compres tokens. En el gateway usado para estas pruebas, grok-4.6 devolvía un error model_not_found, mientras que los alias grok-latest y grok resolvían ambos a grok-4.5-build. Si accedes a Grok a través de un revendedor en lugar de la API propia de xAI, comprueba a qué modelo resuelve realmente el alias antes de dar por sentada una versión.
Ese retraso también explica que las mediciones de abajo se hicieran con grok-4.5 y no con 4.6. Como ambas versiones tienen el mismo precio de entrada y salida, las conclusiones de coste son trasladables; los resultados de precisión por tarea corresponden a 4.5.
El seguimiento de instrucciones es donde se separan de verdad
En siete tareas verificadas mecánicamente, seis terminaron empatadas y una marcó una diferencia rotunda. La prueba diferenciadora pedía exactamente cuatro líneas, cada una terminada con una descripción de exactamente cinco palabras. DeepSeek V4 Pro acertó en 5 de 5 intentos; Grok, en 0 de 5.
Los fallos de Grok no fueron la repetición de un mismo error. En dos ejecuciones mostró una llamada de herramienta web_search sin procesar como texto del cuerpo, en vez de dar una respuesta. Una de ellas decía, completa: «Necesito información precisa sobre las cuatro etapas de un despliegue canary. Déjame buscarlo». Dos ejecuciones respetaron la estructura de cuatro líneas, pero contaron mal las descripciones: una tenía cuatro palabras y la otra seis. En otra ejecución alcanzó 130 segundos y 10,357 tokens de salida, y devolvió 331 líneas.
La filtración probablemente se debe al gateway y no al modelo: convierte un prompt de 6 tokens en 201 tokens de entrada reportados, algo que apunta a un preámbulo inyectado que declara las herramientas del lado del servidor de xAI. Los errores de conteo de palabras son otra cuestión. Esas ejecuciones respondieron con normalidad y, aun así, incumplieron la restricción.
Metodología: deepseek-v4-pro y grok-4.5 a través del mismo gateway compatible con OpenAI, usando la configuración predeterminada. Se realizó una ejecución por tarea, salvo la prueba de formato, que se ejecutó cinco veces para cada modelo. Todas las tareas tenían una respuesta verificable mecánicamente, así que la puntuación no requirió ningún modelo juez. Las seis tareas empatadas aparecen por nombre en la tabla de costes inferior.
Ambos aceptaron una premisa falsa
La séptima tarea introducía dos errores en el prompt: que DeepSeek V4 Pro tiene una ventana de contexto de 128K y que Grok 4.6 se lanzó en enero de 2026 con 2M de contexto. Después preguntaba cuál usar para un corpus de 900,000 tokens. Ninguno de los dos modelos cuestionó las cifras. Ambos razonaron correctamente a partir de datos erróneos y recomendaron Grok con seguridad.
Si pegas especificaciones desactualizadas en un prompt y pides una recomendación, ambos modelos te entregarán una respuesta errónea pero bien argumentada, en lugar de corregir los datos de partida.
Grok generó menos tokens de salida, pero costó 5,7x más
En las seis tareas completadas por ambos modelos, Grok produjo 5,275 tokens de salida frente a los 6,331 de DeepSeek: un 17% menos. Sin embargo, aplicando las tarifas oficiales de salida de cada uno, esas mismas respuestas costaron $0.0317 con Grok y $0.0055 con DeepSeek. La diferencia de precio fue de 5,7x a favor de DeepSeek.
| Tarea | Tokens de DeepSeek | Tokens de Grok | Coste de DeepSeek | Coste de Grok |
|---|---|---|---|---|
| JSON estricto | 147 | 219 | 0.013¢ | 0.131¢ |
| Fusionar rangos | 384 | 416 | 0.033¢ | 0.250¢ |
| Aguja de 56K | 181 | 174 | 0.016¢ | 0.104¢ |
| Aritmética de precios | 520 | 647 | 0.045¢ | 0.388¢ |
| Parser de duraciones | 4,087 | 2,611 | 0.356¢ | 1.567¢ |
| Agregación SQL | 1,012 | 1,208 | 0.088¢ | 0.725¢ |
| Total | 6,331 | 5,275 | 0.551¢ | 3.165¢ |
La eficiencia de tokens existe, pero no basta: Grok fue más conciso en el parser de duraciones, con 2,611 tokens frente a 4,087, y aun así esa respuesta costó cuatro veces más.
Llevado a un mes de trabajo, el cálculo es fácil de repetir: 1,000 solicitudes con 50,000 tokens de entrada sin caché y 3,000 tokens de salida cada una suman 50M de entrada y 3M de salida. En Grok 4.6, son $100.00 más $18.00: $118.00. En DeepSeek V4 Pro, $21.75 más $2.61: $24.36.
Grok fue más rápido en las seis tareas, y la ventaja aumentó con la duración de la tarea: 48.8 segundos frente a 83.3 en el parser de duraciones, frente a 3.7 y 5.4 en la tarea JSON. Son ejecuciones individuales en un gateway compartido, así que conviene tratar las diferencias pequeñas como ruido y las grandes como una indicación de tendencia.
Dos reglas de facturación que no aparecen en las tablas
Hay dos mecanismos de precios que pesan más en la factura real que las tarifas principales, y ninguno aparece como columna en una tabla de especificaciones.
El umbral de contexto largo de xAI es un precipicio, no una escala gradual. Toda solicitud cuyo prompt llegue a 200,000 tokens se factura al doble para cada token de esa petición, no solo para los que superen el límite. Un prompt de 199,000 tokens cuesta $0.398 de entrada; uno de 201,000 tokens, $0.804. Superar el límite en un 1% duplica la factura.
La caché de DeepSeek cuesta prácticamente nada. Un acierto de caché vale $0.003625 por cada 1M de tokens de entrada, frente a los $0.50 de Grok 4.6: alrededor de 138 veces menos. En trabajo repetido sobre una base de código estable, esa es la cifra que decide la factura. Un desarrollador en Hacker News comentó:
La API oficial de DeepSeek alcanza una tasa de aciertos de caché superior al 99% si la usas de forma continua sobre la misma base de código durante sesiones largas, así que resulta mucho más barata que los modelos frontier. Tengo un ejemplo de una sesión de 200M tokens en claude code.
La contrapartida es que las tarifas de DeepSeek son explícitamente temporales. La página de precios incluye una nota: «Planeamos subir próximamente el precio global de los servicios de la API de DeepSeek, y se espera un aumento significativo». Un análisis en Hacker News de los precios promocionales de DeepSeek sitúa las tarifas previas al descuento en $1.74 de entrada y $3.48 de salida. El cálculo es coherente, ya que $0.435 y $0.87 son exactamente una cuarta parte de esas cifras, pero DeepSeek no ha publicado las condiciones de la promoción.
Si la subida se aplica en esos niveles, el escenario mensual anterior pasaría de $24.36 a $97.44, frente a los $118.00 de Grok. La brecha en el precio de salida se reduciría de 6.9x a alrededor de 1.7x, y una decisión basada únicamente en el precio dejaría de ser tan evidente.
Cuál elegir
Elige DeepSeek V4 Pro para grandes volúmenes, costes ajustados y trabajo con contexto recurrente: procesamiento por lotes, sesiones largas de programación agéntica sobre un mismo repositorio o cualquier caso que supere aproximadamente los 200K tokens por prompt, donde el umbral de Grok duplica la tarifa. La ventana de contexto de 1M y la caché casi gratuita juegan a tu favor, y además mantuvo la restricción de formato exacto en los cinco intentos. Puedes ejecutarlo directamente desde la página de la API de DeepSeek V4 Pro.
Elige Grok 4.6 para trabajo multimodal y sensible a la latencia. Grok fue más rápido en todas las tareas, aunque tanto ese resultado como el de formato se midieron con 4.5, no con 4.6. Acepta imágenes como entrada, algo que DeepSeek no hace, y al menos publica una fecha de corte de conocimientos: el 1 de febrero de 2026. Si usas un gateway, confirma que recibes 4.6 y no 4.5. Grok en AIReiter y cualquier otro revendedor dependen de la versión conectada aguas arriba.
No elijas ninguno basándote en un precio anunciado. La propia nota de DeepSeek convierte su ventaja actual en un objetivo móvil, y la tarifa de entrada en caché de Grok ya subió un 67% entre 4.5 y 4.6. Antes de comprometer una carga de trabajo, repite los cálculos anteriores con las páginas de precios vigentes.
Preguntas frecuentes
¿Grok 4.6 está realmente disponible?
Sí. A fecha de 13 de agosto de 2026, Grok 4.6 aparece en la documentación de modelos de xAI en la posición Latest, con precios publicados de $2.00 de entrada y $6.00 de salida por 1M de tokens, además de una ventana de contexto de 500K. Los gateways de terceros pueden seguir dirigiendo grok-latest a Grok 4.5.
¿Qué es DeepSeek-V4-Pro-0813?
Es la cadena de versión del modelo que DeepSeek sirve actualmente tras el endpoint de API deepseek-v4-pro, indicada en la fila MODEL VERSION de la página oficial de precios. El ID de la API no lleva sufijo de fecha, por lo que el snapshot puede cambiar sin que cambie tu solicitud.
¿Qué modelo tiene la ventana de contexto más grande?
DeepSeek V4 Pro, con 1M de tokens frente a los 500K de Grok 4.6. DeepSeek también publica una salida máxima de 384K; xAI no publica una cifra máxima de salida para Grok 4.6.
¿DeepSeek V4 Pro es más barato que Grok 4.6?
Con los precios de lista del 13 de agosto de 2026, sí: es 4.6x más barato en entrada y 6.9x en salida. La página de precios de DeepSeek advierte de un aumento significativo y, con las tarifas previas a la promoción identificadas por desarrolladores, la diferencia de salida bajaría a aproximadamente 1.7x.
¿Cuál sigue las instrucciones con mayor fiabilidad?
En la única prueba que los diferenció, DeepSeek V4 Pro cumplió una restricción de formato exacto en 5 de 5 intentos, mientras que Grok lo hizo en 0 de 5. Ambos modelos fallaron al no cuestionar especificaciones falsas introducidas en un prompt.
Lectura relacionada: GPT-5.6 Luna vs DeepSeek V4 Pro