AIREITER

API de Grok 4.6: precios, benchmarks y novedades

Última actualización: 2026-08-13 02:28:19

Grok 4.6 llegó el 12 de agosto de 2026, cinco días después de la fecha que sugerían las «dos semanas» de Elon Musk. Sobre el papel, todo sigue igual: $2.00 por millón de tokens de entrada, $6.00 por millón de tokens de salida y 500K de contexto, exactamente las mismas condiciones que Grok 4.5. Pero la factura cuenta otra historia. El input en caché cuesta un 67% más que en 4.5 y las mediciones independientes muestran que el modelo necesita más tokens para completar el mismo trabajo.

Qué llegó el 12 de agosto

El ID del modelo es grok-4.6 y las notas de lanzamiento de SpaceXAI sitúan su disponibilidad en la API el 12 de agosto de 2026. Estas son sus especificaciones documentadas:

PropiedadGrok 4.6
ID del modelogrok-4.6
Contexto500K tokens
EntradaTexto e imagen
SalidaSolo texto, sin límite de salida indicado
Nivel de razonamientolow, medium, high (predeterminado), xhigh
Fecha de corte del conocimiento1 de febrero de 2026
Entrada de las notas de lanzamiento de SpaceXAI fechada el 12 de agosto de 2026 que anuncia Grok 4.6 en la API de xAI, con su ventana de contexto y precios

Dos de esas filas son nuevas. xhigh añade un cuarto nivel de razonamiento que Grok 4.5 no ofrece: 4.5 llega como máximo a high. Además, la documentación incorpora ahora una fecha de corte del conocimiento del 1 de febrero de 2026, un dato relevante si estabas derivando preguntas fechadas para evitar el punto ciego del modelo.

El catálogo de modelos presenta Grok 4.6 como el buque insignia para código y chat. En la barra lateral aparece con la etiqueta Latest y la página está fechada el 12 de agosto de 2026. Grok 4.5 no ha sido retirado: sigue apareciendo en la página de precios con sus propias tarifas.

Documentación para desarrolladores de SpaceXAI que muestra Grok 4.6 con la etiqueta New, 500k de contexto y precios de $2.00 de entrada y $6.00 de salida

La distribución fue amplia desde el primer día. El anuncio de SpaceXAI menciona Cursor y Grok Build, ambos con el doble de uso incluido durante la primera semana, además de la API y socios como OpenRouter, Vercel y Cloudflare. También habla de una variante rápida que cuesta el doble; esa variante todavía no tiene una fila propia en la página pública de precios, así que conviene entender el dato de 2x como una cifra del anuncio, no como una tarifa publicada.

Precios de Grok 4.6: mismo precio visible, caché más cara

Las tarifas de entrada y salida se mantienen sin cambios respecto a Grok 4.5. La del input en caché, no.

Tarifa por 1M de tokensGrok 4.5Grok 4.6
Entrada (menos de 200K)$2.00$2.00
Entrada en caché (menos de 200K)$0.30$0.50
Salida (menos de 200K)$6.00$6.00
Entrada / caché / salida (200K+)$4.00 / $0.60 / $12.00$4.00 / $1.00 / $12.00
Gráfico de barras agrupadas que compara las tarifas de entrada, entrada en caché y salida de Grok 4.5 y Grok 4.6 con menos de 200K de contexto

El input en caché pasa de un descuento del 85% a uno del 75%: son 20 céntimos más por millón de tokens en la partida que crece con los pasos de un agente, no con el número de tareas. Un sistema de pruebas que reproduzca 50M de tokens en caché al día paga $15.00 con 4.6 frente a $9.00 con 4.5.

La regla para contextos largos no cambia y sigue siendo una fuente habitual de sorpresas. Cuando el prompt de una petición alcanza los 200K tokens, todos los tokens de esa petición se facturan con la tarifa superior: una llamada de 210K tokens cuesta $4.00 por millón de tokens de entrada en todo el request, no una mezcla de los dos tramos. El listado público de modelos de OpenRouter muestra las mismas tarifas y el mismo salto a partir de 200K, así que usar una ruta de terceros no altera las cuentas.

En qué benchmarks oficiales gana y pierde Grok 4.6

SpaceXAI publicó una comparativa de diez filas frente a Grok 4.5, GPT-5.6 Sol Max y Fable 5 Max. Grok 4.6 consigue la mejor puntuación en tres: GDPVal-AA v2 (1753), AA-Briefcase (1577) y Harvey LAB (15.8%). En las otras siete queda por detrás. Estas son las ocho filas más relevantes para decidir rutas:

Tabla de evaluaciones oficial de SpaceXAI que compara Grok 4.6 con Grok 4.5, GPT-5.6 Sol y Fable 5 en diez benchmarks
EvaluaciónGrok 4.6Grok 4.5GPT-5.6 SolFable 5
AA Intelligence Index61566162
GDPVal-AA v21753152617281741
CursorBench v3.269.9%66.7%67.2%70.5%
DeepSWE v1.165.9%54%73%70%
FrontierCode v1.161.3%56.6%60.6%63.6%
APEX-Agents57.5%47.1%56.7%59.2%
Terminal-Bench v3.026%15.7%34.6%34.1%
AA-Briefcase1577131315021574

Terminal-Bench es la diferencia que merece una segunda lectura. Grok 4.6 obtiene un 26%, frente al 34.6% de GPT-5.6 Sol y el 34.1% de Fable 5: queda tercero, a ocho puntos, en la prueba que más se parece a un agente manejando un shell. DeepSWE cuenta una historia similar con otras cifras: 65.9% frente al 73% de Sol. Si tu carga de trabajo depende de agentes orientados al terminal, la propia tabla del fabricante deja claro que este no es el modelo líder.

La mejora frente a Grok 4.5, eso sí, es real y consistente. Todas las filas suben, y APEX-Agents pasa del 47.1% al 57.5%, mientras que Terminal-Bench mejora del 15.7% al 26%, en ambos casos más de diez puntos. SpaceXAI atribuye el avance a una fase adicional de entrenamiento más larga, trayectorias SFT regeneradas y RL agéntico en entornos de programación y trabajo de conocimiento. Hay un dato que el anuncio nunca proporciona: el número de parámetros. La cifra de 2 trillones asociada a este modelo procede de Musk, no del lanzamiento.

El coste real de esa inteligencia

Las tablas del fabricante muestran las puntuaciones, pero no cuánto cuesta obtenerlas. Artificial Analysis publica ambas cosas, y su medición del 13 de agosto deja al descubierto el verdadero intercambio de Grok 4.6.

Medido en el mismo índiceGrok 4.5 (high)Grok 4.6 (high)
Intelligence Index56 (#16 de 184)61 (#6 de 184)
Velocidad de salida56.9 tokens/s (#102)67.6 tokens/s (#74)
Tokens de salida generados60M72M
Coste de la evaluación completa$579.21$1,068.47
Gráfico de barras que compara el coste de ejecutar el Artificial Analysis Intelligence Index en Grok 4.5 y Grok 4.6

Cinco puntos de inteligencia cuestan 1.8x. Las tarifas anunciadas son idénticas, pero la misma batería de benchmarks salió $489 más cara: en parte por la verbosidad —72M de tokens de salida frente a 60M— y en parte por el encarecimiento de la caché explicado arriba. Artificial Analysis no publica el desglose por partida de la ejecución, así que 1.8x es un total observado, no una fórmula que pueda reconstruirse.

La velocidad sí mejora: 67.6 tokens de salida por segundo frente a los 56.9 de 4.5. Eso lo lleva de la mitad inferior a aproximadamente la mediana de los 184 modelos de su categoría.

Lo que dijo Musk frente a lo que finalmente llegó

El nombre apareció por primera vez en una respuesta de tres palabras. El 18 de julio, en respuesta a @minchoi, Musk escribió: «Nuestro modelo de 2T, que es mejor que nuestro modelo de 1.5T en todos los sentidos, terminará el entrenamiento inicial la próxima semana. Podría superar a Kimi, pero con una velocidad y eficiencia de tokens cercanas a las de nuestro 1.5T (también conocido como Grok 4.5)». Cuando Andrew Curran le preguntó si se trataba de Grok 4.6, respondió: «Sí, Grok 4.6».

Hilo de Elon Musk en X que describe un modelo de 2T mejor que el Grok 4.5 de 1.5T, seguido de su respuesta de tres palabras que confirma el nombre Grok 4.6

El 24 de julio llegó el calendario: «Grok 4.6 en 2 semanas y Grok 4.7 en 4 semanas». Dos semanas después de esa fecha apuntaban aproximadamente al 7 de agosto; el modelo llegó el 12 de agosto, cinco días más tarde.

Publicación de Elon Musk en X que afirma que Grok 4.6 llegaría en 2 semanas y Grok 4.7 en 4 semanas, en respuesta a su gráfico de la frontera de Pareto de FrontierCode

Tres afirmaciones de esas publicaciones no llegaron intactas al lanzamiento:

  • Los 2 trillones de parámetros siguen sin confirmarse. El anuncio de SpaceXAI, la documentación del modelo y las notas de lanzamiento no ofrecen ninguna cifra.
  • «Eficiencia de tokens cercana a la de Grok 4.5» contradice la medición de Artificial Analysis: 72M de tokens de salida frente a 60M en la misma evaluación.
  • «Podría superar a Kimi» sigue sin probarse frente a K3 de Moonshot en la tabla de SpaceXAI, que solo compara con GPT-5.6 Sol y Fable 5.

¿Deberías pasar de Grok 4.5 a Grok 4.6?

Sí, si vienes de Grok 4.5 y trabajas con agentes o tareas de conocimiento, pero comprueba la factura después de una semana en lugar de dar por hecho el resultado desde el día de la migración. Grok 4.5 sigue disponible con sus tarifas anteriores, así que el cambio se puede deshacer y merece la pena medirlo.

Haz el cambio ya si tu trabajo depende de agentes de horizonte largo o tareas de conocimiento: APEX-Agents sube 10.4 puntos, GDPVal-AA mejora 227 y la mayor velocidad de generación se acumula en ejecuciones de varios pasos. Quédate en 4.5 si tu tráfico usa mucho la caché y el precio es prioritario: el aumento del 67% en las lecturas de caché es un retroceso real, y las puntuaciones de 4.5 no bajaron cuando llegó 4.6. Para agentes centrados específicamente en el terminal, busca otra opción: la propia tabla de SpaceXAI coloca a Grok 4.6 ocho puntos por detrás de GPT-5.6 Sol y Fable 5.

Antes de cambiar una ruta de producción, comprueba estas tres cosas:

  1. Ten presente que ambos ID son alias. Las reglas de alias de SpaceXAI apuntan grok-4.6 a la versión estable más reciente y grok-4.6-latest a la versión más nueva. Solo un ID con formato <modelname>-<date> queda fijado; ni el catálogo de modelos ni OpenRouter ofrecen una variante 4.6 fechada. Hoy no existe un pin disponible para flujos reproducibles.
  2. Vuelve a probar el nivel de razonamiento. El nuevo nivel xhigh no es una mejora gratuita: consume más tokens en un modelo que ya ha demostrado ser más verboso que su predecesor. El nivel predeterminado high es la comparación equivalente con 4.5.
  3. Confirma que tu proveedor lo ofrece. Que SpaceXAI lo tuviera disponible el primer día no significa que estuviera disponible en todas partes. Al consultar /v1/models el 13 de agosto, tanto la API oficial como OpenRouter devolvieron grok-4.6, mientras que un endpoint de un revendedor compatible con OpenAI que probé todavía llegaba hasta grok-4.5 y rechazaba el nuevo ID con model_not_found. Verifica con tu propia clave que responde el ID exacto antes de dirigirle tráfico.

Preguntas frecuentes

¿Cuánto cuesta la API de Grok 4.6?

$2.00 por millón de tokens de entrada y $6.00 por millón de tokens de salida con menos de 200K de contexto, y $0.50 para la entrada en caché. Por encima de 200K tokens en el prompt, toda la petición se factura a $4.00 por la entrada, $1.00 por la entrada en caché y $12.00 por la salida. El anuncio menciona una variante rápida al doble de precio, pero todavía no aparece en la página pública de precios.

¿Es Grok 4.6 mejor que Grok 4.5?

En todos los benchmarks publicados por SpaceXAI, sí: obtiene 61 frente a 56 en el AA Intelligence Index, con las mayores mejoras en las evaluaciones de agentes. La medición independiente añade un matiz importante: generó 72M de tokens de salida frente a los 60M de Grok 4.5 en la misma evaluación, por lo que la misma tarea cuesta más.

¿Cuántos parámetros tiene Grok 4.6?

No se ha revelado. Musk describió el 18 de julio de 2026 un modelo de 2 trillones de parámetros y confirmó su nombre, pero los materiales de lanzamiento de SpaceXAI no indican el número de parámetros, detalles de arquitectura ni cuántos parámetros se activan por token.

¿Cuál es la ventana de contexto y la fecha de corte del conocimiento de Grok 4.6?

Cuenta con 500K tokens de contexto, acepta texto e imágenes como entrada y genera únicamente texto. La documentación indica una fecha de corte del conocimiento del 1 de febrero de 2026. Sin Web Search o X Search habilitados en el servidor, el modelo no puede acceder a acontecimientos posteriores.

¿Grok lo fabrica xAI o SpaceXAI?

Ambos nombres se refieren a la misma empresa. La documentación para desarrolladores se titula «SpaceXAI Docs» y el pie del anuncio todavía muestra X.AI LLC, después del movimiento bajo SpaceX en 2026. Los dominios x.ai y los ID de modelo grok-* no cambiaron.

¿Cuándo saldrá Grok 4.7?

No se ha anunciado ninguna fecha. La publicación de Musk del 24 de julio situaba Grok 4.7 aproximadamente cuatro semanas después, alrededor del 21 de agosto de 2026, y Grok 4.6 llegó cinco días después de su propia fecha implícita.

Lecturas relacionadas

Los precios, los ID de modelo y las cifras de los benchmarks se verificaron frente a la documentación de SpaceXAI, el anuncio de Grok 4.6 y Artificial Analysis el 13 de agosto de 2026.