Si estás valorando Grok 4.7 para un flujo de trabajo con API, el titular es correcto, pero se queda corto: la documentación de xAI fija la tarifa de la API estándar en $2 por cada millón de tokens de entrada y $6 por cada millón de tokens de salida. El modelo está disponible oficialmente con el identificador grok-4.7, aunque el gateway utilizado, el enrutamiento regional en EE. UU., la caché y el uso de contexto largo pueden cambiar lo que acabes pagando.
La respuesta breve: el acceso es real, pero $2/$6 solo es la referencia directa
Grok 4.7 no es un rumor ni una simple etiqueta para el chat. La página oficial de xAI, actualizada el 21 de septiembre de 2026, documenta el acceso mediante Responses API y Chat Completions. También especifica una ventana de contexto de 500.000 tokens, entradas de texto e imagen, salidas de texto, llamadas a funciones, búsqueda web, búsqueda en X y ejecución de código.
La tarifa de $2/$6 está confirmada específicamente como precio directo estándar:
| Ruta o modalidad de uso | Entrada | Salida | Qué significa |
|---|---|---|---|
| API directa de xAI, estándar | $2.00/M | $6.00/M | Referencia oficial para grok-4.7 |
| Endpoint regional de xAI en EE. UU. | $2.20/M* | $6.60/M* | Recargo del 10 % sobre el precio estándar |
| Listado estándar de OpenRouter | $1.60/M | $4.80/M | Precio del gateway/proveedor, no la tarifa directa de xAI |
| Promoción de Vercel AI Gateway | $1.20/M | $3.60/M | Precio promocional mostrado hasta el 27 de septiembre de 2026 |
*Las cifras para EE. UU. se calculan aplicando el recargo del 10 % documentado por xAI; no aparecen como precios destacados independientes. Para presupuestar el uso directo de xAI, parte de $2/$6. Considera las tarifas de los gateways como precios específicos de cada ruta y comprueba sus condiciones y disponibilidad.
Qué ofrece oficialmente xAI
El identificador oficial del modelo es grok-4.7. xAI muestra tres formas compatibles de acceso: su SDK, un cliente compatible con OpenAI apuntando a https://api.x.ai/v1 y una petición POST directa a https://api.x.ai/v1/responses.
Estas son las especificaciones documentadas, especialmente relevantes para agentes:
| Especificación | Valor documentado por xAI |
|---|---|
| Ventana de contexto | 500.000 tokens |
| Fecha de corte del conocimiento | Mayo de 2026 |
| Niveles de razonamiento | Low, medium, high, xhigh |
| Razonamiento predeterminado | High |
| Entrada | Texto e imágenes |
| Salida | Texto |
| APIs | Responses API y Chat Completions |
| Herramientas | Llamadas a funciones, búsqueda web, búsqueda en X y ejecución de código |
| Precio estándar de entrada | $2/M tokens |
| Precio estándar de salida | $6/M tokens |
El ejemplo de la documentación pide al modelo localizar y explicar un error en una función de JavaScript que calcula la mediana. Eso demuestra que la API está correctamente conectada, no la calidad de su programación. La página no incluye una tabla de benchmarks independiente, resultados de latencia, compromiso de disponibilidad ni tasa de tareas completadas.
Precios de la API de Grok 4.7: los detalles que pueden cambiar la factura
API directa frente a precios de gateways
La página del modelo en OpenRouter muestra $1.60/M para la entrada, $4.80/M para la salida y $0.40/M para las lecturas desde caché. La página de AI Gateway de Vercel aplica una reducción promocional del 40 %, hasta $1.20/M y $3.60/M, con una promoción que termina el 27 de septiembre de 2026.
Los precios de los gateways pueden incluir promociones o reflejar un enrutamiento distinto. Compara el coste completo de cada petición, no solo la tarifa destacada por token.
Enrutamiento regional en EE. UU.
xAI documenta https://us.api.x.ai/v1 como endpoint regional para EE. UU., con un recargo del 10 % sobre el uso de tokens. Aplicado a la tarifa estándar, el cálculo da $2.20/M de entrada y $6.60/M de salida.
La caché importa cuando repites prompts de un repositorio
xAI recomienda utilizar un identificador para dirigir la caché: prompt_cache_key en Responses API o la cabecera x-grok-conv-id en Chat Completions. Enrutar los turnos repetidos al mismo servidor hace que las coincidencias de caché sean más fiables, mientras que una petición sin caché puede hacer que pagues el precio completo de entrada.
La tabla de precios de Grok 4.7 en Cursor ofrece una referencia para servicios alojados: $0.50/M por lecturas desde caché en el nivel estándar, frente a $2/M por entradas sin caché. Es el modelo de facturación de Cursor, no una garantía de que la API directa de xAI aplique exactamente el mismo precio a la caché.
El contexto largo no sale gratis
Cursor indica 256k como contexto estándar y 500k como máximo. Su documentación señala que las peticiones de más de 256k aplican tarifas superiores para contexto largo: el uso estándar cuesta 2× y el uso Fast, 3×.
xAI confirma que admite 500k de contexto, pero no publica un multiplicador específico para contexto largo en el resumen del modelo. Comprueba las reglas de facturación de tu ruta antes de dar por hecho que 500k de contexto se cobran a la tarifa base.
Qué demuestra —y qué no— la evidencia publicada sobre programación
La propuesta documentada de Grok 4.7 está orientada al trabajo prolongado con agentes. xAI, Cursor y OpenRouter lo presentan para programación, ingeniería de software de larga duración, autoverificación y contextos amplios. La documentación del modelo de Cursor incluye búsqueda y edición de archivos, comandos de shell, control del navegador, acceso web, generación de imágenes y preguntas de aclaración dentro de su entorno de agentes.
Estas funciones justifican probarlo en un proyecto de programación, pero no demuestran que corrija mejor los errores, supere más pruebas o resulte más rentable por tarea. Ejecuta una prueba reproducible sobre un repositorio y registra las tareas completadas, los reintentos, las llamadas a herramientas, el tiempo total y los tokens consumidos.
El nivel de esfuerzo va de low a xhigh, con high como valor predeterminado. Un nivel más alto puede tardar más y modificar el consumo; antes de calcular costes de producción, comprueba cómo informa y factura el razonamiento tu proveedor.
El trabajo de conocimiento actual necesita recuperación de información
Grok 4.7 admite imágenes, ofrece búsqueda web y en X, y tiene una fecha de corte del conocimiento situada en mayo de 2026. Para investigar temas actuales, utiliza recuperación de información o búsqueda y evalúa la precisión de las citas, la cobertura de fuentes, el número de revisiones y el tiempo de corrección humana, en lugar de juzgar solo la redacción.
Cuánto costarían dos ejemplos de bucles de agente
Para la tarifa directa estándar, puedes usar este cálculo sencillo:
cost = (input_tokens / 1,000,000 × $2) + (output_tokens / 1,000,000 × $6)
| Petición de ejemplo | Coste de entrada | Coste de salida | Coste de tokens |
|---|---|---|---|
| 100k de entrada + 20k de salida | $0.20 | $0.12 | $0.32 |
| 500k de entrada + 50k de salida | $1.00 | $0.30 | $1.30 |
El segundo ejemplo usa la tarifa base como referencia. El coste puede aumentar por el recargo regional, los multiplicadores de contexto largo en una ruta alojada, los prompts repetidos sin caché, las reglas de razonamiento específicas del proveedor y las peticiones adicionales. Un agente de programación que realice diez peticiones puede costar mucho más que una única petición de 500k tokens.
Cómo comprobar el acceso antes de comprometerte
- Usa el identificador oficial del modelo. Envía
grok-4.7, no un alias inventado ni un nombre específico de un gateway. - Empieza con una petición pequeña a Responses API. xAI documenta
POST https://api.x.ai/v1/responsescon autenticación Bearer y una entrada de texto. - Registra el consumo de la respuesta y de la factura. Guarda los tokens de entrada y salida, el uso de razonamiento si aparece, las llamadas a herramientas y el importe facturado.
- Prueba la caché por separado. Repite el mismo prompt de sistema largo con
prompt_cache_keyy compara la facturación de entrada de la segunda petición. - Comprueba tu nivel de contexto. Haz una ejecución por debajo de 256k tokens y otra por encima si tu aplicación necesita trabajar con repositorios extensos.
- Elige el endpoint de forma deliberada. Usa el endpoint estándar para medir la economía de referencia; recurre al endpoint regional de EE. UU. solo cuando sus ventajas de ubicación de datos compensen el recargo del 10 %.
- Trata los precios de los gateways como productos distintos. Comprueba la fecha de finalización de la promoción, el enrutamiento del proveedor, el comportamiento de respaldo, las condiciones de conservación de datos y los cargos específicos de la ruta antes de usar $1.20/$3.60 o $1.60/$4.80 en una previsión.
- Mide las tareas terminadas. En programación, registra las pruebas superadas, los reintentos, las llamadas a herramientas, el tiempo total y el coste por cambio aceptado.
Preguntas frecuentes sobre la API de Grok 4.7
¿Grok 4.7 está disponible mediante la API oficial?
Sí. La documentación de xAI incluye el modelo grok-4.7 para Responses API y Chat Completions, junto con ejemplos para el SDK, clientes compatibles con OpenAI y cURL.
¿Está confirmado el precio de $2 de entrada y $6 de salida?
Sí, para la tarifa estándar de la API directa de xAI documentada el 21 de septiembre de 2026. El endpoint regional de EE. UU. añade un 10 %, mientras que los gateways pueden mostrar precios o promociones diferentes.
¿Grok 4.7 es bueno para programar?
Es un candidato razonable para probarlo en agentes de programación de larga duración, ya que su diseño documentado incluye uso de herramientas, razonamiento ajustable, indicaciones para compactar el contexto y hasta 500k de contexto. Las fuentes disponibles no demuestran de forma independiente que supere a otros modelos en programación, así que pruébalo con tus propias tareas de repositorio.
¿Grok 4.7 tiene una ventana de contexto de 500k?
Sí. xAI indica 500.000 tokens. Cursor describe por separado 256k como contexto estándar y 500k como nivel máximo, con precios superiores por encima de 256k.
¿Grok 4.7 Fast está disponible mediante la API pública?
No. La documentación de Grok 4.7 de xAI describe Grok 4.7 Fast como el mismo modelo ejecutado en una infraestructura más rápida y con el doble de las tarifas estándar, pero indica que no está disponible mediante la API pública de xAI. Sí aparece listado para Cursor y Grok Build.
La decisión: pruébalo, pero presupuesta la ruta que realmente vayas a utilizar
El acceso a la API de Grok 4.7 y la referencia de $2/$6 están confirmados; su ventaja programando, no. Si tu carga de trabajo supera los 256k tokens, depende de contexto de repositorio sin caché, utiliza enrutamiento en EE. UU. o genera muchas llamadas de razonamiento, el coste por tarea completada puede ser muy distinto. Haz primero una prueba medida antes de migrar trabajo de producción.