El precio no se queda en los 10 $ por millón de tokens de entrada y 50 $ por millón de tokens de salida. Las solicitudes que superan los 272.000 tokens de entrada pasan a una tarifa superior para toda la petición. Además, el acceso a GPT-6 Astra todavía se está habilitando de forma progresiva: que aparezca en la documentación no significa necesariamente que tu cuenta ya pueda utilizarlo.
Precios de la API de GPT-6 Astra, de un vistazo
La siguiente tabla recoge las tarifas de la página oficial del modelo de OpenAI. La caché, las solicitudes con contexto largo y el modo Fast pueden cambiar bastante el coste real.
| Concepto | Detalle actual |
|---|---|
| ID del modelo en la API | gpt-6-astra |
| Entrada estándar | 10,00 $ / 1 M de tokens |
| Entrada en caché | 1,00 $ / 1 M de tokens |
| Escrituras en caché | 12,50 $ / 1 M de tokens |
| Salida estándar | 50,00 $ / 1 M de tokens |
| Ventana de contexto | 1.050.000 tokens |
| Salida máxima | 128.000 tokens |
| Fecha de corte del conocimiento | 30 de abril de 2026 |
| Entrada/salida | Entrada de texto e imágenes; salida de texto |
| Nivel gratuito de la API | No compatible |
| Disponibilidad actual | Despliegue progresivo para empresas con Trusted Access; el acceso más amplio a la API y a los planes de pago está previsto para los próximos días |
Estas cifras proceden de la página del modelo GPT-6 Astra y no de una estimación previa al lanzamiento. La guía del modelo de OpenAI indica que la ejecución de herramientas requiere la Responses API.
Tres reglas de tarificación que pueden disparar la factura
GPT-6 Astra tiene cuatro categorías de tokens, además de reglas específicas según la modalidad de servicio. Tratarlo como un endpoint sencillo de 10 $ de entrada / 50 $ de salida deja fuera el coste de crear cachés, procesar prompts largos y utilizar procesamiento de baja latencia.
Entrada estándar, entrada en caché y escrituras en caché
La entrada estándar cuesta 10 $ por millón, la entrada en caché 1 $ por millón y las escrituras en caché 12,50 $ por millón. Reutilizar un prompt puede salir barato después de la escritura inicial.
| Categoría de tokens | Tarifa estándar | Qué representa |
|---|---|---|
| Entrada no almacenada en caché | 10,00 $ / 1 M | Entrada nueva procesada por el modelo |
| Entrada en caché | 1,00 $ / 1 M | Entrada procesada previamente y servida desde la caché |
| Escritura en caché | 12,50 $ / 1 M | Entrada añadida a la caché del prompt |
| Salida | 50,00 $ / 1 M | Tokens generados en la respuesta |
No multipliques la ventana de contexto por la tarifa de entrada. Una ventana de contexto de 1,05 millones de tokens es un límite de capacidad, no una garantía de que todos los tokens se facturen a la tarifa base.
El umbral de 272.000 tokens se aplica a toda la solicitud
Cuando una solicitud contiene más de 272.000 tokens de entrada, OpenAI aplica el doble a las tarifas de entrada y caché y un multiplicador de 1,5x a las tarifas de salida para toda la petición. En la práctica, la modalidad de contexto largo cuesta 20 $ por millón de tokens de entrada sin caché, 2 $ por millón de tokens de entrada en caché, 25 $ por millón de escrituras en caché y 75 $ por millón de tokens de salida.
| Modalidad de la solicitud | Entrada | Entrada en caché | Escritura en caché | Salida |
|---|---|---|---|---|
| Hasta 272.000 tokens de entrada | 10 $ | 1 $ | 12,50 $ | 50 $ |
| Más de 272.000 tokens de entrada | 20 $ | 2 $ | 25 $ | 75 $ |
En una solicitud con 300.000 tokens de entrada, todos los tokens de entrada, caché y salida aplicables se facturan con las tarifas superiores de contexto largo; los primeros 272.000 no se cobran según la modalidad estándar.
Batch, Flex, Fast y las opciones de despliegue regional
OpenAI ofrece Batch y Flex al 50 % de las tarifas aplicables. Su guía del modelo indica que el modo Fast cuesta 2x las tarifas aplicables, no incluye un SLA de latencia y no está disponible con residencia de datos en la UE. El procesamiento Priority tampoco está disponible con residencia de datos en la UE.
| Modalidad | Entrada estándar | Salida estándar | Interpretación práctica |
|---|---|---|---|
| Standard | 10 $ / 1 M | 50 $ / 1 M | Modalidad directa predeterminada de la API |
| Batch o Flex | 5 $ / 1 M | 25 $ / 1 M | La mitad de la tarifa Standard aplicable |
| Fast | 20 $ / 1 M | 100 $ / 1 M | El doble de la tarifa Standard aplicable |
| Standard con contexto largo | 20 $ / 1 M | 75 $ / 1 M | Se aplica por encima de 272.000 tokens de entrada |
| Fast con contexto largo | 40 $ / 1 M | 150 $ / 1 M | 2x las tarifas de contexto largo |
La tabla muestra únicamente la entrada sin caché y la salida. Las tarifas de lectura y escritura de caché también siguen el multiplicador correspondiente a la modalidad de servicio.
Microsoft Foundry publica una tabla de despliegue independiente. Su anuncio de GPT-6 Astra recoge para Global Standard y contexto corto unas tarifas de 10 $ de entrada, 1 $ de entrada en caché, 12,50 $ de escrituras en caché y 50 $ de salida. U.S. Data Zone Standard aplica 11 $, 1,10 $, 13,75 $ y 55 $. Para contexto largo, la tabla indica 20 $/2 $/25 $/75 $ en Global y 22 $/2,20 $/27,50 $/82,50 $ en U.S. Data Zone. No traslades directamente las tarifas de OpenAI a un presupuesto de Azure.
Cuánto cuesta realmente una solicitud a Astra
Los ejemplos utilizan las tarifas directas de OpenAI en Standard, excluyen herramientas y reintentos, y clasifican los tokens como no almacenados en caché o en caché exactamente según se indica.
| Ejemplo de solicitud | Cálculo | Coste estimado de tokens |
|---|---|---|
| 100.000 tokens de entrada sin caché + 10.000 de salida | 0.1 × $10 + 0.01 × $50 | 1,50 $ |
| 200.000 tokens de entrada en caché + 20.000 de salida | 0.2 × $1 + 0.02 × $50 | 1,20 $ |
| 300.000 tokens de entrada sin caché + 30.000 de salida | 0.3 × $20 + 0.03 × $75 | 8,25 $ |
Comprueba el límite de 272.000 tokens antes de adoptar flujos de trabajo con contexto largo. La recuperación o compactación puede reducir el coste del modelo, aunque añade trabajo a la aplicación.
Escribir 200.000 tokens cuesta 2,50 $, mientras que una lectura posterior de esos 200.000 tokens desde la caché cuesta 0,20 $. La amortización de la caché depende de la frecuencia con la que reutilices el contenido.
En Microsoft Foundry, una solicitud de 100.000 tokens de entrada y 10.000 de salida en la tabla Global de contexto corto también cuesta 1,50 $ antes de herramientas o reintentos. La versión U.S. Data Zone cuesta 1,65 $: 0.1 × $11 + 0.01 × $55.
La guía de OpenAI afirma que Astra puede ofrecer un coste estimado por tarea completada inferior al de modelos anteriores, pero esa indicación no constituye una comparativa independiente de costes en producción. Mide en tus propios registros los tokens de entrada, los aciertos de caché, los tokens de salida, las llamadas a herramientas, los reintentos y las correcciones humanas.
Acceso, cuotas y la diferencia entre ChatGPT y la API
GPT-6 Astra se está habilitando progresivamente para empresas del Trusted Access Program. El acceso a la API y a los planes Plus, Pro, Business y Enterprise llegará en los próximos días. La documentación del proveedor OpenAI de OpenClaw también señala que el catálogo disponible para la cuenta determina si Astra está habilitado; añadir el nombre del modelo a la configuración no concede acceso.
Un usuario describió así el retraso en el despliegue:
“Son casi las 2 de la madrugada y me voy a dormir cabreado. Me pasé TODO EL DÍA esperando Astra. ... Y entonces me entero de que NI SIQUIERA PUEDO USARLO.” — @buildwithrajath, X
La página del modelo muestra estos límites de la API según el nivel de uso:
| Nivel | RPM | TPM | Límite de cola Batch |
|---|---|---|---|
| Free | No compatible | No compatible | No compatible |
| Tier 1 | 500 | 500.000 | 1.500.000 |
| Tier 2 | 5.000 | 1.000.000 | 3.000.000 |
| Tier 3 | 5.000 | 2.000.000 | 100.000.000 |
| Tier 4 | 10.000 | 4.000.000 | 200.000.000 |
| Tier 5 | 15.000 | 40.000.000 | 15.000.000.000 |
La tabla de precios de Astra corresponde únicamente a la API. La documentación citada no incluye créditos de API con los planes de ChatGPT, así que presupuestar el uso de Platform API por separado.
Comprobaciones de migración para agentes existentes
La guía del modelo de OpenAI destaca tres comprobaciones de migración:
- Modelo y API: establece
modelcomogpt-6-astra, verifica que el catálogo de la cuenta lo muestre y utiliza la Responses API para las llamadas a herramientas. - Parámetros de la solicitud: elige
low,medium,high,xhighomax; Astra no admitenone. Elimina los parámetros de muestreo y de log-probabilidad que no sean compatibles. - Caché y región: sustituye
prompt_cache_retentionporprompt_cache_options.ttl: "30m"al seguir la guía de migración de modelos antiguos de OpenAI. Después, vuelve a comprobar la configuración de Fast y Priority si utilizas residencia de datos en la UE.
La decisión de presupuesto: enruta según tus registros, no solo según el precio por token
GPT-6 Astra resulta más fácil de justificar en tareas largas, con muchas herramientas, costosas cuando fallan o bloqueadas por software que no ofrece una API limpia. No es la mejor opción predeterminada para prompts cortos y rutinarios si la tarifa de 50 $ por millón de tokens de salida no se traduce en menos reintentos o más trabajo completado correctamente.
- Prueba Astra primero en investigación con contexto largo, uso del ordenador, programación compleja y flujos de trabajo que atraviesen varias aplicaciones, especialmente cuando un fallo implique revisión o retrabajo.
- Mantén un modelo más barato como opción predeterminada para clasificación breve, extracción, redacción sencilla y transformaciones predecibles.
- Utiliza Batch o Flex cuando la latencia no sea importante y la carga de trabajo sea compatible con una tarifa del 50 %.
- No actives Fast por defecto. Con 20 $ de entrada y 100 $ de salida por millón de tokens antes de cualquier multiplicador de contexto largo, necesita aportar una mejora de rendimiento medible.
- Configura un límite estricto en 272.000 tokens. Genera una alerta antes de que una solicitud cruce el umbral, porque la tarifa superior se aplica a toda la petición.
Evalúa el coste por tarea aceptada a partir de tus propios registros, no solo del precio por token. Para otros cálculos de presupuesto, compara las hipótesis de la guía de precios de GPT-5.6 y la guía de precios de OpenRouter, pero no traslades sus reglas de tarifas directamente a Astra.
Preguntas frecuentes sobre los precios de la API de GPT-6 Astra
¿Cuánto cuesta GPT-6 Astra por cada millón de tokens?
La tarifa estándar es de 10 $ por millón de tokens de entrada sin caché, 1 $ por millón de tokens de entrada en caché, 12,50 $ por millón de escrituras en caché y 50 $ por millón de tokens de salida.
¿Qué ocurre por encima de 272.000 tokens de entrada?
Las tarifas de entrada y caché se duplican y la salida aumenta un 50 %: 20 $ de entrada, 2 $ de entrada en caché, 25 $ de escrituras en caché y 75 $ de salida por millón de tokens para toda la solicitud.
¿La entrada en caché es lo mismo que una escritura en caché?
No. La entrada en caché es un acierto de caché que se factura a 1 $ por millón en la modalidad Standard. Una escritura en caché crea o actualiza el prefijo almacenado y cuesta 12,50 $ por millón.
¿Batch o Flex reducen a la mitad el precio de GPT-6 Astra?
OpenAI sitúa Batch y Flex en el 50 % de las tarifas Standard aplicables, incluida la tarifa de contexto largo correspondiente cuando se supera ese umbral.
¿Merece la pena pagar el sobrecoste del modo Fast?
El modo Fast cuesta 2x las tarifas aplicables y no ofrece un SLA de latencia. Úsalo únicamente si tus registros demuestran una mejora suficiente de rendimiento o valor para el usuario que compense la prima.
¿Puedo utilizar GPT-6 Astra mediante la API hoy?
El acceso se está habilitando de forma progresiva y todavía no está abierto para todo el mundo. OpenAI indica una disponibilidad inicial para empresas con Trusted Access y señala que el acceso más amplio a la API llegará en los próximos días. Por tanto, el catálogo de la cuenta es la comprobación definitiva.
¿ChatGPT Plus incluye créditos para la API de GPT-6 Astra?
La documentación del modelo no promete créditos de API con un plan de ChatGPT. Considera por separado el acceso al modelo incluido en el plan de pago y la facturación por uso de Platform API, salvo que las condiciones de facturación explícitas de tu cuenta indiquen lo contrario.
¿Qué cambios requiere la API para utilizar GPT-6 Astra?
Establece model como gpt-6-astra, utiliza la Responses API para las llamadas a herramientas, selecciona un nivel de razonamiento compatible, elimina los parámetros de muestreo y log-probabilidad no admitidos y revisa el TTL de la caché y las reglas regionales del modo Fast. Antes de convertir Astra en el modelo predeterminado, registra los tokens, el comportamiento de la caché, las herramientas, los reintentos y las correcciones humanas durante una ejecución representativa.