AIREITER
DOCS APIPRECIOS
PLANTILLAS
  • AIReiter
  • Blog
  • Precios de la API de GPT-6 Astra (2026): costes, límites y acceso

Precios de la API de GPT-6 Astra (2026): costes, límites y acceso

Última actualización: 2026-09-04 00:37:39

El precio no se queda en los 10 $ por millón de tokens de entrada y 50 $ por millón de tokens de salida. Las solicitudes que superan los 272.000 tokens de entrada pasan a una tarifa superior para toda la petición. Además, el acceso a GPT-6 Astra todavía se está habilitando de forma progresiva: que aparezca en la documentación no significa necesariamente que tu cuenta ya pueda utilizarlo.

Precios de la API de GPT-6 Astra, de un vistazo

La siguiente tabla recoge las tarifas de la página oficial del modelo de OpenAI. La caché, las solicitudes con contexto largo y el modo Fast pueden cambiar bastante el coste real.

ConceptoDetalle actual
ID del modelo en la APIgpt-6-astra
Entrada estándar10,00 $ / 1 M de tokens
Entrada en caché1,00 $ / 1 M de tokens
Escrituras en caché12,50 $ / 1 M de tokens
Salida estándar50,00 $ / 1 M de tokens
Ventana de contexto1.050.000 tokens
Salida máxima128.000 tokens
Fecha de corte del conocimiento30 de abril de 2026
Entrada/salidaEntrada de texto e imágenes; salida de texto
Nivel gratuito de la APINo compatible
Disponibilidad actualDespliegue progresivo para empresas con Trusted Access; el acceso más amplio a la API y a los planes de pago está previsto para los próximos días

Estas cifras proceden de la página del modelo GPT-6 Astra y no de una estimación previa al lanzamiento. La guía del modelo de OpenAI indica que la ejecución de herramientas requiere la Responses API.

Precios de la API de GPT-6 Astra en la página oficial del modelo de OpenAI

Tres reglas de tarificación que pueden disparar la factura

GPT-6 Astra tiene cuatro categorías de tokens, además de reglas específicas según la modalidad de servicio. Tratarlo como un endpoint sencillo de 10 $ de entrada / 50 $ de salida deja fuera el coste de crear cachés, procesar prompts largos y utilizar procesamiento de baja latencia.

Entrada estándar, entrada en caché y escrituras en caché

La entrada estándar cuesta 10 $ por millón, la entrada en caché 1 $ por millón y las escrituras en caché 12,50 $ por millón. Reutilizar un prompt puede salir barato después de la escritura inicial.

Categoría de tokensTarifa estándarQué representa
Entrada no almacenada en caché10,00 $ / 1 MEntrada nueva procesada por el modelo
Entrada en caché1,00 $ / 1 MEntrada procesada previamente y servida desde la caché
Escritura en caché12,50 $ / 1 MEntrada añadida a la caché del prompt
Salida50,00 $ / 1 MTokens generados en la respuesta

No multipliques la ventana de contexto por la tarifa de entrada. Una ventana de contexto de 1,05 millones de tokens es un límite de capacidad, no una garantía de que todos los tokens se facturen a la tarifa base.

El umbral de 272.000 tokens se aplica a toda la solicitud

Cuando una solicitud contiene más de 272.000 tokens de entrada, OpenAI aplica el doble a las tarifas de entrada y caché y un multiplicador de 1,5x a las tarifas de salida para toda la petición. En la práctica, la modalidad de contexto largo cuesta 20 $ por millón de tokens de entrada sin caché, 2 $ por millón de tokens de entrada en caché, 25 $ por millón de escrituras en caché y 75 $ por millón de tokens de salida.

Modalidad de la solicitudEntradaEntrada en cachéEscritura en cachéSalida
Hasta 272.000 tokens de entrada10 $1 $12,50 $50 $
Más de 272.000 tokens de entrada20 $2 $25 $75 $

En una solicitud con 300.000 tokens de entrada, todos los tokens de entrada, caché y salida aplicables se facturan con las tarifas superiores de contexto largo; los primeros 272.000 no se cobran según la modalidad estándar.

Precios de entrada y salida de GPT-6 Astra en los modos Standard, contexto largo y Fast

Batch, Flex, Fast y las opciones de despliegue regional

OpenAI ofrece Batch y Flex al 50 % de las tarifas aplicables. Su guía del modelo indica que el modo Fast cuesta 2x las tarifas aplicables, no incluye un SLA de latencia y no está disponible con residencia de datos en la UE. El procesamiento Priority tampoco está disponible con residencia de datos en la UE.

ModalidadEntrada estándarSalida estándarInterpretación práctica
Standard10 $ / 1 M50 $ / 1 MModalidad directa predeterminada de la API
Batch o Flex5 $ / 1 M25 $ / 1 MLa mitad de la tarifa Standard aplicable
Fast20 $ / 1 M100 $ / 1 MEl doble de la tarifa Standard aplicable
Standard con contexto largo20 $ / 1 M75 $ / 1 MSe aplica por encima de 272.000 tokens de entrada
Fast con contexto largo40 $ / 1 M150 $ / 1 M2x las tarifas de contexto largo

La tabla muestra únicamente la entrada sin caché y la salida. Las tarifas de lectura y escritura de caché también siguen el multiplicador correspondiente a la modalidad de servicio.

Microsoft Foundry publica una tabla de despliegue independiente. Su anuncio de GPT-6 Astra recoge para Global Standard y contexto corto unas tarifas de 10 $ de entrada, 1 $ de entrada en caché, 12,50 $ de escrituras en caché y 50 $ de salida. U.S. Data Zone Standard aplica 11 $, 1,10 $, 13,75 $ y 55 $. Para contexto largo, la tabla indica 20 $/2 $/25 $/75 $ en Global y 22 $/2,20 $/27,50 $/82,50 $ en U.S. Data Zone. No traslades directamente las tarifas de OpenAI a un presupuesto de Azure.

Cuánto cuesta realmente una solicitud a Astra

Los ejemplos utilizan las tarifas directas de OpenAI en Standard, excluyen herramientas y reintentos, y clasifican los tokens como no almacenados en caché o en caché exactamente según se indica.

Ejemplo de solicitudCálculoCoste estimado de tokens
100.000 tokens de entrada sin caché + 10.000 de salida0.1 × $10 + 0.01 × $501,50 $
200.000 tokens de entrada en caché + 20.000 de salida0.2 × $1 + 0.02 × $501,20 $
300.000 tokens de entrada sin caché + 30.000 de salida0.3 × $20 + 0.03 × $758,25 $

Comprueba el límite de 272.000 tokens antes de adoptar flujos de trabajo con contexto largo. La recuperación o compactación puede reducir el coste del modelo, aunque añade trabajo a la aplicación.

Escribir 200.000 tokens cuesta 2,50 $, mientras que una lectura posterior de esos 200.000 tokens desde la caché cuesta 0,20 $. La amortización de la caché depende de la frecuencia con la que reutilices el contenido.

En Microsoft Foundry, una solicitud de 100.000 tokens de entrada y 10.000 de salida en la tabla Global de contexto corto también cuesta 1,50 $ antes de herramientas o reintentos. La versión U.S. Data Zone cuesta 1,65 $: 0.1 × $11 + 0.01 × $55.

La guía de OpenAI afirma que Astra puede ofrecer un coste estimado por tarea completada inferior al de modelos anteriores, pero esa indicación no constituye una comparativa independiente de costes en producción. Mide en tus propios registros los tokens de entrada, los aciertos de caché, los tokens de salida, las llamadas a herramientas, los reintentos y las correcciones humanas.

Acceso, cuotas y la diferencia entre ChatGPT y la API

GPT-6 Astra se está habilitando progresivamente para empresas del Trusted Access Program. El acceso a la API y a los planes Plus, Pro, Business y Enterprise llegará en los próximos días. La documentación del proveedor OpenAI de OpenClaw también señala que el catálogo disponible para la cuenta determina si Astra está habilitado; añadir el nombre del modelo a la configuración no concede acceso.

Un usuario describió así el retraso en el despliegue:

“Son casi las 2 de la madrugada y me voy a dormir cabreado. Me pasé TODO EL DÍA esperando Astra. ... Y entonces me entero de que NI SIQUIERA PUEDO USARLO.” — @buildwithrajath, X

La página del modelo muestra estos límites de la API según el nivel de uso:

NivelRPMTPMLímite de cola Batch
FreeNo compatibleNo compatibleNo compatible
Tier 1500500.0001.500.000
Tier 25.0001.000.0003.000.000
Tier 35.0002.000.000100.000.000
Tier 410.0004.000.000200.000.000
Tier 515.00040.000.00015.000.000.000

La tabla de precios de Astra corresponde únicamente a la API. La documentación citada no incluye créditos de API con los planes de ChatGPT, así que presupuestar el uso de Platform API por separado.

Comprobaciones de migración para agentes existentes

La guía del modelo de OpenAI destaca tres comprobaciones de migración:

  1. Modelo y API: establece model como gpt-6-astra, verifica que el catálogo de la cuenta lo muestre y utiliza la Responses API para las llamadas a herramientas.
  2. Parámetros de la solicitud: elige low, medium, high, xhigh o max; Astra no admite none. Elimina los parámetros de muestreo y de log-probabilidad que no sean compatibles.
  3. Caché y región: sustituye prompt_cache_retention por prompt_cache_options.ttl: "30m" al seguir la guía de migración de modelos antiguos de OpenAI. Después, vuelve a comprobar la configuración de Fast y Priority si utilizas residencia de datos en la UE.

La decisión de presupuesto: enruta según tus registros, no solo según el precio por token

GPT-6 Astra resulta más fácil de justificar en tareas largas, con muchas herramientas, costosas cuando fallan o bloqueadas por software que no ofrece una API limpia. No es la mejor opción predeterminada para prompts cortos y rutinarios si la tarifa de 50 $ por millón de tokens de salida no se traduce en menos reintentos o más trabajo completado correctamente.

  • Prueba Astra primero en investigación con contexto largo, uso del ordenador, programación compleja y flujos de trabajo que atraviesen varias aplicaciones, especialmente cuando un fallo implique revisión o retrabajo.
  • Mantén un modelo más barato como opción predeterminada para clasificación breve, extracción, redacción sencilla y transformaciones predecibles.
  • Utiliza Batch o Flex cuando la latencia no sea importante y la carga de trabajo sea compatible con una tarifa del 50 %.
  • No actives Fast por defecto. Con 20 $ de entrada y 100 $ de salida por millón de tokens antes de cualquier multiplicador de contexto largo, necesita aportar una mejora de rendimiento medible.
  • Configura un límite estricto en 272.000 tokens. Genera una alerta antes de que una solicitud cruce el umbral, porque la tarifa superior se aplica a toda la petición.

Evalúa el coste por tarea aceptada a partir de tus propios registros, no solo del precio por token. Para otros cálculos de presupuesto, compara las hipótesis de la guía de precios de GPT-5.6 y la guía de precios de OpenRouter, pero no traslades sus reglas de tarifas directamente a Astra.

Preguntas frecuentes sobre los precios de la API de GPT-6 Astra

¿Cuánto cuesta GPT-6 Astra por cada millón de tokens?

La tarifa estándar es de 10 $ por millón de tokens de entrada sin caché, 1 $ por millón de tokens de entrada en caché, 12,50 $ por millón de escrituras en caché y 50 $ por millón de tokens de salida.

¿Qué ocurre por encima de 272.000 tokens de entrada?

Las tarifas de entrada y caché se duplican y la salida aumenta un 50 %: 20 $ de entrada, 2 $ de entrada en caché, 25 $ de escrituras en caché y 75 $ de salida por millón de tokens para toda la solicitud.

¿La entrada en caché es lo mismo que una escritura en caché?

No. La entrada en caché es un acierto de caché que se factura a 1 $ por millón en la modalidad Standard. Una escritura en caché crea o actualiza el prefijo almacenado y cuesta 12,50 $ por millón.

¿Batch o Flex reducen a la mitad el precio de GPT-6 Astra?

OpenAI sitúa Batch y Flex en el 50 % de las tarifas Standard aplicables, incluida la tarifa de contexto largo correspondiente cuando se supera ese umbral.

¿Merece la pena pagar el sobrecoste del modo Fast?

El modo Fast cuesta 2x las tarifas aplicables y no ofrece un SLA de latencia. Úsalo únicamente si tus registros demuestran una mejora suficiente de rendimiento o valor para el usuario que compense la prima.

¿Puedo utilizar GPT-6 Astra mediante la API hoy?

El acceso se está habilitando de forma progresiva y todavía no está abierto para todo el mundo. OpenAI indica una disponibilidad inicial para empresas con Trusted Access y señala que el acceso más amplio a la API llegará en los próximos días. Por tanto, el catálogo de la cuenta es la comprobación definitiva.

¿ChatGPT Plus incluye créditos para la API de GPT-6 Astra?

La documentación del modelo no promete créditos de API con un plan de ChatGPT. Considera por separado el acceso al modelo incluido en el plan de pago y la facturación por uso de Platform API, salvo que las condiciones de facturación explícitas de tu cuenta indiquen lo contrario.

¿Qué cambios requiere la API para utilizar GPT-6 Astra?

Establece model como gpt-6-astra, utiliza la Responses API para las llamadas a herramientas, selecciona un nivel de razonamiento compatible, elimina los parámetros de muestreo y log-probabilidad no admitidos y revisa el TTL de la caché y las reglas regionales del modo Fast. Antes de convertir Astra en el modelo predeterminado, registra los tokens, el comportamiento de la caché, las herramientas, los reintentos y las correcciones humanas durante una ejecución representativa.

>_Directorio de modelos AIReiter

Acceso API rápido a modelos relacionados con esta guía

GPT-5.6 Terra

Chat

Un modelo de texto GPT-5.6 más potente para tareas de codificación y análisis que requieren mucho razonamiento.

OpenAICrear API Key >

GPT-6 Astra

Chat

OpenAI frontier model for complex reasoning, coding, and long-context work.

OpenAICrear API Key >

Claude Fable 5

Chat

Un modelo premium de Claude para razonamiento profundo y trabajo complejo de formato largo.

AnthropicCrear API Key >

Claude Fable 5.1

Chat

Mythos-class model for long-horizon coding, research, and knowledge work.

AnthropicCrear API Key >

Claude Opus 4.8

Chat

Un modelo Claude de alta capacidad para tareas que exigen razonamiento y trabajo profesional.

AnthropicCrear API Key >

Publicaciones recientes

Análisis de la API de GPT-6 Astra (2026): creada para agentes, no para sustituir sin más

2026-09-07

API de Kling: guía de integración oficial y mediante agregadores (2026)

2026-09-07

Suno API Key: cómo conseguir una y cuánto cuesta (2026)

2026-09-07

Análisis de GPT-6 Astra: ¿merece la pena su precio de API de $10/$50?

2026-09-06
AIREITER

¿Preguntas? Contáctanos en
[email protected]

新速率有限公司NEWRATE LIMITED香港九龍花園街 2-16 號好景商業中心 2304 室Room 2304, Haojing Commercial Center, 2-16 Garden Street, Kowloon, Hong Kong

LLM

GPT-6 AstraGemini 3.8 FlashClaude Fable 5.1GLM-5.3 FlashGemini 3.6 Flash

Video IA

Gemini Omni 1.1 Flash ExtMiniMax H3Kling 3.0 Motion ControlKling 3.0 TurboKling 3.0

Imagen IA

Grok Imagine Image 2.0Midjourney V8.1Midjourney V7Z-Image TurboKrea 2 Turbo

Blog

Ver todo →

Compañía

Política de privacidadTérminos de servicioPolítica de reembolso

© 2026 AIReiter. Todos los derechos reservados.