AIREITER
DOCS APITARIFS
MODÈLES
  • AIReiter
  • Blog
  • Tarifs de l’API GPT-6 Astra (2026) : coûts, limites et accès

Tarifs de l’API GPT-6 Astra (2026) : coûts, limites et accès

Dernière mise à jour: 2026-09-04 00:37:46

Ne vous arrêtez pas au tarif affiché de 10 $ par million de tokens en entrée et 50 $ par million de tokens en sortie. Au-delà de 272 000 tokens en entrée, l’intégralité de la requête passe sur une grille tarifaire plus élevée. Et comme l’accès à GPT-6 Astra est encore déployé progressivement, le simple fait de voir le modèle dans la documentation ne garantit pas qu’un compte puisse réellement l’appeler.

Tarifs de l’API GPT-6 Astra en un coup d’œil

La grille ci-dessous provient de la page officielle du modèle publiée par OpenAI. Les prompts mis en cache, les requêtes en contexte long et le mode Fast peuvent modifier sensiblement le coût réel.

ÉlémentDétail actuel
ID du modèle APIgpt-6-astra
Entrée standard10,00 $ / 1M tokens
Entrée en cache1,00 $ / 1M tokens
Écriture du cache12,50 $ / 1M tokens
Sortie standard50,00 $ / 1M tokens
Fenêtre de contexte1 050 000 tokens
Sortie maximale128 000 tokens
Date de connaissance30 avril 2026
Entrée/sortieEntrée texte et image ; sortie texte
Palier API gratuitNon pris en charge
Disponibilité actuelleDéploiement progressif auprès des entreprises bénéficiant du Trusted Access ; un accès API plus large et l’accès via les offres payantes sont annoncés dans les prochains jours

Ces chiffres proviennent de la page du modèle GPT-6 Astra, et non d’une estimation de préversion. Le guide du modèle d’OpenAI précise que l’appel d’outils nécessite la Responses API.

Tarifs de l’API GPT-6 Astra affichés sur la page officielle du modèle OpenAI

Trois règles tarifaires qui peuvent faire grimper la facture

GPT-6 Astra distingue quatre catégories de tokens et applique plusieurs règles selon le mode de service. Réduire son prix à un simple endpoint à 10 $ en entrée / 50 $ en sortie sous-estime le coût de création du cache, des prompts longs et du traitement à faible latence.

Entrée standard, entrée en cache et écritures du cache

L’entrée standard coûte 10 $ par million, l’entrée en cache 1 $ par million et les écritures du cache 12,50 $ par million. La réutilisation peut donc devenir très économique après l’écriture initiale.

Catégorie de tokensTarif standardCe que cela recouvre
Entrée non mise en cache10,00 $ / 1MNouvelles données d’entrée traitées par le modèle
Entrée en cache1,00 $ / 1MDonnées déjà traitées et servies depuis le cache
Écriture du cache12,50 $ / 1MDonnées ajoutées au cache du prompt
Sortie50,00 $ / 1MTokens générés dans la réponse

Ne multipliez pas la fenêtre de contexte par le tarif d’entrée. Une fenêtre de contexte de 1,05 million de tokens correspond à une limite de capacité, pas à la promesse que tous les tokens seront facturés au tarif de base.

Le seuil de 272K tokens en entrée concerne toute la requête

Lorsqu’une requête contient plus de 272 000 tokens en entrée, OpenAI applique, selon sa grille, des tarifs d’entrée et de cache multipliés par 2, ainsi qu’un tarif de sortie multiplié par 1,5, sur l’intégralité de la requête. Le mode contexte long revient donc à 20 $ par million de tokens d’entrée non mis en cache, 2 $ par million de tokens d’entrée en cache, 25 $ par million pour les écritures du cache et 75 $ par million de tokens en sortie.

Type de requêteEntréeEntrée en cacheÉcriture du cacheSortie
272K tokens en entrée ou moins10 $1 $12,50 $50 $
Plus de 272K tokens en entrée20 $2 $25 $75 $

Pour une requête comprenant 300K tokens en entrée, tous les tokens concernés — entrée, cache et sortie — sont facturés selon les tarifs de contexte long. Les 272 premiers milliers ne restent pas au tarif standard.

Prix des tokens en entrée et en sortie de GPT-6 Astra selon les modes Standard, contexte long et Fast

Batch, Flex, Fast et choix de déploiement régional

OpenAI facture Batch et Flex à 50 % des tarifs applicables. Son guide du modèle indique que le mode Fast coûte 2 fois les tarifs applicables, sans SLA de latence, et qu’il n’est pas disponible avec la résidence des données dans l’UE. Le traitement Priority n’est pas non plus disponible avec cette option de résidence des données.

ModeEntrée standardSortie standardÀ retenir
Standard10 $ / 1M50 $ / 1MMode direct par défaut de l’API
Batch ou Flex5 $ / 1M25 $ / 1MLa moitié du tarif Standard applicable
Fast20 $ / 1M100 $ / 1MDeux fois le tarif Standard applicable
Standard, contexte long20 $ / 1M75 $ / 1MS’applique au-delà de 272K tokens en entrée
Fast, contexte long40 $ / 1M150 $ / 1MDeux fois les tarifs de contexte long

Le tableau ne présente que les tarifs de l’entrée non mise en cache et de la sortie. Les tarifs de lecture et d’écriture du cache suivent eux aussi le coefficient du mode de service applicable.

Microsoft Foundry publie une grille de déploiement distincte. Son annonce de GPT-6 Astra indique, pour le mode Global Standard en contexte court, des tarifs de 10 $ en entrée, 1 $ pour l’entrée en cache, 12,50 $ pour les écritures du cache et 50 $ en sortie. En U.S. Data Zone Standard, ils passent à 11 $, 1,10 $, 13,75 $ et 55 $. Pour le contexte long, la grille affiche 20 $/2 $/25 $/75 $ en Global et 22 $/2,20 $/27,50 $/82,50 $ en U.S. Data Zone. N’appliquez donc pas directement la grille OpenAI à un budget Azure.

Combien coûte réellement une requête Astra ?

Les exemples utilisent les tarifs directs OpenAI en mode Standard, sans outils ni nouvelles tentatives, et classent les tokens comme non mis en cache ou mis en cache, conformément aux indications fournies.

Exemple de requêteCalculCoût estimé des tokens
100K tokens d’entrée non mis en cache + 10K en sortie0.1 × $10 + 0.01 × $501,50 $
200K tokens d’entrée en cache + 20K en sortie0.2 × $1 + 0.02 × $501,20 $
300K tokens d’entrée non mis en cache + 30K en sortie0.3 × $20 + 0.03 × $758,25 $

Vérifiez le seuil de 272K avant d’adopter des workflows en contexte long. La récupération de contenu ou la condensation du contexte peuvent réduire le coût du modèle, mais elles ajoutent du travail côté application.

Écrire 200K tokens coûte 2,50 $, tandis qu’une lecture ultérieure de 200K tokens depuis le cache revient à 0,20 $. La rentabilité du cache dépend donc de la fréquence de réutilisation.

Dans Microsoft Foundry, une requête de 100K tokens en entrée et 10K en sortie coûte également 1,50 $ dans la grille Global en contexte court, avant les outils et les nouvelles tentatives. En U.S. Data Zone, elle revient à 1,65 $ : 0.1 × $11 + 0.01 × $55.

Le guide d’OpenAI affirme qu’Astra peut offrir un coût estimé inférieur par tâche terminée à celui de modèles précédents, mais cette indication ne constitue pas un benchmark indépendant des coûts en production. Mesurez dans vos propres traces les tokens en entrée, les accès au cache, les tokens en sortie, les appels d’outils, les nouvelles tentatives et les corrections humaines.

Accès, quotas et séparation entre ChatGPT et l’API

GPT-6 Astra est progressivement proposé aux entreprises du Trusted Access Program, tandis que l’accès via l’API ainsi que les offres Plus, Pro, Business et Enterprise doit arriver dans les prochains jours. La documentation du fournisseur OpenAI d’OpenClaw précise elle aussi que la découverte du catalogue du compte détermine si celui-ci dispose d’un accès à Astra. Ajouter le nom du modèle dans la configuration ne suffit pas à obtenir cet accès.

Un utilisateur a décrit le retard du déploiement en ces termes :

« Il est presque 2 heures du matin et je vais me coucher furieux. J’ai attendu Astra TOUTE LA JOURNÉE. ... Et voilà que j’apprends que JE NE PEUX MÊME PAS L’UTILISER. » — @buildwithrajath, X

La page du modèle indique les limites API suivantes selon le niveau d’utilisation :

NiveauRPMTPMLimite de la file Batch
FreeNon pris en chargeNon pris en chargeNon pris en charge
Tier 1500500 0001 500 000
Tier 25 0001 000 0003 000 000
Tier 35 0002 000 000100 000 000
Tier 410 0004 000 000200 000 000
Tier 515 00040 000 00015 000 000 000

La grille tarifaire d’Astra concerne uniquement l’API. La documentation citée n’indique pas que les offres ChatGPT incluent des crédits API : prévoyez donc séparément les coûts d’utilisation de la Platform API.

Vérifications à effectuer avant de migrer des agents existants

Le guide du modèle d’OpenAI couvre trois points de migration :

  1. Modèle et API : définissez model sur gpt-6-astra, vérifiez que le catalogue du compte expose bien le modèle et utilisez la Responses API pour l’appel d’outils.
  2. Paramètres de requête : choisissez low, medium, high, xhigh ou max ; Astra ne prend pas en charge none. Supprimez les paramètres d’échantillonnage et de log-probabilités non compatibles.
  3. Cache et région : remplacez prompt_cache_retention par prompt_cache_options.ttl: "30m" en suivant les anciennes instructions de migration des modèles OpenAI, puis revérifiez les paramètres Fast et Priority en cas de résidence des données dans l’UE.

Choix budgétaire : orientez les requêtes selon vos traces, pas selon le seul prix des tokens

GPT-6 Astra se justifie plus facilement pour les tâches longues, riches en outils, coûteuses en cas d’échec, ou dépendantes de logiciels qui n’exposent pas d’API propre. En revanche, c’est un mauvais choix par défaut pour les prompts courts et routiniers si le tarif de 50 $ par million de tokens en sortie ne permet pas de réduire les nouvelles tentatives ou d’obtenir un meilleur résultat final.

  • Testez Astra en priorité sur la recherche en contexte long, l’utilisation d’un ordinateur, le code complexe et les workflows impliquant plusieurs applications, lorsque les erreurs entraînent des coûts de vérification ou de reprise.
  • Gardez un modèle moins cher par défaut pour la classification courte, l’extraction, la rédaction simple et les transformations prévisibles.
  • Utilisez Batch ou Flex lorsque la latence importe peu et que la charge de travail accepte un tarif réduit de 50 %.
  • N’activez pas Fast par défaut. À 20 $ en entrée et 100 $ en sortie par million de tokens, avant même l’éventuel coefficient de contexte long, ce mode doit apporter un gain mesurable de débit.
  • Définissez une limite stricte à 272K. Déclenchez une alerte avant qu’une requête franchisse ce seuil, puisque le tarif majoré s’applique à toute la requête.

Évaluez le coût par tâche acceptée à partir de vos propres journaux de traces, et pas uniquement du prix des tokens. Pour vos comparaisons budgétaires, consultez le guide des tarifs GPT-5.6 et le guide des tarifs OpenRouter, mais ne transposez pas leurs règles tarifaires à Astra.

FAQ sur les tarifs de l’API GPT-6 Astra

Combien coûte GPT-6 Astra pour 1M tokens ?

Le tarif standard est de 10 $ par million de tokens d’entrée non mis en cache, 1 $ par million de tokens d’entrée en cache, 12,50 $ par million pour les écritures du cache et 50 $ par million de tokens en sortie.

Que se passe-t-il au-delà de 272K tokens en entrée ?

Les tarifs d’entrée et de cache doublent, tandis que celui de la sortie augmente de 50 % : 20 $ en entrée, 2 $ pour l’entrée en cache, 25 $ pour les écritures du cache et 75 $ en sortie par million de tokens sur l’intégralité de la requête.

L’entrée en cache est-elle la même chose qu’une écriture du cache ?

Non. L’entrée en cache correspond à une lecture depuis le cache, facturée 1 $ par million dans le mode Standard. Une écriture crée ou met à jour le préfixe mis en cache et coûte 12,50 $ par million.

Batch ou Flex divisent-ils par deux le prix de GPT-6 Astra ?

OpenAI facture Batch et Flex à 50 % des tarifs Standard applicables, y compris le tarif de contexte long correspondant lorsque le seuil est franchi.

Le mode Fast vaut-il son surcoût ?

Le mode Fast coûte 2 fois les tarifs applicables et ne bénéficie d’aucun SLA de latence. Utilisez-le uniquement si vos traces montrent un gain suffisant de débit ou de valeur pour les utilisateurs afin de compenser ce surcoût.

Puis-je utiliser GPT-6 Astra via l’API aujourd’hui ?

L’accès est déployé progressivement et n’est pas encore ouvert à tous. OpenAI indique une disponibilité initiale pour les entreprises du Trusted Access et annonce un accès API plus large dans les prochains jours. Le catalogue du compte reste donc la vérification décisive.

ChatGPT Plus inclut-il des crédits API pour GPT-6 Astra ?

La documentation du modèle ne promet pas de crédits API avec une offre ChatGPT. Considérez l’accès au modèle dans une offre payante et la facturation à l’usage de la Platform API comme deux éléments distincts, tant que les conditions de facturation explicites de votre compte ne précisent pas le contraire.

Quels changements faut-il apporter à l’API pour GPT-6 Astra ?

Définissez model sur gpt-6-astra, utilisez la Responses API pour l’appel d’outils, sélectionnez un niveau d’effort de raisonnement compatible, supprimez les paramètres d’échantillonnage et de log-probabilités non pris en charge, puis vérifiez la durée de vie du cache et les règles régionales du mode Fast. Avant de faire d’Astra votre modèle par défaut, consignez les tokens, le comportement du cache, les outils, les nouvelles tentatives et les corrections humaines lors d’une exécution représentative.

>_Répertoire des modèles AIReiter

Accès API rapide aux modèles liés à ce guide

GPT-5.6 Terra

Chat

Un modèle texte GPT-5.6 plus puissant pour les tâches de codage et d’analyse nécessitant un raisonnement poussé.

OpenAICréer une API Key >

GPT-6 Astra

Chat

OpenAI frontier model for complex reasoning, coding, and long-context work.

OpenAICréer une API Key >

Claude Fable 5

Chat

Un modèle Claude premium pour le raisonnement approfondi et le travail long et complexe.

AnthropicCréer une API Key >

Claude Fable 5.1

Chat

Mythos-class model for long-horizon coding, research, and knowledge work.

AnthropicCréer une API Key >

Claude Opus 4.8

Chat

Un modèle Claude hautement performant pour les tâches de raisonnement exigeantes et le travail professionnel.

AnthropicCréer une API Key >

Articles récents

GPT-6 Astra API : test (2026) — conçu pour les agents, pas pour un remplacement à l’identique

2026-09-07

API Kling : guide d’intégration officielle et via agrégateurs (2026)

2026-09-07

Clé API Suno : comment l’obtenir et combien elle coûte (2026)

2026-09-07

Test de GPT-6 Astra : le tarif API de 10 $/50 $ en vaut-il la peine ?

2026-09-06
AIREITER

Des questions ? Contactez-nous à
[email protected]

新速率有限公司NEWRATE LIMITED香港九龍花園街 2-16 號好景商業中心 2304 室Room 2304, Haojing Commercial Center, 2-16 Garden Street, Kowloon, Hong Kong

LLM

GPT-6 AstraGemini 3.8 FlashClaude Fable 5.1GLM-5.3 FlashGemini 3.6 Flash

Vidéo IA

Gemini Omni 1.1 Flash ExtMiniMax H3Kling 3.0 Motion ControlKling 3.0 TurboKling 3.0

Image IA

Grok Imagine Image 2.0Midjourney V8.1Midjourney V7Z-Image TurboKrea 2 Turbo

Blog

Voir tout →

Entreprise

Politique de confidentialitéConditions d'utilisationPolitique de remboursement

© 2026 AIReiter. Tous droits réservés.