Ce que vous pouvez faire avec GPT-6 Luna
GPT-6 Luna est le modèle rapide et économique de la famille GPT-6. Quatre particularités changent la manière dont vous concevez vos applications avec lui, et aucune ne figure dans les arguments marketing.
La sortie coûte 5 fois plus cher que l'entrée
0,03 $ par million de tokens d'entrée contre 0,15 $ par million en sortie. Les longs prompts sont presque gratuits ; les longues réponses ne le sont pas. Limiter le nombre maximal de tokens de complétion réduit bien plus votre facture que de raccourcir le prompt.
Une fenêtre de 1M avec un palier critique à 272K
La fenêtre de contexte est de 1 050 000 tokens, mais dépasser 272K tokens d'entrée recalcule le tarif de l'ensemble de la requête à 2x en entrée et 1,5x en sortie — pas seulement le surplus. Un prompt de 280K tokens coûte plus cher que deux prompts de 140K.
Il raisonne avant de répondre
Lors de nos tests, le premier token diffusé a nécessité 5,0 à 5,6 secondes sur une réponse totale de 7,2 à 7,4 secondes. Le streaming ne masque pas ce délai. Si vous avez besoin d'afficher du texte à l'écran plus rapidement, réduisez l'effort de raisonnement plutôt que la limite de tokens de sortie.
La sortie structurée tient sans schéma
Interrogé en langage naturel pour fournir quatre champs spécifiques au format JSON, il a renvoyé exactement ces quatre clés dans un bloc de code, sans schéma, sans définition de fonction et sans nouvelle tentative. L'exemple ci-dessus correspond à cette réponse non modifiée.
Tarifs de GPT-6 Luna
Tokens d'entrée
0,03 $ par million de tokens, contre 0,10 $ au tarif officiel d'OpenAI.
Tokens de sortie
0,15 $ par million de tokens, contre 0,50 $ au tarif officiel d'OpenAI.
Lectures d'entrée en cache
0,003 $ par million de tokens, contre 0,01 $ au tarif officiel d'OpenAI.
Palier contexte long
Les requêtes de plus de 272K tokens d'entrée appliquent la surtaxe d'OpenAI : 2x sur l'entrée et 1,5x sur la sortie.
Cas d'usage de GPT-6 Luna
Tri du support client à 0,05 $ pour 1 000 tickets
Résumé, niveau de gravité, domaine produit, version concernée et étiquette de priorité en un seul appel par ticket. Un arriéré de 50 000 tickets est retraité pour environ 2,30 $.
Enrichissement par lots avec préfixe en cache
Les traitements par lots répètent les mêmes instructions sur chaque ligne. Gardez ce préfixe strictement identique à l'octet près, et la partie répétée sera facturée 0,003 $ par million au lieu de 0,03 $ — soit un dixième du coût d'entrée sur l'ensemble du traitement.
Niveau par défaut derrière un routeur
Envoyez tout vers Luna et ne basculez vers un modèle supérieur que si une vérification échoue. Sol coûtant environ 20x plus cher, un routeur maintenant 95 % du trafic sur Luna ne paie qu'environ un dixième d'un pipeline 100 % Sol — les 5 % escaladés représentant la moitié de la facture restante.
Documents complets sous la barre des 272K
Les rapports, transcriptions et contrats tiennent dans la fenêtre de 1M, mais restez sous les 272K tokens d'entrée par requête pour éviter le tarif multiplié par 2. Découper le contenu sous cette limite est généralement plus économique qu'un seul appel volumineux.
Comment utiliser GPT-6 Luna
Luna est un modèle taillé pour le volume : testez-le donc en conditions réelles, sur un véritable enregistrement, avec des paramètres viables à grande échelle.
Collez un véritable enregistrement
Utilisez un vrai ticket, une transcription ou un document réel plutôt qu'un prompt d'exemple. Le point faible de Luna réside dans les entrées désordonnées, pas dans le raisonnement complexe.
Ajustez à la baisse, pas à la hausse
Commencez avec un effort de raisonnement faible et une limite stricte de tokens de complétion max. La sortie coûte 5 fois plus cher que l'entrée, le plafond de sortie est donc le levier clé pour maîtriser votre facture.
Multipliez le nombre de tokens
Prenez l'utilisation indiquée sous la réponse, multipliez-la par votre volume quotidien, et vous obtiendrez votre coût mensuel avant même d'écrire la moindre ligne de code d'intégration.
Développer avec l'API GPT-6 Luna
Dans une intégration par lots, l'important n'est pas le premier appel mais le dix-millième : coût par enregistrement, comportement du cache et gestion des erreurs sur une ligne.
ID de modèle directement interchangeable
Pointez un client compatible OpenAI existant vers gpt-6-luna sans rien changer d'autre. Le streaming, les prompts système et les sorties au format JSON fonctionnent exactement comme en amont.
La mise en cache des préfixes prend tout son sens
Les tâches par lots répètent les mêmes instructions sur chaque ligne. La lecture en cache coûte 0,003 $ par million contre 0,03 $ pour une nouvelle entrée ; structurer vos données avec un préfixe de prompt stable est donc particulièrement rentable.
Comptabilisation des coûts par réponse
Chaque réponse indique l'entrée, la sortie, les lectures en cache et les crédits consommés, permettant ainsi à un pipeline d'enregistrer la rentabilité unitaire par enregistrement au lieu de la découvrir sur la facture.
Basculez vers GPT-6 Sol sans refonte technique
Sol et Luna partagent le même endpoint, la même clé et le même solde : router une ligne complexe vers l'offre phare se résume à changer l'ID du modèle, sans nécessiter de seconde intégration.
GPT-6 Luna vs GPT-6 Sol vs GPT-5.6 Luna
GPT-6 Luna - environ 0,05 $ pour 1 000 tickets
0,03 $ en entrée et 0,15 $ en sortie par million de tokens sur AIReiter, contre 0,10 $ et 0,50 $ officiellement chez OpenAI. L'offre GPT-6 la plus abordable, idéale pour rentabiliser l'automatisation à l'enregistrement.
GPT-6 Sol - environ 0,91 $ pour 1 000 tickets
0,60 $ en entrée et 3,00 $ en sortie par million de tokens, soit environ 20 fois le prix de Luna. Indispensable lorsqu'une tâche requiert un raisonnement de pointe, mais superflu s'il s'agit d'une simple extraction que Luna réussit déjà.
GPT-5.6 Luna - la génération précédente
Prix officiel de 0,20 $ en entrée et 1,20 $ en sortie par million de tokens. GPT-6 Luna réduit de moitié le prix officiel en entrée et divise par plus de deux celui en sortie, tout en conservant le même positionnement économique.
Comment choisir
Testez votre enregistrement le plus complexe sur les deux modèles dans le playground ci-dessus. Si la réponse de Luna tient la route, l'écart de prix de 20x impose que Sol justifie cette différence sur cette tâche précise plutôt que sur sa seule réputation.
FAQ GPT-6 Luna
Questions fréquentes sur le playground en ligne, la tarification et l’accès à l’API.
/ 01Quand dois-je choisir GPT-6 Luna ?
Choisissez Luna pour les tâches à fort volume et bien définies telles que le résumé, l'extraction et la classification. Ne passez à GPT-6 Sol que lorsqu'une tâche nécessite un raisonnement de pointe.
/ 02Combien coûte GPT-6 Luna sur AIReiter ?
AIReiter facture 30 % des tarifs officiels d'OpenAI : 0,03 $ par million de tokens d'entrée et 0,15 $ par million de tokens de sortie, contre 0,10 $ et 0,50 $ pour les tarifs officiels. Les lectures d'entrées en cache coûtent 0,003 $ par million.
/ 03En quoi GPT-6 Luna diffère-t-il de GPT-5.6 Luna ?
GPT-6 Luna représente la nouvelle génération, à la moitié du prix officiel d'entrée et au cinquième du prix officiel de sortie de GPT-5.6 Luna, au sein de la même gamme économique.
/ 04Quelle est la taille de la fenêtre de contexte ?
GPT-6 Luna prend en charge environ 1M de tokens d'entrée et jusqu'à 128K tokens de sortie. Les requêtes dépassant 272K tokens d'entrée sont facturées 2x pour l'entrée et 1,5x pour la sortie, conformément à la politique d'OpenAI.
/ 05Quelle est la rapidité de GPT-6 Luna ?
Sur AIReiter, une requête de résumé et d'extraction sur un ticket de support de 494 tokens a renvoyé 204 tokens de sortie en 10,6 secondes sans streaming, et entre 7,2 et 7,4 secondes de bout en bout avec streaming. Notez que Luna réfléchit avant de répondre : le premier token en streaming a nécessité 5,0 à 5,6 secondes selon les essais, la majeure partie de l'attente a donc lieu avant l'apparition du texte. Réduisez l'effort de raisonnement si vous souhaitez que la réponse commence plus tôt.
/ 06Combien coûte GPT-6 Luna pour 1 000 enregistrements ?
En utilisant cette même requête mesurée — 494 tokens d'entrée et 204 tokens de sortie —, le coût est d'environ 0,05 $ pour 1 000 tickets aux tarifs d'AIReiter. La même charge de travail sur GPT-6 Sol coûte environ 0,91 $ pour 1 000.
/ 07Puis-je appeler GPT-6 Luna via une API ?
Oui. Suivez la documentation API liée et utilisez l'identifiant de modèle gpt-6-luna sur le point de terminaison compatible OpenAI.