AIREITER
openaiText Chat

GPT-6 Luna

Exécutez GPT-6 Luna en ligne et via API pour le résumé, l'extraction et la classification à 30 % des tarifs officiels de tokens d'OpenAI. Contexte de 1M de tokens.

Token d’entréeEntréeSortieLecture cacheCréation cache
≤ 271,999$0.03 par million de tokens$0.15 par million de tokens$0.003 par million de tokens$0.0375 par million de tokens
> 271,999$0.06 par million de tokens$0.225 par million de tokens$0.006 par million de tokens$0.075 par million de tokens

Tarifs par million de tokens. Le palier s’applique à toute la requête selon le total des tokens d’entrée, y compris les lectures et écritures en cache.

Exécuter avec l'API

ENTRÉE

SORTIE

Example
Generated in
10.6 seconds
Token d’entrée
494
Token de sortie
204
Tokens per second
19.25 tokens / second
Time to first token
-

Détails du modèle

Utilisez la même clé de modèle dans le Playground, les requêtes API et les workflows internes.

ID du modèle
gpt-6-luna
Fournisseur
openai
Protocole
OpenAI Chat Completions
Fenêtre de contexte
1,050,000 tokens
Sortie maximale
128,000 tokens

Ce que vous pouvez faire avec GPT-6 Luna

GPT-6 Luna est le modèle rapide et économique de la famille GPT-6. Quatre particularités changent la manière dont vous concevez vos applications avec lui, et aucune ne figure dans les arguments marketing.

La sortie coûte 5 fois plus cher que l'entrée

0,03 $ par million de tokens d'entrée contre 0,15 $ par million en sortie. Les longs prompts sont presque gratuits ; les longues réponses ne le sont pas. Limiter le nombre maximal de tokens de complétion réduit bien plus votre facture que de raccourcir le prompt.

Une fenêtre de 1M avec un palier critique à 272K

La fenêtre de contexte est de 1 050 000 tokens, mais dépasser 272K tokens d'entrée recalcule le tarif de l'ensemble de la requête à 2x en entrée et 1,5x en sortie — pas seulement le surplus. Un prompt de 280K tokens coûte plus cher que deux prompts de 140K.

Il raisonne avant de répondre

Lors de nos tests, le premier token diffusé a nécessité 5,0 à 5,6 secondes sur une réponse totale de 7,2 à 7,4 secondes. Le streaming ne masque pas ce délai. Si vous avez besoin d'afficher du texte à l'écran plus rapidement, réduisez l'effort de raisonnement plutôt que la limite de tokens de sortie.

La sortie structurée tient sans schéma

Interrogé en langage naturel pour fournir quatre champs spécifiques au format JSON, il a renvoyé exactement ces quatre clés dans un bloc de code, sans schéma, sans définition de fonction et sans nouvelle tentative. L'exemple ci-dessus correspond à cette réponse non modifiée.

Tarifs de GPT-6 Luna

AIReiter propose GPT-6 Luna à 30 % des tarifs officiels de l'API OpenAI. Tarifs ci-dessous vérifiés d'après la grille tarifaire d'OpenAI au 23 septembre 2026 ; les tarifs en direct par token sont affichés au-dessus du playground.
01

Tokens d'entrée

0,03 $ par million de tokens, contre 0,10 $ au tarif officiel d'OpenAI.

02

Tokens de sortie

0,15 $ par million de tokens, contre 0,50 $ au tarif officiel d'OpenAI.

03

Lectures d'entrée en cache

0,003 $ par million de tokens, contre 0,01 $ au tarif officiel d'OpenAI.

04

Palier contexte long

Les requêtes de plus de 272K tokens d'entrée appliquent la surtaxe d'OpenAI : 2x sur l'entrée et 1,5x sur la sortie.

Cas d'usage de GPT-6 Luna

Luna trouve toute sa place dès lors que le coût par enregistrement est une contrainte. Les chiffres ci-dessous proviennent de l'exécution mesurée dans le playground : 494 tokens en entrée et 204 tokens en sortie par ticket.
01

Tri du support client à 0,05 $ pour 1 000 tickets

Résumé, niveau de gravité, domaine produit, version concernée et étiquette de priorité en un seul appel par ticket. Un arriéré de 50 000 tickets est retraité pour environ 2,30 $.

02

Enrichissement par lots avec préfixe en cache

Les traitements par lots répètent les mêmes instructions sur chaque ligne. Gardez ce préfixe strictement identique à l'octet près, et la partie répétée sera facturée 0,003 $ par million au lieu de 0,03 $ — soit un dixième du coût d'entrée sur l'ensemble du traitement.

03

Niveau par défaut derrière un routeur

Envoyez tout vers Luna et ne basculez vers un modèle supérieur que si une vérification échoue. Sol coûtant environ 20x plus cher, un routeur maintenant 95 % du trafic sur Luna ne paie qu'environ un dixième d'un pipeline 100 % Sol — les 5 % escaladés représentant la moitié de la facture restante.

04

Documents complets sous la barre des 272K

Les rapports, transcriptions et contrats tiennent dans la fenêtre de 1M, mais restez sous les 272K tokens d'entrée par requête pour éviter le tarif multiplié par 2. Découper le contenu sous cette limite est généralement plus économique qu'un seul appel volumineux.

Comment utiliser GPT-6 Luna

Luna est un modèle taillé pour le volume : testez-le donc en conditions réelles, sur un véritable enregistrement, avec des paramètres viables à grande échelle.

01

Collez un véritable enregistrement

Utilisez un vrai ticket, une transcription ou un document réel plutôt qu'un prompt d'exemple. Le point faible de Luna réside dans les entrées désordonnées, pas dans le raisonnement complexe.

02

Ajustez à la baisse, pas à la hausse

Commencez avec un effort de raisonnement faible et une limite stricte de tokens de complétion max. La sortie coûte 5 fois plus cher que l'entrée, le plafond de sortie est donc le levier clé pour maîtriser votre facture.

03

Multipliez le nombre de tokens

Prenez l'utilisation indiquée sous la réponse, multipliez-la par votre volume quotidien, et vous obtiendrez votre coût mensuel avant même d'écrire la moindre ligne de code d'intégration.

Développer avec l'API GPT-6 Luna

Dans une intégration par lots, l'important n'est pas le premier appel mais le dix-millième : coût par enregistrement, comportement du cache et gestion des erreurs sur une ligne.

ID de modèle directement interchangeable

Pointez un client compatible OpenAI existant vers gpt-6-luna sans rien changer d'autre. Le streaming, les prompts système et les sorties au format JSON fonctionnent exactement comme en amont.

La mise en cache des préfixes prend tout son sens

Les tâches par lots répètent les mêmes instructions sur chaque ligne. La lecture en cache coûte 0,003 $ par million contre 0,03 $ pour une nouvelle entrée ; structurer vos données avec un préfixe de prompt stable est donc particulièrement rentable.

Comptabilisation des coûts par réponse

Chaque réponse indique l'entrée, la sortie, les lectures en cache et les crédits consommés, permettant ainsi à un pipeline d'enregistrer la rentabilité unitaire par enregistrement au lieu de la découvrir sur la facture.

Basculez vers GPT-6 Sol sans refonte technique

Sol et Luna partagent le même endpoint, la même clé et le même solde : router une ligne complexe vers l'offre phare se résume à changer l'ID du modèle, sans nécessiter de seconde intégration.

GPT-6 Luna vs GPT-6 Sol vs GPT-5.6 Luna

La même tâche de ticket d'assistance — résumer et extraire quatre champs — mesurée sur AIReiter le 23 septembre 2026 à 494 tokens en entrée et 204 tokens en sortie, exécutée en 10,6 secondes sur Luna. Les modèles diffèrent d'environ un facteur vingt sur le plan tarifaire, non sur leur capacité à accomplir cette tâche.
01

GPT-6 Luna - environ 0,05 $ pour 1 000 tickets

0,03 $ en entrée et 0,15 $ en sortie par million de tokens sur AIReiter, contre 0,10 $ et 0,50 $ officiellement chez OpenAI. L'offre GPT-6 la plus abordable, idéale pour rentabiliser l'automatisation à l'enregistrement.

02

GPT-6 Sol - environ 0,91 $ pour 1 000 tickets

0,60 $ en entrée et 3,00 $ en sortie par million de tokens, soit environ 20 fois le prix de Luna. Indispensable lorsqu'une tâche requiert un raisonnement de pointe, mais superflu s'il s'agit d'une simple extraction que Luna réussit déjà.

03

GPT-5.6 Luna - la génération précédente

Prix officiel de 0,20 $ en entrée et 1,20 $ en sortie par million de tokens. GPT-6 Luna réduit de moitié le prix officiel en entrée et divise par plus de deux celui en sortie, tout en conservant le même positionnement économique.

04

Comment choisir

Testez votre enregistrement le plus complexe sur les deux modèles dans le playground ci-dessus. Si la réponse de Luna tient la route, l'écart de prix de 20x impose que Sol justifie cette différence sur cette tâche précise plutôt que sur sa seule réputation.

FAQ GPT-6 Luna

Questions fréquentes sur le playground en ligne, la tarification et l’accès à l’API.

/ 01

Quand dois-je choisir GPT-6 Luna ?

Choisissez Luna pour les tâches à fort volume et bien définies telles que le résumé, l'extraction et la classification. Ne passez à GPT-6 Sol que lorsqu'une tâche nécessite un raisonnement de pointe.

/ 02

Combien coûte GPT-6 Luna sur AIReiter ?

AIReiter facture 30 % des tarifs officiels d'OpenAI : 0,03 $ par million de tokens d'entrée et 0,15 $ par million de tokens de sortie, contre 0,10 $ et 0,50 $ pour les tarifs officiels. Les lectures d'entrées en cache coûtent 0,003 $ par million.

/ 03

En quoi GPT-6 Luna diffère-t-il de GPT-5.6 Luna ?

GPT-6 Luna représente la nouvelle génération, à la moitié du prix officiel d'entrée et au cinquième du prix officiel de sortie de GPT-5.6 Luna, au sein de la même gamme économique.

/ 04

Quelle est la taille de la fenêtre de contexte ?

GPT-6 Luna prend en charge environ 1M de tokens d'entrée et jusqu'à 128K tokens de sortie. Les requêtes dépassant 272K tokens d'entrée sont facturées 2x pour l'entrée et 1,5x pour la sortie, conformément à la politique d'OpenAI.

/ 05

Quelle est la rapidité de GPT-6 Luna ?

Sur AIReiter, une requête de résumé et d'extraction sur un ticket de support de 494 tokens a renvoyé 204 tokens de sortie en 10,6 secondes sans streaming, et entre 7,2 et 7,4 secondes de bout en bout avec streaming. Notez que Luna réfléchit avant de répondre : le premier token en streaming a nécessité 5,0 à 5,6 secondes selon les essais, la majeure partie de l'attente a donc lieu avant l'apparition du texte. Réduisez l'effort de raisonnement si vous souhaitez que la réponse commence plus tôt.

/ 06

Combien coûte GPT-6 Luna pour 1 000 enregistrements ?

En utilisant cette même requête mesurée — 494 tokens d'entrée et 204 tokens de sortie —, le coût est d'environ 0,05 $ pour 1 000 tickets aux tarifs d'AIReiter. La même charge de travail sur GPT-6 Sol coûte environ 0,91 $ pour 1 000.

/ 07

Puis-je appeler GPT-6 Luna via une API ?

Oui. Suivez la documentation API liée et utilisez l'identifiant de modèle gpt-6-luna sur le point de terminaison compatible OpenAI.