Un modèle peut être officiellement lancé sans disposer pour autant d’une grille tarifaire publique. C’est précisément le cas de Gemini 3.8 Live : Google a annoncé Gemini 3.8 Live et Gemini 3.8 Live Extended Thinking le 15 septembre 2026, mais sa documentation ne donne toujours aucun prix distinct en dollars pour 3.8 Live. Ne reportez pas les tarifs de $0.75/$3.75 par token de Gemini 3.8 Flash dans le budget d’un agent vocal.
En bref : Gemini 3.8 Live existe, mais son prix API n’est pas encore public
Selon le billet de lancement de Google, les deux modèles ont commencé à être déployés auprès des développeurs via la Gemini API et Google AI Studio le 15 septembre 2026. Cela confirme leur disponibilité, pas l’existence d’un tarif public définitif. L’annonce présente Gemini 3.8 Live comme économique et Extended Thinking comme compétitif, sans indiquer de tarif à la minute ni par token audio.
| Question | Réponse |
|---|---|
| Gemini 3.8 Live a-t-il été officiellement lancé ? | Oui, Google l’a annoncé le 15 septembre 2026. |
| Les développeurs peuvent-ils y accéder ? | Google indique que le déploiement a commencé via la Gemini API et AI Studio. |
| Existe-t-il une grille tarifaire officielle pour 3.8 Live ? | Pas sur la page de tarification de la Gemini API consultée pour ce guide. |
| La tarification de Gemini 3.8 Flash est-elle la même ? | Non. gemini-3.8-flash et les modèles Live sont des identifiants de modèle distincts. |
| Peut-on calculer aujourd’hui le coût exact d’un appel 3.8 Live ? | Non, pas sans un tarif propre à votre compte ou une publication tarifaire officielle ultérieure. |
Les deux modèles annoncés par Google le 15 septembre 2026
Google a lancé deux modèles audio de dialogue en direct, pensés pour des usages différents. Gemini 3.8 Live vise des conversations fluides et pouvant passer à l’échelle ; Gemini 3.8 Live Extended Thinking est conçu pour les tâches complexes à plusieurs étapes, sans interrompre l’échange.
L’annonce évoque une entrée visuelle quasi en temps réel, le basculement automatique entre 97 langues, ainsi que des appels d’outils ou d’API en arrière-plan pouvant continuer pendant que le modèle accuse réception de la demande. Extended Thinking est décrit comme capable de raisonner et de parler simultanément, avec des indicateurs de progression pour les tâches longues. Ces fonctions ont un impact potentiel sur la facture : travail en arrière-plan, appels d’outils et raisonnement approfondi peuvent faire évoluer la consommation de tokens.
Quels accès sont proposés aux acheteurs d’API ?
Le déploiement de Google ne correspond pas à une activation uniforme pour tous. L’annonce officielle présente les voies d’accès développeur comme suit :
| Surface | Gemini 3.8 Live | Gemini 3.8 Live Extended Thinking |
|---|---|---|
| Gemini API | Déploiement commencé le 15 septembre 2026 | Déploiement commencé le 15 septembre 2026 |
| Google AI Studio | Déploiement commencé le 15 septembre 2026 | Déploiement commencé le 15 septembre 2026 |
| Gemini Enterprise | Aperçu privé | Aperçu privé |
Considérez ce tableau comme une déclaration de déploiement de Google, et non comme la garantie que chaque compte verra immédiatement le même identifiant de modèle. La liste des modèles accessibles via l’API et les autorisations de votre projet restent les vérifications opérationnelles à effectuer.
Comprendre la facturation de Gemini Live avant la publication d’un tarif 3.8
La documentation de bonnes pratiques de la Live API de Google décrit une facturation fondée sur les tokens, non sur un forfait par session. L’audio est converti en consommation de tokens audio ; les messages texte et les transcriptions générées peuvent ajouter une consommation de tokens texte. Une session longue peut aussi coûter davantage à mesure que le contexte conversationnel actif s’accumule.
Pour préparer votre budget, retenez les règles suivantes :
- Ne considérez pas la durée de connexion comme l’unité de facturation officielle. Un montant à la minute reste une estimation dérivée de la tokenisation et du temps de parole.
- Distinguez l’audio entrant de l’audio sortant. Le modèle peut écouter pendant dix minutes et parler pendant quatre : il s’agit de deux flux de consommation différents.
- Prévoyez la croissance du contexte. Les recommandations de Google signalent que le contexte audio natif accumulé peut être inclus dans la facturation des tours ultérieurs, selon la gestion du contexte.
- Ajoutez séparément la transcription lorsqu’elle est activée. Les transcriptions peuvent entraîner des frais de tokens texte, en plus de l’usage audio.
- Suivez les appels d’outils et les tokens de raisonnement. Le travail en arrière-plan peut consommer davantage de tokens de sortie ou de contexte qu’un simple bot qui répond à tour de rôle.
C’est pourquoi « un demi-centime par minute » ne remplace pas un tarif officiel pour 3.8. Ce chiffre peut décrire un seul sens audio, avec une hypothèse de tokenisation donnée.
Ce que vous pouvez budgéter dès aujourd’hui
Tant que Google n’a pas publié les tarifs de Gemini 3.8 Live, appuyez-vous sur les modèles Live actuellement tarifés pour établir vos prévisions — sans les prendre pour un substitut au prix du nouveau modèle. La documentation tarifaire officielle de Gemini indique les tarifs de référence suivants :
| Modèle | Audio en entrée | Audio en sortie | Texte en entrée | Texte en sortie |
|---|---|---|---|---|
| Gemini 3.1 Flash Live Preview | $3.00 par 1 M de tokens audio (environ $0.005/min) | $12.00 par 1 M de tokens audio (environ $0.018/min) | $0.75 par 1 M | $4.50 par 1 M |
| Gemini 2.5 Flash Native Audio | $3.00 par 1 M de tokens audio | $12.00 par 1 M de tokens audio | $0.50 par 1 M | $2.00 par 1 M |
| Gemini 3.5 Live Translate | $3.50 par 1 M de tokens audio en entrée | $21.00 par 1 M de tokens audio en sortie | Non indiqué | Non indiqué |
Pour un exemple de planification, supposons dix minutes d’audio entrant et quatre minutes de parole générée par le modèle, en utilisant les estimations publiées pour Gemini 3.1 Flash Live :
- Entrée : 10 × $0.005 = $0.05
- Sortie : 4 × $0.018 = $0.072
- Sous-total audio : $0.122
Il s’agit d’un calcul de référence, pas d’un devis pour Gemini 3.8 Live. Il exclut le contexte accumulé, la transcription, les outils et toute nouvelle tarification 3.8. Les conversions à la minute sont des estimations : pour finaliser votre budget, utilisez la consommation de tokens remontée par votre propre réponse de facturation.
Gemini 3.8 Flash standard n’est pas le modèle de la Live API
Le modèle standard gemini-3.8-flash de Google produit du texte à partir d’entrées multimodales. La page tarifaire officielle affiche des tarifs de lancement de $0.75 par million de tokens en entrée et $3.75 par million de tokens en sortie jusqu’au 31 décembre 2026, puis des tarifs prévus de $1.50/$7.50 à partir du 1er janvier 2027.
Ces prix s’appliquent au modèle Flash standard, pas automatiquement à gemini-3.8-live ni à gemini-3.8-live-extended-thinking. La documentation distingue Flash standard de la capacité Live. Les noms partagent un numéro de version, mais Live requiert une sortie audio en streaming, la détection des tours de parole, la gestion des interruptions et le comportement d’une session en temps réel.
Dans une implémentation fiable, consignez l’identifiant exact du modèle renvoyé par le fournisseur. La simple mention de « Gemini 3.8 » dans un tableau de bord ne suffit pas pour attribuer correctement les coûts.
Faut-il construire sur Gemini 3.8 Live dès maintenant ?
Vous pouvez créer un prototype dès maintenant si votre principale interrogation porte sur le design de l’interaction : vos utilisateurs acceptent-ils le travail en arrière-plan, les mises à jour de progression à l’oral, l’ancrage visuel et les interruptions dans votre parcours ? Google a annoncé ces comportements, et le déploiement via l’API et AI Studio permet aux développeurs de tester l’intégration.
En revanche, différez un engagement de coût en production si votre modèle économique dépend d’une marge fixe à la minute. L’absence de grille tarifaire 3.8, l’impact inconnu de la refacturation du contexte et le manque de données indépendantes sur la latence et les défaillances laissent trop de variables pour établir des prévisions fiables d’économie unitaire.
Mettez en place un dispositif de mesure des coûts avant de basculer du trafic :
- Enregistrez les identifiants exacts des modèles et les réponses API.
- Relevez les minutes d’audio entrant, les minutes d’audio sortant, les tokens texte, les tokens de réflexion lorsqu’ils sont exposés, la transcription et les appels d’outils.
- Exécutez des sessions courtes, moyennes et longues avec le même jeu de tâches.
- Comparez le coût par tâche menée à bien, et non le coût par minute de connexion.
- Conservez une solution de repli sur un modèle Live actuellement tarifé jusqu’à ce que Google publie la grille tarifaire 3.8.
FAQ sur l’API Gemini 3.8 Live
Quel est le prix officiel de l’API Gemini 3.8 Live ?
L’annonce de lancement de Google n’indique aucun tarif en dollars, et la documentation tarifaire consultée ne fournit pas de grille distincte pour 3.8 Live.
Gemini 3.8 Live est-il gratuit dans Google AI Studio ?
Google indique que le déploiement a commencé dans AI Studio, mais l’accès, les quotas et les conditions du niveau gratuit sont distincts d’un tarif API de production garanti. Vérifiez la disponibilité des modèles et la page de facturation au niveau de votre compte.
Gemini 3.8 Flash est-il identique à Gemini 3.8 Live ?
Non. gemini-3.8-flash est un modèle standard distinct. Ses tarifs de lancement de $0.75/$3.75 par token ne doivent pas être présentés comme le prix d’une session audio Live.
La Gemini Live API facture-t-elle à la minute ?
Ce n’est pas sa règle de facturation fondamentale. Google documente une facturation par tokens ; les chiffres à la minute sont des estimations fondées sur les tarifs des tokens audio et une durée de parole supposée.
Une longue conversation Live peut-elle coûter plus cher au fil du temps ?
Oui. Le contexte conversationnel actif, les tokens audio, la transcription et l’activité des outils peuvent affecter la consommation lors des tours suivants. Mesurez une session représentative plutôt que de multiplier l’estimation d’un appel court.
Quelle différence entre Gemini 3.8 Live et Extended Thinking ?
Google positionne Gemini 3.8 Live pour un dialogue fluide et évolutif, ainsi que l’ancrage visuel. Extended Thinking cible un raisonnement plus approfondi en plusieurs étapes, tout en continuant de parler et de signaler sa progression.
Où Gemini 3.8 Live est-il disponible ?
Google a annoncé un déploiement via la Gemini API et AI Studio, l’accès entreprise étant initialement décrit comme un aperçu privé. La disponibilité peut varier selon le compte et la région.
Le budget défendable aujourd’hui est donc une fourchette construite à partir des tarifs actuels des tokens Live et du comportement mesuré des sessions, non un prix à la minute supposé pour Gemini 3.8 Live. Revoyez le calcul lorsque Google ajoutera le tarif officiel du modèle.