Un modello può essere ufficialmente disponibile anche senza un listino pubblico. È esattamente la situazione di Gemini 3.8 Live: Google ha annunciato Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking il 15 settembre 2026, ma nella documentazione non compare ancora un prezzo in dollari specifico per la 3.8 Live. Quindi non usare automaticamente le tariffe di Gemini 3.8 Flash, pari a $0.75/$3.75 per token, per calcolare il budget di un agente vocale.
In breve: Gemini 3.8 Live esiste, ma il prezzo API non è ancora pubblico
Nel post di lancio Google spiega che entrambi i modelli hanno iniziato a essere distribuiti agli sviluppatori tramite Gemini API e Google AI Studio il 15 settembre 2026. Questo conferma la disponibilità, non l’esistenza di un listino pubblico definitivo. L’annuncio descrive Gemini 3.8 Live come efficiente nei costi e Extended Thinking come proposta a prezzo competitivo, ma non indica alcuna tariffa per minuto o per token audio.
| Domanda | Risposta |
|---|---|
| Gemini 3.8 Live è stata lanciata ufficialmente? | Sì, Google l’ha annunciata il 15 settembre 2026. |
| Gli sviluppatori possono accedervi? | Google afferma che la distribuzione è iniziata tramite Gemini API e AI Studio. |
| Esiste un listino ufficiale per la 3.8 Live? | Non nella pagina dei prezzi di Gemini API consultata per questa guida. |
| Le tariffe di Gemini 3.8 Flash sono la stessa cosa? | No. gemini-3.8-flash e i modelli Live sono identificativi di modelli distinti. |
| È possibile calcolare oggi il costo esatto di una chiamata alla 3.8 Live? | No, non senza un prezzo specifico per il proprio account o una successiva tariffa ufficiale. |
Cosa ha lanciato Google il 15 settembre 2026
Google ha presentato due modelli audio per il dialogo in tempo reale, pensati per obiettivi operativi diversi. Gemini 3.8 Live punta su conversazioni fluide e scalabili; Gemini 3.8 Live Extended Thinking è destinata ai compiti più complessi e articolati, mantenendo comunque il dialogo attivo.
L’annuncio parla di input visivo quasi in tempo reale, passaggio automatico tra 97 lingue e chiamate a strumenti o API eseguite in background mentre il modello comunica all’utente che sta lavorando. Extended Thinking viene descritta come capace di ragionare e parlare contemporaneamente, fornendo aggiornamenti durante le attività più lunghe. Sono aspetti rilevanti anche per i costi: il lavoro in background, le chiamate agli strumenti e il ragionamento più approfondito possono modificare il consumo di token.
Quali modalità di accesso sono disponibili per chi acquista l’API?
La distribuzione di Google non corrisponde a un unico interruttore valido per tutti. L’annuncio ufficiale indica questi percorsi per gli sviluppatori:
| Superficie | Gemini 3.8 Live | Gemini 3.8 Live Extended Thinking |
|---|---|---|
| Gemini API | Distribuzione iniziata il 15 settembre 2026 | Distribuzione iniziata il 15 settembre 2026 |
| Google AI Studio | Distribuzione iniziata il 15 settembre 2026 | Distribuzione iniziata il 15 settembre 2026 |
| Gemini Enterprise | Anteprima privata | Anteprima privata |
Questa tabella va letta come una dichiarazione sulla distribuzione da parte di Google, non come una garanzia che ogni account visualizzi immediatamente lo stesso model ID. Per verificare la situazione concreta bisogna controllare l’elenco dei modelli disponibili via API e i permessi del proprio progetto.
Come funziona la fatturazione della Gemini Live API in assenza di un listino per la 3.8
La documentazione di Google sulle best practice della Live API descrive una fatturazione basata sui token, non una tariffa fissa per sessione. L’audio viene convertito in consumo di token audio; i messaggi testuali e le trascrizioni generate possono aggiungere ulteriore consumo di token testuali. Inoltre, una sessione prolungata può diventare più costosa man mano che cresce il contesto della conversazione attiva.
Per il budget, le regole da tenere presenti sono:
- Non considerare i minuti di connessione come unità ufficiale di fatturazione. Il costo per minuto è una stima ricavata dalla tokenizzazione e dalla durata del parlato.
- Separa l’audio in ingresso da quello in uscita. Il modello può ascoltare per dieci minuti e parlare per quattro: sono due flussi di consumo diversi.
- Considera la crescita del contesto. Le indicazioni di Google avvertono che il contesto audio nativo accumulato può rientrare nella fatturazione nei turni successivi, in base alla gestione del contesto.
- Calcola a parte le trascrizioni, quando attive. Le trascrizioni possono generare costi per token testuali oltre a quelli dell’audio.
- Monitora chiamate agli strumenti e token di ragionamento. Il lavoro in background può consumare più token di output o di contesto rispetto a un semplice bot che alterna ascolto e risposta.
Ecco perché “mezzo centesimo al minuto” non può sostituire un prezzo ufficiale per la 3.8. Potrebbe riferirsi a una sola direzione dell’audio e a una specifica ipotesi di tokenizzazione.
Come impostare oggi una stima dei costi
Finché Google non pubblicherà le tariffe di Gemini 3.8 Live, usa i modelli Live già prezzati come base di pianificazione, non come indicazione del prezzo del nuovo modello. La documentazione ufficiale sui prezzi di Gemini riporta queste tariffe di riferimento:
| Modello | Input audio | Output audio | Input testuale | Output testuale |
|---|---|---|---|---|
| Gemini 3.1 Flash Live Preview | $3.00 per 1M token audio (circa $0.005/min) | $12.00 per 1M token audio (circa $0.018/min) | $0.75 per 1M | $4.50 per 1M |
| Gemini 2.5 Flash Native Audio | $3.00 per 1M token audio | $12.00 per 1M token audio | $0.50 per 1M | $2.00 per 1M |
| Gemini 3.5 Live Translate | $3.50 per 1M token audio in ingresso | $21.00 per 1M token audio in uscita | Non indicato | Non indicato |
Per un esempio di pianificazione, ipotizziamo dieci minuti di audio in ingresso e quattro minuti di parlato del modello, utilizzando le stime pubblicate per Gemini 3.1 Flash Live:
- Input: 10 × $0.005 = $0.05
- Output: 4 × $0.018 = $0.072
- Subtotale audio: $0.122
Si tratta di un calcolo di riferimento, non di un preventivo per Gemini 3.8 Live. La stima non include il contesto accumulato, le trascrizioni, gli strumenti né eventuali nuove tariffe per la 3.8. Le conversioni da minuti sono stime: per il budget definitivo bisogna usare il consumo di token riportato dalla propria risposta di fatturazione.
Gemini 3.8 Flash standard non è il modello della Live API
gemini-3.8-flash, il modello standard di Google, produce testo e accetta input multimodali. La pagina ufficiale dei prezzi indica tariffe introduttive pari a $0.75 per 1 milione di token in ingresso e $3.75 per 1 milione di token in uscita fino al 31 dicembre 2026, con tariffe programmate di $1.50/$7.50 a partire dal 1° gennaio 2027.
Questi prezzi valgono per il modello Flash standard e non si applicano automaticamente a gemini-3.8-live o gemini-3.8-live-extended-thinking. La documentazione distingue chiaramente il modello Flash standard dalle funzionalità Live. Il numero di versione è lo stesso, ma Live richiede output audio in streaming, rilevamento dei turni, gestione delle interruzioni e comportamento di sessione in tempo reale.
Un’implementazione affidabile dovrebbe registrare il model ID esatto restituito dal provider. La dicitura “Gemini 3.8” mostrata in una dashboard non è abbastanza precisa per attribuire correttamente i costi.
Conviene iniziare ora a sviluppare con Gemini 3.8 Live?
Ha senso creare subito un prototipo se la domanda principale riguarda l’esperienza d’interazione: gli utenti accettano il lavoro in background, gli aggiornamenti vocali sull’avanzamento, il grounding visivo e le interruzioni nel flusso di lavoro? Google ha annunciato queste funzionalità e la distribuzione tramite API e AI Studio permette agli sviluppatori di testare l’integrazione.
Meglio rimandare un impegno produttivo sui costi se il modello di business dipende da un margine fisso per minuto. L’assenza del listino per la 3.8, l’impatto ancora incerto della rifatturazione del contesto e la mancanza di dati misurati in modo indipendente su latenza e malfunzionamenti lasciano troppe variabili per una previsione affidabile dell’economia unitaria.
Prima di spostare il traffico, prepara un sistema per misurare i costi:
- Registra i model ID esatti e le risposte dell’API.
- Raccogli minuti di audio in ingresso, minuti di audio in uscita, token testuali, token di pensiero quando disponibili, trascrizioni e chiamate agli strumenti.
- Esegui sessioni brevi, medie e lunghe usando lo stesso set di attività.
- Confronta il costo per attività completata con successo, non il costo per minuto di connessione.
- Mantieni un fallback su un modello Live già prezzato finché Google non pubblicherà il listino della 3.8.
FAQ sulla Gemini 3.8 Live API
Qual è il prezzo ufficiale della Gemini 3.8 Live API?
L’annuncio di Google non indica un prezzo in dollari e la documentazione sui prezzi consultata non fornisce un listino distinto per la 3.8 Live.
Gemini 3.8 Live è gratuita in Google AI Studio?
Google afferma che la distribuzione è iniziata in AI Studio, ma accesso, quote e condizioni del piano gratuito sono aspetti separati dal prezzo garantito dell’API in produzione. Controlla la disponibilità del modello per il tuo account e la pagina di fatturazione.
Gemini 3.8 Flash è la stessa cosa di Gemini 3.8 Live?
No. gemini-3.8-flash è un modello standard distinto. I suoi prezzi introduttivi di $0.75/$3.75 per token non devono essere presentati come il costo di una sessione audio Live.
La Gemini Live API viene fatturata al minuto?
Non come regola di fatturazione fondamentale. Google documenta una fatturazione basata sui token; i valori per minuto sono stime fondate sulle tariffe dei token audio e su una durata del parlato ipotizzata.
Una conversazione Live lunga può costare di più con il passare del tempo?
Sì. Il contesto attivo della conversazione, i token audio, le trascrizioni e l’attività degli strumenti possono influenzare il consumo nei turni successivi. Misura una sessione rappresentativa invece di moltiplicare la stima di una chiamata breve.
Qual è la differenza tra Gemini 3.8 Live ed Extended Thinking?
Google presenta Gemini 3.8 Live come un modello per dialoghi fluidi e scalabili, con grounding visivo. Extended Thinking è pensata per un ragionamento più approfondito su attività articolate, continuando a parlare e a comunicare l’avanzamento.
Dove è disponibile Gemini 3.8 Live?
Google ha annunciato la distribuzione tramite Gemini API e AI Studio, mentre l’accesso enterprise è stato inizialmente descritto come anteprima privata. La disponibilità può variare in base all’account e alla regione.
Oggi, quindi, il budget più difendibile è un intervallo costruito sulle tariffe correnti dei token Live e sul comportamento misurato delle sessioni, non un prezzo al minuto inventato per Gemini 3.8 Live. Ricalcola tutto quando Google aggiungerà la tariffa ufficiale del modello.