AIREITER

Gemini 3.8 Live API-Preise: Was 2026 offiziell bekannt ist

Zuletzt aktualisiert: 2026-09-15 18:52:02

Ein Modell kann offiziell verfügbar sein, ohne dass es bereits eine öffentliche Preisliste gibt. Genau das ist derzeit bei Gemini 3.8 Live der Fall: Google kündigte Gemini 3.8 Live und Gemini 3.8 Live Extended Thinking am 15. September 2026 an, nennt in der Dokumentation aber weiterhin keinen eigenen Dollarpreis für 3.8 Live. Die Tokenpreise von Gemini 3.8 Flash mit $0.75/$3.75 gehören deshalb nicht unverändert in die Kalkulation eines Sprachassistenten.

Gemini 3.8 Live ist gestartet – ein offizieller API-Preis fehlt noch

Laut Googles Ankündigung begann der Rollout beider Modelle für Entwickler am 15. September 2026 über die Gemini API und Google AI Studio. Das bestätigt die Verfügbarkeit, nicht aber eine abschließende öffentliche Preisgestaltung. Google bezeichnet Gemini 3.8 Live als kosteneffizient und Extended Thinking als wettbewerbsfähig bepreist, nennt jedoch weder einen Minutenpreis noch Preise pro Audio-Token.

FrageAntwort
Ist Gemini 3.8 Live offiziell gestartet?Ja, Google kündigte es am 15. September 2026 an.
Haben Entwickler Zugriff?Google zufolge begann der Rollout über die Gemini API und AI Studio.
Gibt es eine offizielle Preisliste für 3.8 Live?Nicht auf der für diesen Leitfaden geprüften Gemini API-Preisseite.
Entspricht das den Preisen von Gemini 3.8 Flash?Nein. gemini-3.8-flash und die Live-Modelle sind unterschiedliche Modellkennungen.
Lassen sich die exakten Kosten eines 3.8-Live-Aufrufs heute berechnen?Nein, nicht ohne einen kontospezifischen Preis oder einen späteren offiziellen Preiseintrag.

Diese Modelle stellte Google am 15. September 2026 vor

Google führte zwei Audiomodelle für Live-Dialoge ein, die unterschiedliche Einsatzziele haben. Gemini 3.8 Live ist für flüssige, skalierbare Gespräche gedacht; Gemini 3.8 Live Extended Thinking für anspruchsvollere Aufgaben mit mehreren Schritten, ohne den Gesprächsfluss zu unterbrechen.

Die Ankündigung nennt nahezu Echtzeit-Eingaben per Bild, automatisches Wechseln zwischen 97 Sprachen sowie Tool- oder API-Aufrufe im Hintergrund, die weiterlaufen können, während das Modell dem Nutzer bereits Rückmeldung gibt. Extended Thinking soll gleichzeitig denken und sprechen und bei längeren Aufgaben Fortschrittssignale geben. Für die Preisplanung ist das relevant, weil Hintergrundarbeit, Tool-Aufrufe und tieferes Reasoning den Tokenverbrauch verändern können.

Über welche Wege erhalten API-Kunden Zugriff?

Der Rollout erfolgt nicht für alle Zugänge gleichzeitig. Die offizielle Ankündigung nennt folgende praktische Zugangswege für Entwickler:

PlattformGemini 3.8 LiveGemini 3.8 Live Extended Thinking
Gemini APIRollout begann am 15. September 2026Rollout begann am 15. September 2026
Google AI StudioRollout begann am 15. September 2026Rollout begann am 15. September 2026
Gemini EnterprisePrivate PreviewPrivate Preview

Diese Tabelle beschreibt Googles Rollout-Status, garantiert jedoch nicht, dass jedes Konto sofort dieselbe Modell-ID sieht. Entscheidend sind die API-Modellliste und die Berechtigungen des jeweiligen Projekts.

So funktioniert die Abrechnung der Gemini Live API ohne 3.8-Preisliste

Googles Dokumentation zu den Best Practices für die Live API beschreibt eine tokenbasierte Abrechnung statt einer Pauschale pro Sitzung. Audio wird in Audio-Token umgewandelt; Textnachrichten und erzeugte Transkripte können zusätzliche Text-Token verursachen. Bei langen Sitzungen können die Kosten zudem steigen, wenn der aktive Gesprächskontext anwächst.

Für die Budgetplanung sind vor allem diese Regeln wichtig:

  1. Verbindungsminuten sind keine offizielle Abrechnungseinheit. Ein Minutenpreis ist lediglich eine Schätzung, abgeleitet aus Tokenisierung und Sprechdauer.
  2. Audioeingabe und Audioausgabe getrennt rechnen. Das Modell kann zehn Minuten zuhören und vier Minuten sprechen – das sind zwei unterschiedliche Verbrauchsströme.
  3. Wachsenden Kontext einplanen. Google weist darauf hin, dass angesammelter nativer Audiokontext in späteren Turns abgerechnet werden kann, abhängig von der Kontextverarbeitung.
  4. Transkription bei Aktivierung separat berücksichtigen. Transkripte können zusätzlich zum Audioverbrauch Kosten für Text-Token erzeugen.
  5. Tool-Aufrufe und Reasoning-Token erfassen. Hintergrundarbeit kann mehr Ausgabe- oder Kontext-Token verbrauchen als ein einfacher Bot mit abwechselnden Gesprächszügen.

Deshalb ersetzt „einen halben Cent pro Minute“ keinen offiziellen 3.8-Preis. Diese Zahl kann unter einer bestimmten Tokenisierungsannahme nur eine Audiorichtung beschreiben.

Womit sich heute rechnen lässt

Bis Google Preise für Gemini 3.8 Live veröffentlicht, eignen sich derzeit bepreiste Live-Modelle als Planungsgrundlage – nicht als Preisersatz für das neue Modell. Die offizielle Gemini-Preisdokumentation führt diese Referenzpreise auf:

ModellAudioeingabeAudioausgabeTexteingabeTextausgabe
Gemini 3.1 Flash Live Preview$3.00 pro 1 Mio. Audio-Token (etwa $0.005/Min.)$12.00 pro 1 Mio. Audio-Token (etwa $0.018/Min.)$0.75 pro 1 Mio.$4.50 pro 1 Mio.
Gemini 2.5 Flash Native Audio$3.00 pro 1 Mio. Audio-Token$12.00 pro 1 Mio. Audio-Token$0.50 pro 1 Mio.$2.00 pro 1 Mio.
Gemini 3.5 Live Translate$3.50 pro 1 Mio. Audio-Eingabe-Token$21.00 pro 1 Mio. Audio-Ausgabe-TokenNicht aufgeführtNicht aufgeführt

Ein Planungsbeispiel: Angenommen werden zehn Minuten eingehendes Audio und vier Minuten Modellausgabe auf Basis der veröffentlichten Schätzwerte für Gemini 3.1 Flash Live:

  • Eingabe: 10 × $0.005 = $0.05
  • Ausgabe: 4 × $0.018 = $0.072
  • Audio-Zwischensumme: $0.122

Das ist eine Beispielrechnung zur Orientierung, kein Angebotspreis für Gemini 3.8 Live. Sie schließt angesammelten Kontext, Transkription, Tools und mögliche neue 3.8-Preise aus. Da die Umrechnung in Minuten geschätzt ist, sollte das endgültige Budget auf dem Tokenverbrauch aus den eigenen Abrechnungsantworten basieren.

Gemini 3.8 Flash ist nicht das Live-API-Modell

Googles reguläres gemini-3.8-flash ist ein Modell mit Textausgabe und multimodaler Eingabe. Die offizielle Preisseite nennt Einführungspreise von $0.75 pro 1 Million Eingabe-Token und $3.75 pro 1 Million Ausgabe-Token bis zum 31. Dezember 2026. Ab dem 1. Januar 2027 sind $1.50/$7.50 vorgesehen.

Diese Preise gelten für das reguläre Flash-Modell, nicht automatisch für gemini-3.8-live oder gemini-3.8-live-extended-thinking. In der Modelldokumentation behandelt Google Standard Flash getrennt von den Live-Funktionen. Beide Namen tragen zwar dieselbe Versionsnummer, Live benötigt jedoch gestreamte Audioausgabe, Sprecherwechselerkennung, Unterbrechungsbehandlung und Sitzungsverhalten in Echtzeit.

Eine robuste Implementierung sollte die vom Anbieter zurückgegebene exakte Modell-ID protokollieren. „Gemini 3.8“ in einem Dashboard ist für eine Kostenattribution nicht präzise genug.

Lohnt es sich, jetzt auf Gemini 3.8 Live zu setzen?

Für einen Prototyp ist jetzt der richtige Zeitpunkt, wenn es primär um das Interaktionsdesign geht: Akzeptieren Nutzer Hintergrundarbeit, mündliche Fortschrittsmeldungen, visuelle Kontextinformationen und Unterbrechungen im jeweiligen Workflow? Google hat diese Verhaltensweisen angekündigt, und der Rollout über API und AI Studio ermöglicht Entwicklern, die Integration zu testen.

Eine verbindliche Produktionskalkulation sollte warten, wenn das Geschäftsmodell auf einer festen Marge pro Minute beruht. Die fehlende 3.8-Preisliste, der unbekannte Effekt einer erneuten Kontextabrechnung und das Fehlen unabhängig gemessener Daten zu Latenz und Ausfällen lassen zu viele Variablen für eine belastbare Unit-Economics-Prognose offen.

Vor der Umstellung von Traffic empfiehlt sich ein Kostenmesssystem:

  1. Exakte Modell-IDs und API-Antworten erfassen.
  2. Minuten für Audioeingabe und Audioausgabe, Text-Token, Reasoning-Token, sofern sichtbar, Transkription und Tool-Aufrufe dokumentieren.
  3. Kurze, mittellange und lange Sitzungen mit demselben Aufgabenset durchführen.
  4. Kosten pro erfolgreich abgeschlossener Aufgabe vergleichen, nicht Kosten pro Verbindungsminute.
  5. Ein Fallback auf ein aktuell bepreistes Live-Modell behalten, bis Google die 3.8-Preisliste veröffentlicht.

FAQ zur Gemini 3.8 Live API

Wie hoch ist der offizielle Preis der Gemini 3.8 Live API?

Googles Ankündigung nennt keinen Dollarpreis, und die geprüfte Preisdokumentation enthält keine eigene Preisliste für 3.8 Live.

Ist Gemini 3.8 Live in Google AI Studio kostenlos?

Google sagt, dass der Rollout in AI Studio begonnen hat. Zugriff, Kontingente und Bedingungen für kostenlose Tarife sind jedoch etwas anderes als ein garantierter API-Preis für den Produktionseinsatz. Prüfen Sie die Verfügbarkeit des Modells und die Abrechnungsseite auf Kontoebene.

Ist Gemini 3.8 Flash dasselbe wie Gemini 3.8 Live?

Nein. gemini-3.8-flash ist ein separates Standardmodell. Seine Einführungspreise von $0.75/$3.75 pro Token sollten nicht als Preis einer Live-Audiositzung dargestellt werden.

Rechnet die Gemini Live API pro Minute ab?

Nicht als grundlegende Abrechnungsregel. Google dokumentiert tokenbasierte Abrechnung; Werte pro Minute sind Schätzungen auf Basis von Audio-Tokenpreisen und angenommener Sprechdauer.

Kann ein langes Live-Gespräch mit der Zeit teurer werden?

Ja. Aktiver Gesprächskontext, Audio-Token, Transkription und Tool-Aktivität können den Verbrauch in späteren Turns beeinflussen. Statt eine kurze Gesprächsschätzung hochzurechnen, sollte eine repräsentative Sitzung gemessen werden.

Was unterscheidet Gemini 3.8 Live von Extended Thinking?

Google positioniert Gemini 3.8 Live für flüssige, skalierbare Dialoge und visuelle Kontextverarbeitung. Extended Thinking ist für tiefergehendes Reasoning über mehrere Schritte gedacht und spricht weiter, während es Fortschritt meldet.

Wo ist Gemini 3.8 Live verfügbar?

Google kündigte den Rollout über die Gemini API und AI Studio an; der Enterprise-Zugang wurde zunächst als Private Preview beschrieben. Die Verfügbarkeit kann je nach Konto und Region abweichen.

Eine belastbare Budgetplanung besteht heute daher aus einer Spanne, die sich aus aktuellen Live-Tokenpreisen und gemessenem Sitzungsverhalten ableitet – nicht aus einem geratenen Minutenpreis für Gemini 3.8 Live. Die Kalkulation sollte erneut geprüft werden, sobald Google den offiziellen Preiseintrag für das Modell ergänzt.