AIREITER
GoogleText Chat

Gemini 3.7 Flash

Testen Sie Gemini 3.7 Flash online für reaktionsschnellen Chat, Code, Dokumentenverarbeitung, Streaming-Ausgabe, Cache-Nutzung und Zugriff auf die Chat Completions API.

EingabeOffiziell $0.75 pro 1 Mio. TokensAIReiter $0.225 pro 1 Mio. TokensAusgabeOffiziell $3.75 pro 1 Mio. TokensAIReiter $1.125 pro 1 Mio. TokensCache-LesenOffiziell $0.075 pro 1 Mio. TokensAIReiter $0.0225 pro 1 Mio. Tokens
Mit API ausführen

EINGABE

AUSGABE

Example
Generated in
42.7 seconds
Eingabe-Token
134
Ausgabe-Token
2354
Tokens per second
55.13 tokens / second
Time to first token
-

Modelldetails

Verwenden Sie denselben Modellschlüssel im Playground, in API-Anfragen und in internen Workflows.

Modell-ID
gemini-3.7-flash
Anbieter
Google
Protokoll
OpenAI Chat Completions
Kontextfenster
1,048,576 Token
Maximale Ausgabe
65,536 Token
Eingabe-Token
22.5 Credits / 1 Mio. Token
Ausgabe-Token
112.5 Credits / 1 Mio. Token
Cache-Lesen
2.25 Credits / 1 Mio. Token
Cache-Schreiben
-

Was Sie mit Gemini 3.7 Flash tun können

Ein reaktionsschneller Weg für Assistenten, Code-Hilfe, Dokumentenverarbeitung und wiederholte API-Arbeit.

Reaktionsschnelle Assistenten

Setzen Sie chatbasierte Nutzererlebnisse und interne Copilots ein, bei denen gestreamte Ausgaben die Interaktion am Laufen halten.

Dokumentenverarbeitung

Fassen Sie eingehende Texte zusammen, klassifizieren, transformieren und extrahieren Sie strukturierte Erkenntnisse daraus.

Codierungsunterstützung

Erstellen Sie Implementierungs-Checklisten, erklären Sie Code, generieren Sie Tests und beantworten Sie gezielte Entwicklerfragen.

Automatisierung mit hohem Durchsatz

Führen Sie wiederholte Content- und Operations-Aufgaben mit transparentem Input-, Output- und zwischengespeichertem Token-Verbrauch aus.

Gemini 3.7 Flash Anwendungsfälle

Am besten geeignet für Workloads, die nützliche Ergebnisse benötigen, ohne jede Anfrage an ein Flaggschiff-Modell weiterzuleiten.
01

Interaktiver Chat

Beantworten Sie Produkt-, Support- und internes Wissensfragen über eine reaktionsschnelle, gestreamte Oberfläche.

02

Dokumenten-Pipelines

Konvertieren Sie Berichte, Tickets und Notizen in Zusammenfassungen, Felder, Tags und Maßnahmenlisten.

03

Entwickler-Workflows

Erzeugen Sie fokussierten Code, Tests, Erklärungen und Akzeptanzkriterien für Implementierungen.

04

Content-Operationen

Erstellen Sie Varianten, Briefings, Metadaten und strukturierte Entwürfe für häufige API-Jobs.

Sollten Sie von Gemini 3.6 Flash umsteigen?

Betrachten Sie 3.7 Flash als einen neuen Weg, den Sie bewerten sollten, nicht als automatischen Ersatz aufgrund der Versionsnummer.

Beginnen Sie mit Ihrem Regression-Set

Vergleichen Sie beide Versionen anhand der Prompts, Ausgabeformate und Sprachen, die Ihre Anwendung tatsächlich verwendet.

Messen Sie die gesamte Ausgabennutzung

Thinking- oder Hidden-Reasoning-Tokens können die berechnete Ausgabe beeinflussen, selbst wenn die sichtbare Antwort kurz ist.

Überprüfen Sie das Cache-Verhalten

Wiederholen Sie stabile, berechtigte Präfixe und bestätigen Sie prompt_tokens_details.cached_tokens, statt Wiederverwendung einfach anzunehmen.

Schrittweise ausrollen

Senden Sie zunächst einen kleinen Traffic-Anteil und vergleichen Sie akzeptierte Antworten, Latenz, Fehler und Kosten pro abgeschlossenem Task.

So verwenden Sie Gemini 3.7 Flash

Testen Sie das Modell online und übernehmen Sie dann dieselbe ID in Ihre Anwendung.

01

Wählen Sie eine repräsentative Prompt

Verwenden Sie dasselbe Dokument-, Coding- oder Assistant-Task, das in der Produktion ausgeführt wird.

02

Prüfen Sie Qualität und Nutzung

Überprüfen Sie die Antwort, den Abschlussgrund, die Reasoning-Tokens, die zwischengespeicherten Tokens und die gesamte Token-Anzahl.

03

Chat Completions verbinden

Rufen Sie POST https://aireiter.com/api/v1/chat/completions mit model "gemini-3.7-flash" und bei Bedarf stream=true auf.

Gemini 3.7 Flash API-Fragen

Fragen zu Kompatibilität, Caching, Preisgestaltung und Migration für Produktionsteams.

/ 01

Wofür eignet sich Gemini 3.7 Flash am besten?

Verwenden Sie es für reaktionsschnelle Assistenten, Dokumenten-Pipelines, fokussierte Coding-Unterstützung und wiederholte Textautomatisierung.

/ 02

Worin unterscheidet es sich von Gemini 3.6 Flash?

Betrachten Sie es als einen neueren Weg und vergleichen Sie beide mit Ihrem eigenen Prompt-Set. Gehen Sie nicht davon aus, dass es allgemein eine bessere Qualität oder geringere Latenz bietet.

/ 03

Welchen Endpoint sollte ich verwenden?

Verwenden Sie POST https://aireiter.com/api/v1/chat/completions mit model "gemini-3.7-flash".

/ 04

Wie überprüfe ich das Prompt-Caching?

Prüfen Sie usage.prompt_tokens_details.cached_tokens. AIReiter-Tests beobachteten Cache-Treffer bei späteren Anfragen mit einem identischen zulässigen Präfix.

/ 05

Warum kann die Ausgabe-Nutzung den sichtbaren Text überschreiten?

Der Anbieter kann Reasoning-Tokens in der Completion-Nutzung berücksichtigen. Verwenden Sie das zurückgegebene usage-Objekt als verbindliche Quelle für die Abrechnung.