AIREITER
GoogleText Chat

Gemini 3.7 Flash

Essayez Gemini 3.7 Flash en ligne pour un chat réactif, le codage, le traitement de documents, la sortie en streaming, l'utilisation du cache et l'accès à l'API Chat Completions.

EntréeOfficiel $0.75 par million de tokensAIReiter $0.225 par million de tokensSortieOfficiel $3.75 par million de tokensAIReiter $1.125 par million de tokensLecture cacheOfficiel $0.075 par million de tokensAIReiter $0.0225 par million de tokens
Exécuter avec l'API

ENTRÉE

SORTIE

Example
Generated in
42.7 seconds
Token d’entrée
134
Token de sortie
2354
Tokens per second
55.13 tokens / second
Time to first token
-

Détails du modèle

Utilisez la même clé de modèle dans le Playground, les requêtes API et les workflows internes.

ID du modèle
gemini-3.7-flash
Fournisseur
Google
Protocole
OpenAI Chat Completions
Fenêtre de contexte
1,048,576 tokens
Sortie maximale
65,536 tokens
Token d’entrée
22.5 crédits / 1 M de tokens
Token de sortie
112.5 crédits / 1 M de tokens
Lecture du cache
2.25 crédits / 1 M de tokens
Écriture du cache
-

Ce que vous pouvez faire avec Gemini 3.7 Flash

Une voie réactive pour les assistants, l'aide au code, le traitement de documents et les tâches API répétées.

Assistants réactifs

Alimentez des chats destinés aux utilisateurs et des copilotes internes où la sortie en streaming maintient l'interaction en mouvement.

Traitement de documents

Résumez, classez, transformez et extrayez des informations structurées à partir du texte entrant.

Assistance au codage

Rédigez des listes de contrôle d'implémentation, expliquez du code, générez des tests et répondez à des प्रश्नquestions ciblées de développeurs.

Automatisation à haut débit

Exécutez des tâches répétées de contenu et d'opérations avec une utilisation transparente des entrées, des sorties et des jetons mis en cache.

Cas d'utilisation de Gemini 3.7 Flash

Idéal pour les charges de travail qui nécessitent des résultats utiles sans rediriger chaque requête vers un modèle phare.
01

Chat interactif

Répondez aux questions sur les produits, le support et les connaissances internes via une interface réactive en streaming.

02

Pipelines de documents

Convertissez des rapports, des tickets et des notes en résumés, champs, tags et listes d'actions.

03

Flux de travail des développeurs

Générez du code ciblé, des tests, des explications et des critères d'acceptation d'implémentation.

04

Opérations de contenu

Produisez des variantes, des briefs, des métadonnées et des brouillons structurés pour des tâches API fréquentes.

Faut-il passer de Gemini 3.6 Flash ?

Considérez 3.7 Flash comme une nouvelle option à évaluer, et non comme un remplacement automatique basé sur le numéro de version.

Commencez par votre ensemble de régression

Comparez les deux versions sur les prompts, les formats de sortie et les langues réellement utilisés par votre application.

Mesurez l'utilisation totale de la sortie

Les tokens de réflexion ou de raisonnement cachés peuvent affecter la sortie facturée même lorsque la réponse visible est courte.

Vérifiez le comportement du cache

Répétez les préfixes éligibles stables et confirmez prompt_tokens_details.cached_tokens au lieu de supposer une réutilisation.

Déployez progressivement

Envoyez d'abord une petite part du trafic et comparez les réponses acceptées, la latence, les erreurs et le coût par tâche terminée.

Comment utiliser Gemini 3.7 Flash

Testez le modèle en ligne, puis intégrez le même ID dans votre application.

01

Choisissez une invite représentative

Utilisez le même document, le même code ou la même tâche d’assistant qui s’exécutera en production.

02

Inspectez la qualité et l’utilisation

Passez en revue la réponse, la raison de complétion, les jetons de raisonnement, les jetons mis en cache et le nombre total de jetons.

03

Connecter Chat Completions

Appelez POST https://aireiter.com/api/v1/chat/completions avec le modèle "gemini-3.7-flash" et stream=true lorsque nécessaire.

Questions sur l’API Gemini 3.7 Flash

Questions sur la compatibilité, la mise en cache, la tarification et la migration pour les équipes de production.

/ 01

À quoi Gemini 3.7 Flash sert-il le mieux ?

Utilisez-le pour des assistants réactifs, des pipelines de documents, une assistance ciblée au codage et l’automatisation répétée de textes.

/ 02

En quoi est-il différent de Gemini 3.6 Flash ?

Considérez-le comme une version plus récente et comparez les deux avec votre propre ensemble d’invites. Évitez de supposer une amélioration universelle de la qualité ou de la latence.

/ 03

Quel point de terminaison dois-je utiliser ?

Utilisez POST https://aireiter.com/api/v1/chat/completions avec le modèle "gemini-3.7-flash".

/ 04

Comment vérifier la mise en cache des invites ?

Vérifiez usage.prompt_tokens_details.cached_tokens. Les tests AIReiter ont observé des accès au cache lors de requêtes ultérieures avec un préfixe éligible identique.

/ 05

Pourquoi l’utilisation en sortie peut-elle dépasser le texte visible ?

Le fournisseur peut inclure des jetons de raisonnement dans l’utilisation de la complétion. Utilisez l’objet usage retourné comme source de vérité pour la facturation.