AIREITER
GoogleText Chat

Gemini 3.7 Flash

Experimente o Gemini 3.7 Flash online para chat responsivo, programação, processamento de documentos, saída em streaming, uso de cache e acesso à Chat Completions API.

EntradaOficial $0.75 por 1 milhao de tokensAIReiter $0.225 por 1 milhao de tokensSaídaOficial $3.75 por 1 milhao de tokensAIReiter $1.125 por 1 milhao de tokensLeitura de cacheOficial $0.075 por 1 milhao de tokensAIReiter $0.0225 por 1 milhao de tokens
Executar com API

ENTRADA

SAÍDA

Example
Generated in
42.7 seconds
Token de entrada
134
Token de saída
2354
Tokens per second
55.13 tokens / second
Time to first token
-

Detalhes do modelo

Use a mesma chave de modelo no Playground, nas solicitações da API e nos fluxos de trabalho internos.

ID do modelo
gemini-3.7-flash
Provedor
Google
Protocolo
OpenAI Chat Completions
Janela de contexto
1,048,576 tokens
Saída máxima
65,536 tokens
Token de entrada
22.5 créditos / 1 mi de tokens
Token de saída
112.5 créditos / 1 mi de tokens
Leitura de cache
2.25 créditos / 1 mi de tokens
Gravação de cache
-

O que Você Pode Fazer com o Gemini 3.7 Flash

Uma opção responsiva para assistentes, ajuda com código, processamento de documentos e trabalho repetitivo via API.

Assistentes responsivos

Potencialize chat voltado ao usuário e copilotos internos em que a saída em streaming mantém a interação fluindo.

Processamento de documentos

Resuma, classifique, transforme e extraia insights estruturados de textos recebidos.

Suporte a programação

Elabore checklists de implementação, explique código, gere testes e responda a perguntas específicas de desenvolvedores.

Automação de alta capacidade

Execute tarefas repetitivas de conteúdo e operações com uso transparente de entrada, saída e tokens em cache.

Casos de Uso do Gemini 3.7 Flash

Ideal para cargas de trabalho que precisam de resultados úteis sem encaminhar cada solicitação para um modelo principal.
01

Chat interativo

Responda a perguntas sobre produto, suporte e conhecimento interno por meio de uma interface responsiva em streaming.

02

Pipelines de documentos

Converta relatórios, tickets e anotações em resumos, campos, tags e listas de ações.

03

Fluxos de trabalho de desenvolvimento

Gere código focado, testes, explicações e critérios de aceitação de implementação.

04

Operações de conteúdo

Produza variações, briefings, metadados e rascunhos estruturados em tarefas frequentes via API.

Devo migrar do Gemini 3.6 Flash?

Trate o 3.7 Flash como uma nova opção a ser avaliada, e não como uma substituição automática com base no número da versão.

Comece com seu conjunto de regressão

Compare ambas as versões nos prompts, formatos de saída e idiomas que sua aplicação realmente usa.

Meça o uso total de saída

Tokens de raciocínio ou reasoning oculto podem afetar a saída cobrada mesmo quando a resposta visível é curta.

Verifique o comportamento do cache

Repita prefixos estáveis e elegíveis e confirme prompt_tokens_details.cached_tokens em vez de assumir reutilização.

Faça a implementação gradualmente

Envie primeiro uma pequena parcela do tráfego e compare respostas aceitas, latência, erros e custo por tarefa concluída.

Como usar o Gemini 3.7 Flash

Teste o modelo online e depois leve o mesmo ID para o seu aplicativo.

01

Escolha um prompt representativo

Use o mesmo documento, código ou tarefa de assistente que será executado em produção.

02

Inspecione a qualidade e o uso

Revise a resposta, o motivo de conclusão, os tokens de raciocínio, os tokens em cache e o total de tokens.

03

Conecte o Chat Completions

Chame POST https://aireiter.com/api/v1/chat/completions com model "gemini-3.7-flash" e stream=true quando necessário.

Perguntas sobre a API do Gemini 3.7 Flash

Perguntas sobre compatibilidade, cache, preços e migração para equipes de produção.

/ 01

Para que o Gemini 3.7 Flash é melhor?

Use-o para assistentes responsivos, pipelines de documentos, suporte focado a código e automação repetida de texto.

/ 02

Em que ele é diferente do Gemini 3.6 Flash?

Trate-o como uma rota mais nova e compare ambos com seu próprio conjunto de prompts. Evite assumir uma melhora universal de qualidade ou latência.

/ 03

Qual endpoint devo usar?

Use POST https://aireiter.com/api/v1/chat/completions com model "gemini-3.7-flash".

/ 04

Como verifico o cache de prompts?

Verifique usage.prompt_tokens_details.cached_tokens. Os testes da AIReiter observaram acertos de cache em solicitações posteriores com um prefixo idêntico elegível.

/ 05

Por que o uso de saída pode exceder o texto visível?

O provedor pode incluir tokens de raciocínio no uso de completion. Use o objeto usage retornado como a fonte confiável para cobrança.