AIREITER

Preços da API Gemini 3.8 Live: o que é oficial em 2026

Última Atualização: 2026-09-15 18:53:06

Um modelo pode estar oficialmente disponível antes de ganhar uma tabela pública de preços. É exatamente o caso do Gemini 3.8 Live: o Google anunciou o Gemini 3.8 Live e o Gemini 3.8 Live Extended Thinking em 15 de setembro de 2026, mas a documentação ainda não informa um preço específico em dólares para o 3.8 Live. Portanto, não use as tarifas de $0.75/$3.75 por token do Gemini 3.8 Flash para projetar o custo de um agente de voz.

Resposta curta: o Gemini 3.8 Live existe, mas a API ainda não tem preço publicado

Segundo a publicação de lançamento do Google, a distribuição dos dois modelos para desenvolvedores via Gemini API e Google AI Studio começou em 15 de setembro de 2026. Isso confirma a disponibilidade, não uma precificação pública definitiva. O anúncio classifica o Gemini 3.8 Live como econômico e o Extended Thinking como competitivamente precificado, mas não divulga uma tarifa por minuto nem por token de áudio.

PerguntaResposta
O Gemini 3.8 Live foi lançado oficialmente?Sim. O Google o anunciou em 15 de setembro de 2026.
Desenvolvedores já podem acessá-lo?O Google afirma que a distribuição começou pela Gemini API e pelo AI Studio.
Existe uma tabela oficial de preços do 3.8 Live?Não na página de preços da Gemini API consultada para este guia.
O preço do Gemini 3.8 Flash é a mesma coisa?Não. gemini-3.8-flash e os modelos Live têm identificadores de modelo distintos.
Já é possível calcular o custo exato de uma chamada ao 3.8 Live?Não, exceto se houver um preço específico para sua conta ou uma futura tarifa oficial publicada.

Os modelos apresentados pelo Google em 15 de setembro de 2026

O Google apresentou dois modelos de áudio para diálogos ao vivo, cada um com uma proposta operacional diferente. O Gemini 3.8 Live é voltado a conversas fluidas e escaláveis; o Gemini 3.8 Live Extended Thinking atende tarefas mais difíceis, com múltiplas etapas, sem interromper a conversa.

O anúncio destaca entrada visual quase em tempo real, alternância automática entre 97 idiomas e chamadas de ferramentas ou APIs em segundo plano que podem continuar enquanto o modelo responde ao usuário. O Extended Thinking é descrito como capaz de raciocinar e falar ao mesmo tempo, oferecendo sinais de progresso em tarefas mais longas. Esses recursos afetam a precificação porque trabalho em segundo plano, chamadas de ferramentas e raciocínio mais profundo podem alterar o consumo de tokens.

Como está o acesso para quem compra API?

A liberação do Google não acontece de forma idêntica para todos. O anúncio oficial apresenta os caminhos práticos para desenvolvedores da seguinte forma:

PlataformaGemini 3.8 LiveGemini 3.8 Live Extended Thinking
Gemini APIDistribuição iniciada em 15 de setembro de 2026Distribuição iniciada em 15 de setembro de 2026
Google AI StudioDistribuição iniciada em 15 de setembro de 2026Distribuição iniciada em 15 de setembro de 2026
Gemini EnterprisePrévia privadaPrévia privada

Leia essa tabela como a declaração do Google sobre a distribuição, não como garantia de que toda conta verá imediatamente o mesmo ID de modelo. Na operação, o que vale é a lista de modelos da API e as permissões do seu projeto.

Como funciona a cobrança da Gemini Live API enquanto não há preço do 3.8

A documentação de boas práticas da Live API do Google descreve uma cobrança baseada em tokens, e não uma taxa fixa por sessão. O áudio é convertido em consumo de tokens de áudio; mensagens de texto e transcrições geradas também podem acrescentar uso de tokens de texto. Além disso, uma sessão longa pode ficar mais cara à medida que o contexto ativo da conversa se acumula.

Para estimar o orçamento, as regras mais importantes são:

  1. Não considere minutos de conexão como a unidade oficial de cobrança. Um valor por minuto é apenas uma estimativa derivada da tokenização e do tempo de fala.
  2. Separe o áudio de entrada do áudio de saída. O modelo pode ouvir durante dez minutos e falar por quatro; são fluxos de uso diferentes.
  3. Leve em conta o crescimento do contexto. A orientação do Google alerta que o contexto de áudio nativo acumulado pode entrar na cobrança em interações posteriores, dependendo do tratamento do contexto.
  4. Some a transcrição à parte quando ela estiver ativada. Transcrições podem gerar cobranças de tokens de texto além do uso de áudio.
  5. Acompanhe chamadas de ferramentas e tokens de raciocínio. O trabalho em segundo plano pode consumir mais tokens de saída ou de contexto do que um bot simples de troca de turnos.

Por isso, dizer que custa “meio centavo por minuto” não substitui um preço oficial do 3.8. Esse número pode representar apenas uma direção de áudio, sob uma determinada hipótese de tokenização.

O que dá para usar no orçamento agora

Até que o Google publique as tarifas do Gemini 3.8 Live, use os modelos Live com preços atuais como base de planejamento — e não como substitutos do preço do novo modelo. A documentação oficial de preços do Gemini traz estas tarifas de referência:

ModeloÁudio de entradaÁudio de saídaTexto de entradaTexto de saída
Gemini 3.1 Flash Live Preview$3.00 por 1M de tokens de áudio (cerca de $0.005/min)$12.00 por 1M de tokens de áudio (cerca de $0.018/min)$0.75 por 1M$4.50 por 1M
Gemini 2.5 Flash Native Audio$3.00 por 1M de tokens de áudio$12.00 por 1M de tokens de áudio$0.50 por 1M$2.00 por 1M
Gemini 3.5 Live Translate$3.50 por 1M de tokens de áudio de entrada$21.00 por 1M de tokens de áudio de saídaNão informadoNão informado

Como exemplo de planejamento, considere dez minutos de áudio recebido e quatro minutos de fala do modelo, usando as estimativas publicadas para o Gemini 3.1 Flash Live:

  • Entrada: 10 × $0.005 = $0.05
  • Saída: 4 × $0.018 = $0.072
  • Subtotal de áudio: $0.122

Esse é um cálculo de referência, não uma cotação do Gemini 3.8 Live. Ele exclui contexto acumulado, transcrição, ferramentas e qualquer nova precificação do 3.8. Como as conversões por minuto são estimativas, use o consumo de tokens informado na resposta de cobrança da sua conta para fechar o orçamento.

Gemini 3.8 Flash padrão não é o modelo da Live API

O gemini-3.8-flash padrão do Google é um modelo com saída de texto e entrada multimodal. A página oficial de preços lista tarifas introdutórias de $0.75 por 1 milhão de tokens de entrada e $3.75 por 1 milhão de tokens de saída até 31 de dezembro de 2026, com tarifas programadas de $1.50/$7.50 a partir de 1º de janeiro de 2027.

Esses preços se aplicam ao modelo Flash padrão, e não automaticamente a gemini-3.8-live ou gemini-3.8-live-extended-thinking. A documentação de modelos trata o Flash padrão separadamente das capacidades Live. Embora os nomes compartilhem o número da versão, o Live exige saída de áudio em streaming, detecção de turno, tratamento de interrupções e comportamento de sessão em tempo real.

Uma implementação segura deve registrar o ID exato do modelo retornado pelo provedor. Ver apenas “Gemini 3.8” em um dashboard não basta para atribuir custos com precisão.

Vale a pena desenvolver com o Gemini 3.8 Live agora?

Vale criar um protótipo se sua principal dúvida for o design da interação: seus usuários aceitam trabalho em segundo plano, atualizações verbais de progresso, contexto visual e interrupções no fluxo? O Google anunciou esses comportamentos, e a liberação via API/AI Studio oferece aos desenvolvedores um caminho para testar a integração.

Adie um compromisso de custo em produção se seu caso de negócio depender de uma margem fixa por minuto. A ausência da tabela de preços do 3.8, o impacto desconhecido da recobrança de contexto e a falta de dados independentes de latência e falhas medidos deixam variáveis demais para uma projeção confiável de economia unitária.

Antes de migrar tráfego, crie uma estrutura de medição de custos:

  1. Registre os IDs exatos dos modelos e as respostas da API.
  2. Capture minutos de áudio de entrada, minutos de áudio de saída, tokens de texto, tokens de pensamento quando expostos, transcrição e chamadas de ferramentas.
  3. Execute sessões curtas, médias e longas com o mesmo conjunto de tarefas.
  4. Compare o custo por tarefa concluída com sucesso, e não o custo por minuto conectado.
  5. Mantenha uma alternativa em um modelo Live com preço já publicado até o Google divulgar a tabela de preços do 3.8.

Perguntas frequentes sobre a API Gemini 3.8 Live

Qual é o preço oficial da API Gemini 3.8 Live?

O anúncio de lançamento do Google não informa um preço em dólares, e a documentação de preços consultada não apresenta uma tabela de tarifas específica para o 3.8 Live.

O Gemini 3.8 Live é gratuito no Google AI Studio?

O Google afirma que a distribuição começou no AI Studio, mas acesso, cotas e termos da camada gratuita são independentes de um preço de API para produção garantido. Consulte a disponibilidade de modelos e a página de cobrança da sua conta.

Gemini 3.8 Flash é igual ao Gemini 3.8 Live?

Não. gemini-3.8-flash é um modelo padrão separado. Seus preços introdutórios de $0.75/$3.75 por token não devem ser apresentados como o preço de uma sessão de áudio Live.

A Gemini Live API cobra por minuto?

Não como regra fundamental de cobrança. O Google documenta faturamento baseado em tokens; os valores por minuto são estimativas baseadas nas tarifas de tokens de áudio e em uma duração de fala presumida.

Uma conversa Live longa pode custar mais com o tempo?

Sim. Contexto ativo da conversa, tokens de áudio, transcrição e atividade de ferramentas podem afetar o consumo em interações posteriores. Meça uma sessão representativa em vez de multiplicar a estimativa de uma chamada curta.

Qual é a diferença entre Gemini 3.8 Live e Extended Thinking?

O Google posiciona o Gemini 3.8 Live para diálogo fluido, escalável e com contexto visual. O Extended Thinking é voltado a raciocínio mais profundo, em múltiplas etapas, enquanto continua falando e informando o progresso.

Onde o Gemini 3.8 Live está disponível?

O Google anunciou a distribuição pela Gemini API e pelo AI Studio, com o acesso empresarial inicialmente descrito como prévia privada. A disponibilidade pode variar conforme a conta e a região.

Assim, o orçamento defensável hoje é uma faixa calculada a partir das tarifas atuais de tokens Live e do comportamento medido das sessões — não um preço por minuto estimado para o Gemini 3.8 Live. Refça os cálculos quando o Google incluir a tarifa oficial do modelo.