AIREITER
DOCS APIPREÇOS
TEMPLATES
  • AIReiter
  • Blog
  • Preços da API GPT-Live-1: status, custos e alternativas

Preços da API GPT-Live-1: status, custos e alternativas

Última Atualização: 2026-09-10 18:44:10

Um anúncio de lançamento pode dar a impressão de que um modelo já está disponível, mesmo quando os desenvolvedores ainda não conseguem chamá-lo. No caso do GPT-Live-1, a página pública de cadastro da API da OpenAI continua pedindo que os interessados se inscrevam para receber uma notificação quando o modelo estiver disponível, enquanto a API Realtime documentada já tem preços publicados. A diferença é importante: não inclua o GPT-Live-1 em um orçamento ou integração de produção até que a OpenAI divulgue um ID de modelo, endpoint, documentação e tabela de preços.

A decisão em um minuto

O GPT-Live-1 não está documentado publicamente como uma API disponível para uso geral nos materiais da OpenAI que consegui verificar. A página da API do GPT-Live-1 da OpenAI é um formulário de notificação, não uma referência de API: não informa endpoint, ID de modelo, preços, limites ou data de lançamento.

Isso não prova que não exista algum tipo de acesso privado. Mas significa que um desenvolvedor comum não pode tratar um anúncio em rede social ou uma experiência de voz do ChatGPT como um contrato de API que possa ser chamado diretamente.

Para uma aplicação de voz em produção hoje:

NecessidadeEscolha prática
Lançar agora uma API de voz em tempo real documentadaGPT-Realtime-2.1
Reduzir o custo de áudio e tokens de textoGPT-Realtime-2.1 mini
Preparar um protótipo para trocar de modelo no futuroColoque o ID do modelo e os preços em uma configuração
Exigir especificamente o GPT-Live-1Entre na lista de notificações; não prometa uma data de lançamento

O preço do GPT-Live-1 não foi publicado como preço de API

A página de cadastro verificada da OpenAI diz: “Inscreva-se para receber uma notificação quando o GPT‑Live‑1 estiver disponível na API.” Ela não informa preço por minuto, preço por token de áudio, preço por token de texto, cobrança mínima ou limite de uso. Portanto, o preço honesto da API do GPT-Live-1 é desconhecido — não é $0.05 por minuto nem qualquer estimativa copiada de outro modelo em tempo real.

Os preços das assinaturas do ChatGPT pertencem a uma categoria de produto diferente. Uma assinatura Plus ou Pro pode incluir acesso à voz para consumidores, mas não fornece automaticamente créditos de API. Mantenha a fatura da assinatura e a fatura da API em orçamentos separados.

O que já dá para comprar e desenvolver

A página do modelo GPT-Realtime da OpenAI publica preços baseados em tokens. Os valores abaixo são as tarifas encontradas nos materiais de pesquisa para a família Realtime atual; consulte novamente a página oficial antes de fazer o deploy, porque os preços podem mudar.

ModeloEntrada de texto / em cacheSaída de textoEntrada de áudio / em cacheSaída de áudioContexto / saída máxima
GPT-Realtime-2.1$4 / $0.40 por 1M$24 por 1M$32 / $0.40 por 1M$64 por 1M128k / 32k
GPT-Realtime-2.1 mini$0.60 / $0.06 por 1M$2.40 por 1M$10 / $0.30 por 1M$20 por 1M128k / 32k

Nos materiais pesquisados sobre o status da API, os dois modelos são descritos como capazes de receber entradas de texto, áudio e imagem e produzir saídas de texto e áudio; vídeo não aparece como formato compatível. O modelo padrão é a opção mais segura quando raciocínio complexo ou uso de ferramentas são importantes. O Mini é a escolha para priorizar custos quando latência e preço pesam mais do que a capacidade máxima.

O detalhe mais importante do faturamento é que entrada e saída são cobradas separadamente. Uma chamada de cinco minutos não equivale automaticamente a cinco minutos de áudio do usuário mais cinco minutos de áudio do assistente. Meça quanto cada lado realmente fala.

Monte um orçamento que sobreviva à troca de modelo

Enquanto o GPT-Live-1 não publicar uma tabela de preços, use um modelo por cenários em vez de chutar um preço médio:

monthly exposure = sessions
                 × measured billable usage per session
                 × provider rate
                 × retry and tool-call factors

Acompanhe estes campos em cada piloto:

  1. Segundos de fala do usuário e segundos de fala do assistente, separadamente.
  2. Tokens de entrada de texto, entrada em cache e saída de texto.
  3. Turnos, chamadas de ferramentas, falhas de ferramentas, novas tentativas e reconexões.
  4. Duração da sessão, silêncios, sessões abandonadas e concorrência máxima.
  5. Tráfego de fallback, como o modo somente texto ou um modelo menor.

Por exemplo, uma planilha de planejamento pode usar 500 minutos de entrada e 500 minutos de saída, mas precisa identificar qualquer conversão de tokens de áudio por minuto como uma suposição. Para chegar a um orçamento exato, use os registros de uso retornados pela API, não a conversão genérica de minutos de uma calculadora.

Defina um limite rígido para a sessão, um limite de chamadas de ferramentas, um alerta de gastos e um kill switch antes de abrir um piloto. Um agente de voz que se reconecta depois de uma queda de rede pode gerar uso sem concluir a tarefa do cliente. Portanto, uma política de “uso justo” não é um controle financeiro.

FAQ da API GPT-Live-1

O formulário de notificação concede acesso à API do GPT-Live-1?

Não. O formulário público coleta informações de contato e dados comerciais para que a OpenAI possa notificar os desenvolvedores interessados. Ele não exibe chave de API, ID de modelo, endpoint, contrato de preços nem garante participação em um beta.

O ChatGPT Plus ou Pro pode pagar pelo uso da API?

Não. As assinaturas do ChatGPT e o uso da API são cobrados separadamente. Escolha um plano de consumidor para o produto ChatGPT; inclua as chamadas de API para desenvolvedores no orçamento baseado na tabela de preços da API.

O GPT-Live-Transcribe é a mesma coisa que o GPT-Live-1?

Não. Um modelo de transcrição converte fala em texto. GPT-Live-1 se refere à experiência de voz conversacional. O preço por minuto de transcrição não pode ser usado como preço de um agente full-duplex que escuta, raciocina, fala e potencialmente chama ferramentas.

A equipe deve esperar ou usar o Realtime agora?

Use o GPT-Realtime-2.1 ou sua variante mini em produção agora. Se o modelo de interação do GPT-Live-1 for estrategicamente importante, isole a configuração do modelo atrás de um adaptador. Assim, uma migração futura exigirá mudar a configuração, não a aplicação inteira.

“É muito mais eficiente ditar o mesmo prompt em uma janela de trabalho do chatgpt.” — @pranavkrn, descrevendo uma limitação que observou ao chamar ferramentas por voz; post original. Este é um relato de usuário sobre a experiência do ChatGPT, não uma evidência sobre uma API não documentada.

A decisão prática

A decisão mais simples é lançar com um modelo Realtime documentado, registrar as categorias de uso que determinam o custo e manter o GPT-Live-1 como um alvo substituível de configuração. Esperar só se justifica quando o comportamento full-duplex específico do GPT-Live-1 for um requisito indispensável do produto. Caso contrário, trabalhar com preço e endpoint não publicados cria riscos desnecessários para o cronograma e para a margem.

>_Diretório de modelos AIReiter

Acesso API rápido aos modelos relacionados a este guia

GPT-6 Astra

Chat

OpenAI frontier model for complex reasoning, coding, and long-context work.

OpenAICriar API Key >

GPT-5.6 Terra

Chat

Um modelo de texto GPT-5.6 mais forte para tarefas de programação e análise com raciocínio intensivo.

OpenAICriar API Key >

DeepSeek V4 Flash

Chat

DeepSeek V4 Flash para chat técnico rápido, extração, classificação e cargas frequentes de API.

DeepseekCriar API Key >

Claude Fable 5

Chat

Um modelo premium Claude para raciocínio profundo e trabalhos complexos de longo formato.

AnthropicCriar API Key >

Claude Fable 5.1

Chat

Mythos-class model for long-horizon coding, research, and knowledge work.

AnthropicCriar API Key >

Posts recentes

API full-duplex GPT-Live: arquitetura de agentes de voz

2026-09-10

OpenRouter US In-Region Routing: configuração e limites

2026-09-10

Alternativas ao Civitai: Hugging Face, Tensor.Art, SeaArt e ComfyUI

2026-09-10

Preços da API Kling: custo oficial vs. agregadores (2026)

2026-09-10
AIREITER

Dúvidas? Entre em contato em
[email protected]

新速率有限公司NEWRATE LIMITED香港九龍花園街 2-16 號好景商業中心 2304 室Room 2304, Haojing Commercial Center, 2-16 Garden Street, Kowloon, Hong Kong

LLM

GPT-6 AstraGemini 3.8 FlashClaude Fable 5.1GLM-5.3 FlashGemini 3.6 Flash

Vídeo IA

Gemini Omni 1.1 Flash ExtMiniMax H3Kling 3.0 Motion ControlKling 3.0 TurboKling 3.0

Imagem IA

GPT-Image 2.5Grok Imagine Image 2.0Midjourney V8.1Midjourney V7Z-Image Turbo

Blog

Ver Tudo →

Empresa

Política de PrivacidadeTermos de ServiçoPolítica de Reembolso

© 2026 AIReiter. Todos os direitos reservados.