Um anúncio de lançamento pode dar a impressão de que um modelo já está disponível, mesmo quando os desenvolvedores ainda não conseguem chamá-lo. No caso do GPT-Live-1, a página pública de cadastro da API da OpenAI continua pedindo que os interessados se inscrevam para receber uma notificação quando o modelo estiver disponível, enquanto a API Realtime documentada já tem preços publicados. A diferença é importante: não inclua o GPT-Live-1 em um orçamento ou integração de produção até que a OpenAI divulgue um ID de modelo, endpoint, documentação e tabela de preços.
A decisão em um minuto
O GPT-Live-1 não está documentado publicamente como uma API disponível para uso geral nos materiais da OpenAI que consegui verificar. A página da API do GPT-Live-1 da OpenAI é um formulário de notificação, não uma referência de API: não informa endpoint, ID de modelo, preços, limites ou data de lançamento.
Isso não prova que não exista algum tipo de acesso privado. Mas significa que um desenvolvedor comum não pode tratar um anúncio em rede social ou uma experiência de voz do ChatGPT como um contrato de API que possa ser chamado diretamente.
Para uma aplicação de voz em produção hoje:
| Necessidade | Escolha prática |
|---|---|
| Lançar agora uma API de voz em tempo real documentada | GPT-Realtime-2.1 |
| Reduzir o custo de áudio e tokens de texto | GPT-Realtime-2.1 mini |
| Preparar um protótipo para trocar de modelo no futuro | Coloque o ID do modelo e os preços em uma configuração |
| Exigir especificamente o GPT-Live-1 | Entre na lista de notificações; não prometa uma data de lançamento |
O preço do GPT-Live-1 não foi publicado como preço de API
A página de cadastro verificada da OpenAI diz: “Inscreva-se para receber uma notificação quando o GPT‑Live‑1 estiver disponível na API.” Ela não informa preço por minuto, preço por token de áudio, preço por token de texto, cobrança mínima ou limite de uso. Portanto, o preço honesto da API do GPT-Live-1 é desconhecido — não é $0.05 por minuto nem qualquer estimativa copiada de outro modelo em tempo real.
Os preços das assinaturas do ChatGPT pertencem a uma categoria de produto diferente. Uma assinatura Plus ou Pro pode incluir acesso à voz para consumidores, mas não fornece automaticamente créditos de API. Mantenha a fatura da assinatura e a fatura da API em orçamentos separados.
O que já dá para comprar e desenvolver
A página do modelo GPT-Realtime da OpenAI publica preços baseados em tokens. Os valores abaixo são as tarifas encontradas nos materiais de pesquisa para a família Realtime atual; consulte novamente a página oficial antes de fazer o deploy, porque os preços podem mudar.
| Modelo | Entrada de texto / em cache | Saída de texto | Entrada de áudio / em cache | Saída de áudio | Contexto / saída máxima |
|---|---|---|---|---|---|
| GPT-Realtime-2.1 | $4 / $0.40 por 1M | $24 por 1M | $32 / $0.40 por 1M | $64 por 1M | 128k / 32k |
| GPT-Realtime-2.1 mini | $0.60 / $0.06 por 1M | $2.40 por 1M | $10 / $0.30 por 1M | $20 por 1M | 128k / 32k |
Nos materiais pesquisados sobre o status da API, os dois modelos são descritos como capazes de receber entradas de texto, áudio e imagem e produzir saídas de texto e áudio; vídeo não aparece como formato compatível. O modelo padrão é a opção mais segura quando raciocínio complexo ou uso de ferramentas são importantes. O Mini é a escolha para priorizar custos quando latência e preço pesam mais do que a capacidade máxima.
O detalhe mais importante do faturamento é que entrada e saída são cobradas separadamente. Uma chamada de cinco minutos não equivale automaticamente a cinco minutos de áudio do usuário mais cinco minutos de áudio do assistente. Meça quanto cada lado realmente fala.
Monte um orçamento que sobreviva à troca de modelo
Enquanto o GPT-Live-1 não publicar uma tabela de preços, use um modelo por cenários em vez de chutar um preço médio:
monthly exposure = sessions
× measured billable usage per session
× provider rate
× retry and tool-call factors
Acompanhe estes campos em cada piloto:
- Segundos de fala do usuário e segundos de fala do assistente, separadamente.
- Tokens de entrada de texto, entrada em cache e saída de texto.
- Turnos, chamadas de ferramentas, falhas de ferramentas, novas tentativas e reconexões.
- Duração da sessão, silêncios, sessões abandonadas e concorrência máxima.
- Tráfego de fallback, como o modo somente texto ou um modelo menor.
Por exemplo, uma planilha de planejamento pode usar 500 minutos de entrada e 500 minutos de saída, mas precisa identificar qualquer conversão de tokens de áudio por minuto como uma suposição. Para chegar a um orçamento exato, use os registros de uso retornados pela API, não a conversão genérica de minutos de uma calculadora.
Defina um limite rígido para a sessão, um limite de chamadas de ferramentas, um alerta de gastos e um kill switch antes de abrir um piloto. Um agente de voz que se reconecta depois de uma queda de rede pode gerar uso sem concluir a tarefa do cliente. Portanto, uma política de “uso justo” não é um controle financeiro.
FAQ da API GPT-Live-1
O formulário de notificação concede acesso à API do GPT-Live-1?
Não. O formulário público coleta informações de contato e dados comerciais para que a OpenAI possa notificar os desenvolvedores interessados. Ele não exibe chave de API, ID de modelo, endpoint, contrato de preços nem garante participação em um beta.
O ChatGPT Plus ou Pro pode pagar pelo uso da API?
Não. As assinaturas do ChatGPT e o uso da API são cobrados separadamente. Escolha um plano de consumidor para o produto ChatGPT; inclua as chamadas de API para desenvolvedores no orçamento baseado na tabela de preços da API.
O GPT-Live-Transcribe é a mesma coisa que o GPT-Live-1?
Não. Um modelo de transcrição converte fala em texto. GPT-Live-1 se refere à experiência de voz conversacional. O preço por minuto de transcrição não pode ser usado como preço de um agente full-duplex que escuta, raciocina, fala e potencialmente chama ferramentas.
A equipe deve esperar ou usar o Realtime agora?
Use o GPT-Realtime-2.1 ou sua variante mini em produção agora. Se o modelo de interação do GPT-Live-1 for estrategicamente importante, isole a configuração do modelo atrás de um adaptador. Assim, uma migração futura exigirá mudar a configuração, não a aplicação inteira.
“É muito mais eficiente ditar o mesmo prompt em uma janela de trabalho do chatgpt.” — @pranavkrn, descrevendo uma limitação que observou ao chamar ferramentas por voz; post original. Este é um relato de usuário sobre a experiência do ChatGPT, não uma evidência sobre uma API não documentada.
A decisão prática
A decisão mais simples é lançar com um modelo Realtime documentado, registrar as categorias de uso que determinam o custo e manter o GPT-Live-1 como um alvo substituível de configuração. Esperar só se justifica quando o comportamento full-duplex específico do GPT-Live-1 for um requisito indispensável do produto. Caso contrário, trabalhar com preço e endpoint não publicados cria riscos desnecessários para o cronograma e para a margem.