AIREITER

Preços da API ChatGPT Images 2.5: exemplos de custo

Última Atualização: 2026-09-09 00:46:00

Uma tarifa de US$ 30 por milhão de tokens de saída parece barata — até chegar a hora de orçar 10.000 imagens. O preço da API ChatGPT Images 2.5 é o mesmo para Flare e Sunburst, mas a fatura final depende dos tokens consumidos, das imagens de referência, das edições e das tentativas repetidas — não apenas do nome do modelo.

Os cenários abaixo servem para planejamento, não são cotações fixas: a OpenAI não divulga um preço único e universal por imagem gerada com GPT-Image-2.5.

As tarifas oficiais — e o dado que elas não revelam

A OpenAI cobra as mesmas tarifas por token para os dois modelos da API GPT-Image-2.5. A tabela oficial de preços lista gpt-image-2.5-flare e gpt-image-2.5-sunburst por US$ 30 por milhão de tokens de saída de imagem, com cobranças separadas para texto do prompt e imagens de entrada.

Tarifas oficiais por token do GPT-Image-2.5

Dados cobradosEntrada padrãoEntrada em cacheSaída
Tokens de textoUS$ 5,00 / 1MUS$ 1,25 / 1MNão se aplica
Tokens de imagemUS$ 8,00 / 1MUS$ 2,00 / 1MUS$ 30,00 / 1M

Fonte: preços da API da OpenAI, consultados em 9 de setembro de 2026.

A OpenAI posiciona o Flare como padrão para a maioria das aplicações e para geração em alto volume. O Sunburst é a opção mais lenta, voltada à precisão, para edições controladas e criação pronta para produção. Segundo a OpenAI, o Flare oferece latência até 50% menor que o GPT-Image-2, enquanto o Sunburst leva mais tempo para gerar.

O preço de tabela não determina um valor fixo por imagem. Uma solicitação que gera 2.000 tokens de saída custa um décimo de outra que gera 20.000 tokens, antes de considerar entradas e novas tentativas.

Fórmula de custo para geração e edição

Para uma chamada direta à API de imagem, use esta fórmula:

cost =
  (text_input_tokens × $5 / 1,000,000)
+ (cached_text_tokens × $1.25 / 1,000,000)
+ (image_input_tokens × $8 / 1,000,000)
+ (cached_image_tokens × $2 / 1,000,000)
+ (image_output_tokens × $30 / 1,000,000)

Na geração de texto para imagem sem uma imagem de referência, os tokens de saída normalmente serão a maior parcela da conta. Um prompt de 500 tokens custa US$ 0,0025; 7.000 tokens de saída de imagem custam US$ 0,21.

As edições incluem cobranças de entrada de imagem, pois a imagem de origem ou referência precisa ser processada. Fluxos de várias etapas também podem gerar uma nova cobrança a cada chamada. Por isso, a métrica relevante em produção é o custo por ativo aprovado, e não o custo da primeira tentativa.

Exemplos de custo por imagem com base no uso de tokens

O único cálculo confiável de custo por imagem começa pelo uso registrado em uma solicitação concluída. Os exemplos a seguir usam deliberadamente números redondos de tokens, para que você possa substituí-los pelos dados dos seus próprios logs de API.

Exemplos de geração sem imagem de referência

Considere que cada solicitação tenha 500 tokens de texto de entrada sem cache e nenhuma imagem de entrada.

Cenário de planejamentoTokens de saída de imagemCusto do textoCusto da saída de imagemTotal por chamada1.000 chamadas
Saída enxuta2.000US$ 0,0025US$ 0,0600US$ 0,0625US$ 62,50
Saída intermediária7.000US$ 0,0025US$ 0,2100US$ 0,2125US$ 212,50
Saída pesada20.000US$ 0,0025US$ 0,6000US$ 0,6025US$ 602,50

Esses valores são conversões diretas de tokens em dólares, não uma afirmação de que uma configuração de qualidade específica sempre consumirá determinada quantidade de tokens. Troque os números redondos pelo uso faturado nas suas próprias chamadas.

A tabela também deixa claro por que encurtar um prompt já modesto raramente muda o orçamento de forma relevante. Cortar pela metade um prompt de 500 tokens economiza US$ 0,00125, enquanto reduzir a saída de 20.000 para 7.000 tokens economiza US$ 0,39 por chamada.

Exemplos com imagem de referência e edição

Considere uma edição com 500 tokens de texto, 5.000 tokens de imagem de entrada e 7.000 tokens de saída de imagem.

ComponenteTokensTarifaCusto
Instrução de texto500US$ 5 / 1MUS$ 0,0025
Imagem de referência5.000US$ 8 / 1MUS$ 0,0400
Saída editada7.000US$ 30 / 1MUS$ 0,2100
TotalUS$ 0,2525

Se a mesma imagem de entrada se qualificar para o preço de cache, a cobrança pelos seus 5.000 tokens cai de US$ 0,04 para US$ 0,01. Nesse caso hipotético, a chamada passa a custar US$ 0,2225.

Três chamadas de edição com o mesmo perfil de tokens sem cache custam US$ 0,7575. Se apenas o terceiro resultado for aprovado, o custo efetivo da API será de US$ 0,7575 por ativo utilizável — e não US$ 0,2525.

Como montar o orçamento entre Flare e Sunburst

Flare e Sunburst têm as mesmas tarifas publicadas por token, portanto nenhum deles é automaticamente mais barato por chamada. O Flare é a escolha mais segura como padrão de orçamento, porque a OpenAI o projetou para velocidade e volume. Já o Sunburst precisa justificar seu uso reduzindo falhas em edições precisas ou o trabalho manual de retoque.

Uma preocupação de desenvolvedores no lançamento foi que tarifas iguais não respondem à pergunta que realmente importa no orçamento:

“I wish Flare's pricing was juuuust a little bit cheaper.” — @buildincrisis on X

Como os dois modelos compartilham as mesmas tarifas unitárias, a economia precisa vir de menor uso de tokens, menos tentativas, giro mais rápido de capacidade ou roteamento mais inteligente.

Um orçamento mensal para 10.000 chamadas

Considere um modelo de planejamento com estas premissas:

  • Chamada Flare: 7.000 tokens de saída mais 500 tokens de texto = US$ 0,2125
  • Chamada Sunburst: 20.000 tokens de saída mais 500 tokens de texto = US$ 0,6025
  • Sem cobranças por imagem de referência, cache ou chamadas que falharam
Plano de roteamentoChamadas FlareChamadas SunburstCusto mensal estimado da API
Apenas Flare10.0000US$ 2.125
90% Flare / 10% Sunburst9.0001.000US$ 2.515
70% Flare / 30% Sunburst7.0003.000US$ 3.295
Apenas Sunburst010.000US$ 6.025

A diferença decorre do uso de tokens assumido, e não de tarifas diferentes do provedor. Antes de aprovar um orçamento de produção, substitua essas hipóteses pela mediana de tokens medida para cada modelo e carga de trabalho.

Orce por imagem utilizável, não por chamada de API

Suponha que um fluxo com Flare custe US$ 0,2125 por tentativa e que 80% das chamadas produzam uma imagem aceitável. O custo efetivo da API será de aproximadamente US$ 0,266 por imagem utilizável:

$0.2125 ÷ 0.80 = $0.265625

Se o Sunburst custar US$ 0,6025 por tentativa, mas alcançar uma taxa de aceitação de 95% em edições de precisão, seu custo efetivo será de cerca de US$ 0,634 por imagem utilizável. O Sunburst ainda custa mais nesse exemplo, mas a diferença pode valer a pena quando o retoque manual custa vários dólares ou uma edição de marca mal-sucedida impede a publicação.

Discussões de usuários reais já refletem esse problema mais amplo de custo. Em uma thread de lançamento, o usuário u/EvenAd2969, do Reddit, escreveu: “They need to get rid of these noisy artifacts.” (fonte) Artefatos não são apenas uma reclamação de qualidade: cada nova geração aumenta o gasto e atrasa a aprovação.

Como manter os gastos com ChatGPT Images 2.5 previsíveis

Previsibilidade de gastos exige medir cada carga de trabalho separadamente. Não defina um único “custo por imagem” global para geração, transformação guiada por referência e edição em várias etapas.

  1. Mantenha as configurações da solicitação constantes durante a medição. Uma configuração estável cria uma base mais limpa para comparar trabalhos.
  2. Registre texto de entrada faturado, imagem de entrada, entradas em cache e saída de imagem. Calcule o custo mediano e o percentil 90; a média pode esconder valores atípicos caros.
  3. Defina um limite de tentativas por ativo. Um teto de três tentativas impede que um prompt problemático multiplique a fatura silenciosamente.
  4. Faça o roteamento pelo custo da falha. Comece conteúdo de creators, miniaturas, busca visual e protótipos no Flare. Envie preservação de produto, edições de campanha e revisões de ativos aprovados para o Sunburst.
  5. Recalcule com base na taxa de aceitação. Um modelo aparentemente barato pode sair caro se a equipe rejeita metade dos resultados.

O anúncio da OpenAI informa que a Manus observou o Flare rodando de duas a quatro vezes mais rápido que o GPT-Image-2 em sua avaliação. Esse relato de cliente trata de velocidade, não de uma redução garantida nos tokens ou dólares faturados.

O que as assinaturas do ChatGPT cobrem — e o que não cobrem

O acesso pelos planos do ChatGPT e a cobrança da API são produtos separados. A OpenAI informa que o ChatGPT Images 2.5 está disponível no ChatGPT, ChatGPT Work e Codex, mas o ChatGPT e a API usam sistemas de cobrança distintos. Um pagamento de ChatGPT Plus, Pro ou Work não equivale a crédito pré-pago para a API GPT-Image-2.5; chamadas diretas à API são faturadas na conta da API.

Uma decisão de roteamento pronta para produção

O padrão mais defensável é Flare primeiro, Sunburst por exceção. Use o custo medido por imagem aceita para decidir se uma exceção deve se tornar uma rota permanente.

Carga de trabalhoModelo inicialMotivo de orçamento
Variações para redes sociais e miniaturasFlareVelocidade e posicionamento para alto volume
Descoberta de produtos ou busca visualFlareA latência interativa importa
Conceitos iniciais e criativos para testes A/BFlareMuitas saídas serão descartadas por definição
Imagem final de campanhaSunburstA precisão pode compensar o custo da chamada
Edição que precisa preservar um produto ou pessoaSunburstUse apenas se um teste de taxa de aceitação reduzir tentativas ou retoques
Solicitação não classificadaFlareA OpenAI o define como padrão para a maioria das aplicações

Uma regra prática de escalonamento é simples: tente o Flare uma vez e envie o trabalho ao Sunburst quando o primeiro resultado falhar em uma verificação documentada de preservação ou precisão. Não escale apenas porque o Sunburst é rotulado como premium.

Perguntas frequentes sobre os preços da API ChatGPT Images 2.5

O Flare é mais barato que o Sunburst?

Não no nível das tarifas unitárias publicadas. Os dois modelos custam US$ 5 por milhão de tokens de texto de entrada, US$ 8 por milhão de tokens de imagem de entrada e US$ 30 por milhão de tokens de saída de imagem; o custo real da chamada pode variar caso o consumo de tokens seja diferente.

Quanto custa uma imagem com GPT-Image-2.5?

Não há preço fixo universal. Na tarifa oficial de US$ 30 por milhão de tokens de saída, 2.000 tokens de saída de imagem custam US$ 0,06, 7.000 custam US$ 0,21 e 20.000 custam US$ 0,60, antes das entradas de texto e imagem.

Editar custa mais do que gerar uma imagem do zero?

As edições podem custar mais porque incluem tokens de imagem de entrada e podem exigir várias chamadas. Quando aplicável, o preço de imagem de entrada em cache pode reduzir cobranças de entradas repetidas de US$ 8 para US$ 2 por milhão de tokens.

O texto do prompt afeta significativamente a fatura?

Em geral, menos do que a saída de imagem. Um prompt sem cache de 500 tokens custa US$ 0,0025, enquanto 7.000 tokens de saída de imagem custam US$ 0,21 nas tarifas padrão atuais.

A API está incluída no ChatGPT Plus ou Pro?

Não. As assinaturas do ChatGPT determinam acesso e limites dentro do ChatGPT; o uso direto da API GPT-Image-2.5 é cobrado separadamente pela conta da API.

Leitura relacionada: Análise e testes do ChatGPT Images 2.5 · Preços da API GPT Image 2