AIREITER

Qwen Image 3 Pro: preço da API confirmado, limites e o que o Pro entrega

Última Atualização: 2026-08-05 04:03:00

A Alibaba finalmente publicou o preço oficial da API do Qwen Image 3 Pro: na região de Pequim, cada imagem na faixa 1K custa ¥0.25 (~$0.035), enquanto 2K dobra para ¥0.5. Na mesma resolução, isso equivale a 2.8× o valor cobrado pelo qwen-image-3.0 padrão. Para composições carregadas de texto, o adicional pode fazer sentido. Só que há um detalhe na página oficial do modelo capaz de inviabilizar praticamente qualquer plano de escala: o limite é de 1 solicitação por minuto.

O que o Qwen Image 3 Pro oferece além do qwen-image-3.0

O Qwen Image 3 Pro (qwen-image-3.0-pro) é a variante voltada à máxima qualidade da geração Qwen-Image-3.0, da Alibaba, lançada em 21 de julho de 2026. Ele e o qwen-image-3.0 padrão fazem geração de texto para imagem e edição de imagens pela mesma API, com os mesmos limites de dimensão. O que muda é a qualidade do resultado e a forma de cobrança em 2K.

Os principais recursos são compartilhados por toda a família 3.0:

  • Prompts de até 4.5k tokens, contra cerca de 1k na geração anterior — espaço suficiente para descrever, de uma vez, uma página inteira de jornal, uma grade de infográfico 3×3 ou uma composição de interface dentro de outra interface
  • Renderização de texto em 10px que permanece legível, incluindo fórmulas LaTeX, sobrescritos e numeração de teoremas
  • 12 idiomas e mais de 20 fontes renderizados nativamente, além de interfaces simuladas de sites, jogos e transmissões ao vivo
Anúncio oficial do Qwen-Image-3.0 no qwen.ai, publicado em 21 de julho de 2026

A separação entre os dois está no posicionamento. A própria orientação de seleção de modelos da Alibaba indica o Pro para layouts complexos, texto pequeno com alta precisão e trabalhos multilíngues com fontes; já o modelo padrão é apresentado como um equilíbrio entre qualidade e velocidade. No restante, a ficha técnica é a mesma para ambos os IDs: saída entre 512×512 e 2048×2048 pixels totais, proporções de 1:8 a 8:1, de 1 a 3 imagens de referência em edição e exportação em PNG.

Preço oficial da API, conferido em agosto de 2026

O Alibaba Cloud Model Studio lista preços por imagem do qwen-image-3.0-pro em duas regiões. Os valores abaixo foram verificados na tabela oficial de preços em 5 de agosto de 2026:

Item cobradoPequim (CNY)Internacional, Singapura (CNY)USD aproximado
Entrada de imagem (por imagem)¥0.02¥0.022483~$0.003
Saída 1K (por imagem)¥0.25¥0.299768~$0.035–0.042
Saída 2K (por imagem)¥0.5¥0.562065~$0.070–0.079

A divisão entre 1K e 2K é definida pela área em pixels: qualquer imagem com até 2,250,000 pixels entra na tarifa 1K; acima disso, vale a de 2K. O qwen-image-3.0 padrão cobra ¥0.18 (~$0.025) fixos por imagem de saída, independentemente da resolução. Isso cria uma situação curiosa: em 2K, o Pro custa 2.8× mais que o modelo padrão; em 1K, a diferença cai para 1.4×.

Tabela de preços do qwen-image-3.0-pro na região de Pequim no Alibaba Cloud Model Studio, capturada em 5 de agosto de 2026 Preço de saída por imagem: qwen-image-3.0 com valor fixo de ¥0.18 versus Pro a ¥0.25 em 1K e ¥0.5 em 2K

Há duas observações importantes. A região de Pequim inclui uma cota gratuita de 10 imagens, somando entrada e saída, válida por 90 dias após a ativação. É suficiente para colocar as alegações sobre tipografia à prova com seus próprios prompts, mas não para construir algo de fato. Além disso, ao menos um gateway de terceiros lista o modelo como gratuito no momento, mas a nota no card do modelo deixa claro que se trata de um teste temporário com cota limitada. Portanto, trate qualquer anúncio de $0 como um canal de demonstração, não como preço.

O limite que define o uso: 1 solicitação por minuto

A página oficial do modelo informa RPM (solicitações por minuto) de 1, tanto em Pequim quanto em Singapura, para as versões Pro e padrão. É de uma a duas ordens de grandeza abaixo dos 60–600 RPM comuns em APIs de imagem já consolidadas.

Esse único número explica o que os primeiros usuários relataram: erros 429 imediatos em chamadas consecutivas, falha das duas solicitações quando dois processos compartilhavam a mesma chave e execuções limpas apenas ao serializar rigorosamente as chamadas com um backoff generoso. Um teste publicado em 23 de julho mediu exatamente esse comportamento por meio de um gateway, antes de o limite oficial ser documentado.

Na prática, isso significa:

  • Geração em lote não é uma opção. Com 1 RPM, o teto é de ~1,440 solicitações/dia por chave, em sequência e sem tolerância a rajadas. Cada solicitação pode retornar até 6 imagens via n, com cobrança por imagem.
  • Equipes que dividem uma chave se limitam mutuamente. Dois desenvolvedores testando prompts vão colidir; se precisarem compartilhar, coloque a geração atrás de uma fila com um único worker.
  • Loop de tentativas só piora a situação. Use backoff em intervalos de 45–60 segundos, em vez de insistir sem parar.

O limite parece mais um controle de lançamento gerenciado do que uma política definitiva. Mas, até que a Alibaba o eleve, o qwen-image-3.0-pro é uma ferramenta interativa, não um componente de pipeline.

Renderização de texto: onde funciona e onde falha

A tipografia é a principal razão para prestar atenção neste modelo, e os testes independentes sustentam essa promessa — com uma fronteira bem clara. Em testes publicados com saídas brutas do Pro, uma ficha técnica de máquina de espresso renderizou corretamente todos os valores, inclusive uma linha de série em letras miúdas ("Serial AT-2026-0731 / Made in Suzhou") em um equivalente a aproximadamente 8pt; uma placa bilíngue também acertou inglês e chinês. A falha apareceu em um mockup de editor de código, cujos números de linha saíram como 1, 3, 3, 4, 6. Palavras e rótulos se sustentam; sequências monotônicas e operadores de código, não.

Para calibrar a comparação, rodei o mesmo formato de prompt de ficha técnica no Nano Banana Pro (Gemini 3 Pro Image) em 5 de agosto de 2026: uma ficha fictícia de espresso AROMA-9, com quatro valores exatos na tabela e uma linha de série em letras pequenas, nas configurações padrão. Foi uma tentativa, sem novas tentativas, em 65 segundos:

Resultado do Nano Banana Pro para o mesmo prompt de ficha técnica de espresso: as quatro linhas da tabela estão corretas, mas as letras miúdas dizem "Made in Suzheu"

As quatro linhas de especificação saíram corretas, mas a linha em letras miúdas escreveu o nome da cidade como "Suzheu" — justamente a faixa de tamanho em que a renderização do Qwen teria se mantido correta. Uma imagem isolada prova pouco; o padrão que ela reforça é que fidelidade em texto pequeno continua difícil, e esse é exatamente o terreno em que o Qwen decidiu competir. A percepção da comunidade se divide na mesma direção:

"Qwen está entregando muito acima da sua categoria. O Gemini 3 Pro leva vantagem em fidelidade de textura e 'acabamento'" — r/QwenImageGen, comparando a geração de imagem Qwen anterior ao Gemini 3 Pro Image

Se o texto precisa estar literalmente correto — capturas de código, eixos numerados, dados sequenciais — nenhum modelo de imagem atual é confiável, inclusive este.

Como chamar o qwen-image-3.0-pro

O caminho gratuito é o Qwen Studio (login obrigatório): escolha geração de imagem e troque o modelo padrão pelo 3.0. Para a API, o acesso passa pelo Alibaba Cloud Model Studio e exige uma chave da DashScope. O exemplo abaixo usa o endpoint internacional de Singapura; Pequim requer um endpoint próprio e uma chave de API separada.

curl -X POST "https://dashscope-intl.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $DASHSCOPE_API_KEY" \
  -d '{
    "model": "qwen-image-3.0-pro",
    "input": {"messages": [{"role": "user", "content": [
      {"text": "A four-row product spec table, fine print at the bottom..."}
    ]}]},
    "parameters": {"size": "1024*1536", "prompt_extend": true}
  }'

Alguns parâmetros diferem do que outras APIs de imagem adotam. Veja o que diz a referência oficial da API:

ParâmetroComportamento
sizewidth*height em formato livre; qualquer área total entre 512² e 2048² pixels, com proporção de 1:8–8:1. Se omitido, o modelo escolhe uma resolução com base no prompt
Edição de imagemPasse de 1 a 3 objetos {"image": "..."} (URL ou base64) antes do texto; apenas um turno
prompt_extendReescrita de prompt, ativada por padrão; o modo agent existe apenas para texto para imagem
nDe 1 a 6 imagens por solicitação
watermarkDesativada por padrão
URL do resultadoPNG em uma URL assinada que expira em 24 horas; baixe imediatamente e nunca armazene a URL

Sem pesos abertos: o que você baixa, afinal?

Não é possível baixar o Qwen Image 3 Pro. Ao contrário do Qwen-Image 1.0 e dos modelos de edição da era 2.0, que tiveram os pesos lançados sob Apache 2.0, a geração 3.0 chegou sem pesos, relatório técnico ou resultados de benchmarks. O checkpoint aberto mais recente da equipe continua sendo o Qwen/Qwen-Image-2512, de dezembro de 2025. É nele, junto com o repositório QwenLM/Qwen-Image no GitHub, que uma busca por “download” vai parar.

A ausência de benchmarks importa. A equipe mantém sua própria suíte de avaliação, a Qwen-Image-Bench, mas não publicou resultados para a geração 3.0. Assim, todas as alegações de qualidade acima se baseiam em demos e verificações pontuais de terceiros, não em uma avaliação sistemática.

Vale pagar o adicional do Pro?

Seu caso de usoRecomendação
Layouts densos em texto: fichas técnicas, cartazes, provas, sinalização multilínguePro: é para isso que serve o adicional de 2.8×, e a cota gratuita de 10 imagens dá para fazer o teste
Ilustrações do dia a dia, imagens de destaque, rascunhos que exigirão iteraçõesqwen-image-3.0 padrão: ¥0.18 fixos em qualquer resolução, com os mesmos limites de tamanho
Resultados finais em 2K para trabalhos carregados de textoPro, mas considere ¥0.5/imagem no orçamento e lembre-se do limite de área de 2.25MP
Pipelines em lote, SLAs de latência, qualquer processo sem supervisãoNenhum dos dois: 1 RPM desqualifica ambos; use uma API de imagem consolidada e deixe o Qwen para os casos tipográficos em que ele vence
Execução localQwen-Image-2512, o checkpoint aberto mais recente; a versão 3.0 não tem pesos

A leitura honesta é esta: o qwen-image-3.0-pro constrói sua proposta de valor sobre a renderização de textos densos, resiste bem a verificações pontuais de terceiros, mas fica operacionalmente limitado pelo teto de 1 RPM, que o transforma em uma ferramenta especializada. Experimente a cota gratuita com seu prompt tipográfico mais difícil; mantenha o tráfego de produção onde ele já roda até que o limite de taxa aumente.

Perguntas frequentes

O Qwen Image 3 Pro é gratuito?

Parcialmente. O Qwen Studio oferece uso interativo gratuito após login, e a região de API de Pequim inclui 10 imagens gratuitas válidas por 90 dias. Alguns gateways oferecem uma camada gratuita temporária, que o card do modelo identifica explicitamente como um teste com cota limitada.

Posso baixar o qwen-image-3.0-pro ou executá-lo localmente?

Não. A geração 3.0 não tem pesos publicados. O modelo de imagem Qwen com pesos abertos mais recente é o Qwen-Image-2512, de dezembro de 2025, disponível no Hugging Face sob Apache 2.0.

Qual é a diferença entre qwen-image-3.0-pro e qwen-image-2.0-pro?

O 3.0 Pro amplia a capacidade de prompt para 4.5k tokens — o 2.0 tinha cerca de 1k — e acrescenta renderização de texto pequeno em 10px e suporte a 12 idiomas. Na tabela oficial de preços, ambos cobram ¥0.5 em 2K em Pequim, mas o 3.0 Pro cobra ¥0.25 pela saída 1K, contra os ¥0.5 fixos do 2.0 Pro.

O Qwen Image 3 Pro permite editar imagens?

Sim. O mesmo ID de modelo qwen-image-3.0-pro aceita de 1 a 3 imagens de referência junto de uma instrução para edição image-to-image. Vale notar que a entrada de imagens de referência foi reportada como quebrada em pelo menos um gateway de terceiros compatível com OpenAI. Por isso, teste a edição primeiro pela API nativa da DashScope.

Leia também