AIREITER

Qwen Image 3 Pro: prezzi API verificati, limiti e cosa offre in più

Ultimo Aggiornamento: 2026-08-05 04:01:31

Qwen Image 3 Pro costa ¥0.25 (~$0.035) per un'immagine nella fascia 1K nella regione di Pechino e ¥0.5 a 2K: 2.8× il prezzo di qwen-image-3.0 alla stessa risoluzione. Per impaginati ricchi di testo, il sovrapprezzo può avere senso. C'è però un dato nella pagina ufficiale del modello che condiziona qualunque utilizzo pratico: il limite è di 1 richiesta al minuto.

Qwen Image 3 Pro e qwen-image-3.0: cosa cambia davvero

Qwen Image 3 Pro (qwen-image-3.0-pro) è la variante orientata alla qualità della generazione Qwen-Image-3.0 di Alibaba, rilasciata il 21 luglio 2026. Sia Pro sia il modello standard qwen-image-3.0 gestiscono text-to-image e image editing attraverso la stessa API, con limiti dimensionali identici. Le differenze riguardano la qualità dell'output e la tariffazione del 2K.

Le principali capacità sono comuni a tutta la famiglia 3.0:

  • Prompt fino a 4.5k token, contro circa 1k della generazione precedente: abbastanza per descrivere in un solo passaggio una pagina di giornale completa, una griglia infografica 3×3 o un'interfaccia annidata dentro un'altra interfaccia
  • Testo nitido fino a 10px, con formule LaTeX, apici e numerazione dei teoremi che restano leggibili
  • 12 lingue e oltre 20 font riprodotti nativamente, oltre a interfacce web, di gioco e di livestream simulate
Annuncio ufficiale di Qwen-Image-3.0 su qwen.ai, pubblicato il 21 luglio 2026

La distinzione è soprattutto nel posizionamento. Nelle proprie indicazioni per la scelta del modello, Alibaba indirizza a Pro la generazione di layout complessi, il rendering accurato di testo piccolo e il lavoro con font multilingue; il modello standard viene invece presentato come un compromesso tra qualità e velocità. Per il resto, la scheda tecnica è identica per entrambi gli ID: output da 512×512 a 2048×2048 pixel totali, rapporti d'aspetto da 1:8 a 8:1, da 1 a 3 immagini di riferimento per l'editing e output PNG.

Prezzi API ufficiali, verificati ad agosto 2026

Alibaba Cloud Model Studio riporta prezzi per immagine per qwen-image-3.0-pro in due regioni. Li abbiamo confrontati con il listino ufficiale il 5 agosto 2026:

Voce fatturataPechino (CNY)Singapore intl. (CNY)USD approssimativi
Input immagine (per immagine)¥0.02¥0.022483~$0.003
Output 1K (per immagine)¥0.25¥0.299768~$0.035–0.042
Output 2K (per immagine)¥0.5¥0.562065~$0.070–0.079

Il confine tra 1K e 2K dipende dall'area in pixel: fino a 2,250,000 pixel si applica la tariffa 1K, oltre si passa a quella 2K. Il modello standard qwen-image-3.0 costa invece ¥0.18 (~$0.025) fissi per immagine in output, a entrambe le risoluzioni. Ne deriva una situazione insolita: a 2K, Pro costa 2.8× il modello standard; a 1K, il divario è solo di 1.4×.

Tabella dei prezzi nella regione di Pechino per qwen-image-3.0-pro su Alibaba Cloud Model Studio, acquisita il 5 agosto 2026 Prezzo di output per immagine: qwen-image-3.0 a ¥0.18 fissi contro Pro a ¥0.25 in 1K e ¥0.5 in 2K

Ci sono due note importanti. Nella regione di Pechino è inclusa una quota gratuita di 10 immagini, contando insieme input e output, valida per 90 giorni dall'attivazione: sufficiente per verificare con i propri prompt le promesse sulla tipografia, non per costruirci qualcosa. Inoltre, almeno un gateway di terze parti elenca al momento il modello come gratuito, ma la nota nella model card lo definisce una prova a tempo limitato con quota massima. Qualsiasi prezzo di $0 va quindi considerato un canale demo, non un prezzo reale.

Il limite che cambia tutto: 1 richiesta al minuto

La pagina ufficiale del modello indica un RPM (richieste al minuto) pari a 1, sia a Pechino sia a Singapore e tanto per Pro quanto per il modello standard. È da uno a due ordini di grandezza sotto i 60–600 RPM tipici delle API di generazione immagini ormai consolidate.

Questo solo valore spiega quanto riportato dai primi utilizzatori: errori 429 immediati con chiamate consecutive, fallimento di entrambe le richieste quando due processi usavano la stessa chiave, esecuzioni pulite soltanto serializzando rigorosamente le richieste e adottando backoff generosi. Un test pubblicato il 23 luglio ha misurato esattamente questo comportamento tramite un gateway, prima che venisse documentato il limite ufficiale.

In pratica, significa questo:

  • La generazione in batch non è praticabile. Con 1 RPM il tetto è di ~1,440 richieste al giorno per chiave, in sequenza e senza tolleranza per i burst. Ogni richiesta può restituire fino a 6 immagini tramite n, con fatturazione per immagine.
  • I team con una chiave condivisa si ostacolano a vicenda. Due sviluppatori che iterano sui prompt entreranno in conflitto; se dovete condividere la chiave, mettete la generazione dietro una coda con un singolo worker.
  • I retry aggressivi peggiorano la situazione. Fate backoff a intervalli di 45–60 secondi, invece di insistere con nuove chiamate.

Sembra più un throttling da rollout controllato che una politica definitiva, ma finché Alibaba non alzerà il limite, qwen-image-3.0-pro resta uno strumento interattivo e non un componente da pipeline.

Rendering del testo: dove funziona e dove si rompe

La resa tipografica è il principale motivo d'interesse per questo modello, e nei test indipendenti regge — con un limite netto. Nei test pubblicati sull'output Pro non elaborato, una scheda tecnica di una macchina da espresso ha riprodotto correttamente ogni valore fino alla riga di serie in corpo minuscolo ("Serial AT-2026-0731 / Made in Suzhou"), equivalente a circa 8pt, mentre un cartello bilingue ha reso correttamente inglese e cinese. Il punto debole emerge in un mockup di editor di codice, dove i numeri di riga erano 1, 3, 3, 4, 6. Parole ed etichette tengono; sequenze monotone e operatori di codice no.

Per avere un riferimento, il 5 agosto 2026 ho usato la stessa struttura di prompt da scheda tecnica su Nano Banana Pro (Gemini 3 Pro Image): una scheda immaginaria di una macchina da espresso AROMA-9 con quattro valori esatti in tabella e una riga di serie in caratteri piccoli, con impostazioni predefinite. Un solo tentativo, senza retry, in 65 secondi:

Output di Nano Banana Pro con lo stesso prompt per la scheda tecnica della macchina da espresso: tutte e quattro le righe della tabella sono corrette, ma la scritta piccola riporta "Made in Suzheu"

Tutte e quattro le righe della scheda erano corrette, ma nella riga in corpo piccolo il nome della città diventava "Suzheu": proprio la fascia dimensionale in cui il rendering di Qwen sembra aver retto. Un'immagine dimostra poco; il quadro che ne emerge è che la fedeltà del testo piccolo è difficile ed è precisamente il terreno su cui Qwen ha scelto di competere. Anche il giudizio della community segue la stessa linea:

"Qwen gioca molto al di sopra della sua categoria. Gemini 3 Pro ha un vantaggio nella fedeltà delle texture e nella 'rifinitura'" — r/QwenImageGen, confronto tra la precedente generazione di immagini Qwen e Gemini 3 Pro Image

Se il testo deve essere letteralmente corretto — screenshot di codice, assi numerati, dati sequenziali — nessun modello di immagini attuale è una scelta sicura, incluso questo.

Come chiamare qwen-image-3.0-pro via API

La via gratuita è Qwen Studio, con login obbligatorio: scegliete la generazione immagini e passate dal modello predefinito alla versione 3.0. Per l'API serve invece Alibaba Cloud Model Studio e una chiave API DashScope. L'esempio seguente usa l'endpoint internazionale di Singapore; Pechino richiede un endpoint proprio e una chiave API separata.

curl -X POST "https://dashscope-intl.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $DASHSCOPE_API_KEY" \
  -d '{
    "model": "qwen-image-3.0-pro",
    "input": {"messages": [{"role": "user", "content": [
      {"text": "A four-row product spec table, fine print at the bottom..."}
    ]}]},
    "parameters": {"size": "1024*1536", "prompt_extend": true}
  }'

Dettagli dei parametri, diversi da quelli di altre API per immagini, secondo la documentazione API ufficiale:

ParametroComportamento
sizewidth*height libero; area totale da 512² a 2048² pixel e rapporto d'aspetto da 1:8 a 8:1. Se omesso, il modello sceglie la risoluzione in base al prompt
Image editingPassate da 1 a 3 oggetti {"image": "..."} (URL o base64) prima del testo; solo single-turn
prompt_extendRiscrittura del prompt, attiva per impostazione predefinita; la modalità agent esiste solo per text-to-image
nDa 1 a 6 immagini per richiesta
watermarkDisattivato per impostazione predefinita
URL del risultatoPNG dietro un URL firmato che scade dopo 24 ore; scaricate subito il file e non archiviate mai l'URL

Nessun peso open: cosa si scarica cercando il modello

Qwen Image 3 Pro non è scaricabile. A differenza di Qwen-Image 1.0 e dei modelli di editing dell'era 2.0, distribuiti con pesi sotto licenza Apache 2.0, la generazione 3.0 è arrivata senza pesi, report tecnico o punteggi benchmark. Il checkpoint open-weight più recente del team resta Qwen/Qwen-Image-2512 del dicembre 2025. È questo, insieme al repository GitHub QwenLM/Qwen-Image, ciò che si trova cercando un download.

L'assenza di benchmark conta. Il team mantiene una propria suite di valutazione, Qwen-Image-Bench, ma non ha pubblicato risultati per la generazione 3.0. Tutte le valutazioni sulla qualità riportate sopra si basano quindi su demo e verifiche puntuali di terze parti, non su una valutazione sistematica.

Vale la pena pagare il sovrapprezzo di Pro?

EsigenzaScelta
Layout ricchi di testo: schede tecniche, poster, compiti d'esame, segnaletica multilinguePro: è qui che si giustifica il sovrapprezzo di 2.8×, e la quota gratuita di 10 immagini basta per provarlo
Illustrazioni comuni, hero image, bozze su cui iterareStandard qwen-image-3.0: ¥0.18 fissi a qualsiasi risoluzione, con gli stessi limiti dimensionali
Output finali 2K con molto testoPro, mettendo in conto ¥0.5 per immagine e ricordando il confine di area a 2.25MP
Pipeline batch, SLA di latenza, qualunque flusso non presidiatoNessuno dei due: 1 RPM esclude entrambi; meglio un'API immagini consolidata, mantenendo Qwen per i casi tipografici in cui eccelle
Esecuzione in localeQwen-Image-2512, il checkpoint open più recente; la versione 3.0 non ha pesi pubblicati

La valutazione più onesta è questa: qwen-image-3.0-pro punta tutto sul rendering di layout densi di testo, tiene nei controlli puntuali di terze parti, ma è fortemente limitato sul piano operativo da 1 RPM e va quindi trattato come uno strumento specialistico. Provatelo con la quota gratuita sul vostro prompt tipografico più difficile; per il traffico di produzione, restate dove già operate finché il rate limit non verrà alzato.

FAQ

Qwen Image 3 Pro è gratuito?

In parte. Qwen Studio offre l'uso interattivo gratuito dopo il login e la regione API di Pechino include 10 immagini gratuite valide per 90 giorni. Alcuni gateway propongono un livello gratuito a tempo limitato, che la model card indica esplicitamente come prova soggetta a quota massima.

Posso scaricare qwen-image-3.0-pro o eseguirlo in locale?

No. La generazione 3.0 non ha pesi pubblicati. Il più recente modello immagini Qwen con pesi aperti è Qwen-Image-2512 del dicembre 2025, disponibile su Hugging Face sotto licenza Apache 2.0.

Qual è la differenza tra qwen-image-3.0-pro e qwen-image-2.0-pro?

3.0 Pro porta la capacità del prompt a 4.5k token, contro circa 1k per 2.0, e aggiunge il rendering di testo piccolo a 10px e il supporto per 12 lingue. Nel listino ufficiale, entrambi costano ¥0.5 a 2K a Pechino, ma l'output 1K di 3.0 Pro costa ¥0.25 contro i ¥0.5 fissi di 2.0 Pro.

Qwen Image 3 Pro supporta l'image editing?

Sì. Lo stesso ID modello qwen-image-3.0-pro accetta da 1 a 3 immagini di riferimento insieme a un'istruzione per l'editing image-to-image. L'input con immagini di riferimento è però stato segnalato come non funzionante su almeno un gateway di terze parti compatibile con OpenAI: conviene quindi testare l'editing prima attraverso l'API DashScope nativa.

Approfondimenti correlati