Qwen Image 3 Pro costa ¥0.25 (~$0.035) per un'immagine nella fascia 1K nella regione di Pechino e ¥0.5 a 2K: 2.8× il prezzo di qwen-image-3.0 alla stessa risoluzione. Per impaginati ricchi di testo, il sovrapprezzo può avere senso. C'è però un dato nella pagina ufficiale del modello che condiziona qualunque utilizzo pratico: il limite è di 1 richiesta al minuto.
Qwen Image 3 Pro e qwen-image-3.0: cosa cambia davvero
Qwen Image 3 Pro (qwen-image-3.0-pro) è la variante orientata alla qualità della generazione Qwen-Image-3.0 di Alibaba, rilasciata il 21 luglio 2026. Sia Pro sia il modello standard qwen-image-3.0 gestiscono text-to-image e image editing attraverso la stessa API, con limiti dimensionali identici. Le differenze riguardano la qualità dell'output e la tariffazione del 2K.
Le principali capacità sono comuni a tutta la famiglia 3.0:
- Prompt fino a 4.5k token, contro circa 1k della generazione precedente: abbastanza per descrivere in un solo passaggio una pagina di giornale completa, una griglia infografica 3×3 o un'interfaccia annidata dentro un'altra interfaccia
- Testo nitido fino a 10px, con formule LaTeX, apici e numerazione dei teoremi che restano leggibili
- 12 lingue e oltre 20 font riprodotti nativamente, oltre a interfacce web, di gioco e di livestream simulate
La distinzione è soprattutto nel posizionamento. Nelle proprie indicazioni per la scelta del modello, Alibaba indirizza a Pro la generazione di layout complessi, il rendering accurato di testo piccolo e il lavoro con font multilingue; il modello standard viene invece presentato come un compromesso tra qualità e velocità. Per il resto, la scheda tecnica è identica per entrambi gli ID: output da 512×512 a 2048×2048 pixel totali, rapporti d'aspetto da 1:8 a 8:1, da 1 a 3 immagini di riferimento per l'editing e output PNG.
Prezzi API ufficiali, verificati ad agosto 2026
Alibaba Cloud Model Studio riporta prezzi per immagine per qwen-image-3.0-pro in due regioni. Li abbiamo confrontati con il listino ufficiale il 5 agosto 2026:
| Voce fatturata | Pechino (CNY) | Singapore intl. (CNY) | USD approssimativi |
|---|---|---|---|
| Input immagine (per immagine) | ¥0.02 | ¥0.022483 | ~$0.003 |
| Output 1K (per immagine) | ¥0.25 | ¥0.299768 | ~$0.035–0.042 |
| Output 2K (per immagine) | ¥0.5 | ¥0.562065 | ~$0.070–0.079 |
Il confine tra 1K e 2K dipende dall'area in pixel: fino a 2,250,000 pixel si applica la tariffa 1K, oltre si passa a quella 2K. Il modello standard qwen-image-3.0 costa invece ¥0.18 (~$0.025) fissi per immagine in output, a entrambe le risoluzioni. Ne deriva una situazione insolita: a 2K, Pro costa 2.8× il modello standard; a 1K, il divario è solo di 1.4×.
Ci sono due note importanti. Nella regione di Pechino è inclusa una quota gratuita di 10 immagini, contando insieme input e output, valida per 90 giorni dall'attivazione: sufficiente per verificare con i propri prompt le promesse sulla tipografia, non per costruirci qualcosa. Inoltre, almeno un gateway di terze parti elenca al momento il modello come gratuito, ma la nota nella model card lo definisce una prova a tempo limitato con quota massima. Qualsiasi prezzo di $0 va quindi considerato un canale demo, non un prezzo reale.
Il limite che cambia tutto: 1 richiesta al minuto
La pagina ufficiale del modello indica un RPM (richieste al minuto) pari a 1, sia a Pechino sia a Singapore e tanto per Pro quanto per il modello standard. È da uno a due ordini di grandezza sotto i 60–600 RPM tipici delle API di generazione immagini ormai consolidate.
Questo solo valore spiega quanto riportato dai primi utilizzatori: errori 429 immediati con chiamate consecutive, fallimento di entrambe le richieste quando due processi usavano la stessa chiave, esecuzioni pulite soltanto serializzando rigorosamente le richieste e adottando backoff generosi. Un test pubblicato il 23 luglio ha misurato esattamente questo comportamento tramite un gateway, prima che venisse documentato il limite ufficiale.
In pratica, significa questo:
- La generazione in batch non è praticabile. Con 1 RPM il tetto è di ~1,440 richieste al giorno per chiave, in sequenza e senza tolleranza per i burst. Ogni richiesta può restituire fino a 6 immagini tramite
n, con fatturazione per immagine. - I team con una chiave condivisa si ostacolano a vicenda. Due sviluppatori che iterano sui prompt entreranno in conflitto; se dovete condividere la chiave, mettete la generazione dietro una coda con un singolo worker.
- I retry aggressivi peggiorano la situazione. Fate backoff a intervalli di 45–60 secondi, invece di insistere con nuove chiamate.
Sembra più un throttling da rollout controllato che una politica definitiva, ma finché Alibaba non alzerà il limite, qwen-image-3.0-pro resta uno strumento interattivo e non un componente da pipeline.
Rendering del testo: dove funziona e dove si rompe
La resa tipografica è il principale motivo d'interesse per questo modello, e nei test indipendenti regge — con un limite netto. Nei test pubblicati sull'output Pro non elaborato, una scheda tecnica di una macchina da espresso ha riprodotto correttamente ogni valore fino alla riga di serie in corpo minuscolo ("Serial AT-2026-0731 / Made in Suzhou"), equivalente a circa 8pt, mentre un cartello bilingue ha reso correttamente inglese e cinese. Il punto debole emerge in un mockup di editor di codice, dove i numeri di riga erano 1, 3, 3, 4, 6. Parole ed etichette tengono; sequenze monotone e operatori di codice no.
Per avere un riferimento, il 5 agosto 2026 ho usato la stessa struttura di prompt da scheda tecnica su Nano Banana Pro (Gemini 3 Pro Image): una scheda immaginaria di una macchina da espresso AROMA-9 con quattro valori esatti in tabella e una riga di serie in caratteri piccoli, con impostazioni predefinite. Un solo tentativo, senza retry, in 65 secondi:
Tutte e quattro le righe della scheda erano corrette, ma nella riga in corpo piccolo il nome della città diventava "Suzheu": proprio la fascia dimensionale in cui il rendering di Qwen sembra aver retto. Un'immagine dimostra poco; il quadro che ne emerge è che la fedeltà del testo piccolo è difficile ed è precisamente il terreno su cui Qwen ha scelto di competere. Anche il giudizio della community segue la stessa linea:
"Qwen gioca molto al di sopra della sua categoria. Gemini 3 Pro ha un vantaggio nella fedeltà delle texture e nella 'rifinitura'" — r/QwenImageGen, confronto tra la precedente generazione di immagini Qwen e Gemini 3 Pro Image
Se il testo deve essere letteralmente corretto — screenshot di codice, assi numerati, dati sequenziali — nessun modello di immagini attuale è una scelta sicura, incluso questo.
Come chiamare qwen-image-3.0-pro via API
La via gratuita è Qwen Studio, con login obbligatorio: scegliete la generazione immagini e passate dal modello predefinito alla versione 3.0. Per l'API serve invece Alibaba Cloud Model Studio e una chiave API DashScope. L'esempio seguente usa l'endpoint internazionale di Singapore; Pechino richiede un endpoint proprio e una chiave API separata.
curl -X POST "https://dashscope-intl.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $DASHSCOPE_API_KEY" \
-d '{
"model": "qwen-image-3.0-pro",
"input": {"messages": [{"role": "user", "content": [
{"text": "A four-row product spec table, fine print at the bottom..."}
]}]},
"parameters": {"size": "1024*1536", "prompt_extend": true}
}'
Dettagli dei parametri, diversi da quelli di altre API per immagini, secondo la documentazione API ufficiale:
| Parametro | Comportamento |
|---|---|
size | width*height libero; area totale da 512² a 2048² pixel e rapporto d'aspetto da 1:8 a 8:1. Se omesso, il modello sceglie la risoluzione in base al prompt |
| Image editing | Passate da 1 a 3 oggetti {"image": "..."} (URL o base64) prima del testo; solo single-turn |
prompt_extend | Riscrittura del prompt, attiva per impostazione predefinita; la modalità agent esiste solo per text-to-image |
n | Da 1 a 6 immagini per richiesta |
watermark | Disattivato per impostazione predefinita |
| URL del risultato | PNG dietro un URL firmato che scade dopo 24 ore; scaricate subito il file e non archiviate mai l'URL |
Nessun peso open: cosa si scarica cercando il modello
Qwen Image 3 Pro non è scaricabile. A differenza di Qwen-Image 1.0 e dei modelli di editing dell'era 2.0, distribuiti con pesi sotto licenza Apache 2.0, la generazione 3.0 è arrivata senza pesi, report tecnico o punteggi benchmark. Il checkpoint open-weight più recente del team resta Qwen/Qwen-Image-2512 del dicembre 2025. È questo, insieme al repository GitHub QwenLM/Qwen-Image, ciò che si trova cercando un download.
L'assenza di benchmark conta. Il team mantiene una propria suite di valutazione, Qwen-Image-Bench, ma non ha pubblicato risultati per la generazione 3.0. Tutte le valutazioni sulla qualità riportate sopra si basano quindi su demo e verifiche puntuali di terze parti, non su una valutazione sistematica.
Vale la pena pagare il sovrapprezzo di Pro?
| Esigenza | Scelta |
|---|---|
| Layout ricchi di testo: schede tecniche, poster, compiti d'esame, segnaletica multilingue | Pro: è qui che si giustifica il sovrapprezzo di 2.8×, e la quota gratuita di 10 immagini basta per provarlo |
| Illustrazioni comuni, hero image, bozze su cui iterare | Standard qwen-image-3.0: ¥0.18 fissi a qualsiasi risoluzione, con gli stessi limiti dimensionali |
| Output finali 2K con molto testo | Pro, mettendo in conto ¥0.5 per immagine e ricordando il confine di area a 2.25MP |
| Pipeline batch, SLA di latenza, qualunque flusso non presidiato | Nessuno dei due: 1 RPM esclude entrambi; meglio un'API immagini consolidata, mantenendo Qwen per i casi tipografici in cui eccelle |
| Esecuzione in locale | Qwen-Image-2512, il checkpoint open più recente; la versione 3.0 non ha pesi pubblicati |
La valutazione più onesta è questa: qwen-image-3.0-pro punta tutto sul rendering di layout densi di testo, tiene nei controlli puntuali di terze parti, ma è fortemente limitato sul piano operativo da 1 RPM e va quindi trattato come uno strumento specialistico. Provatelo con la quota gratuita sul vostro prompt tipografico più difficile; per il traffico di produzione, restate dove già operate finché il rate limit non verrà alzato.
FAQ
Qwen Image 3 Pro è gratuito?
In parte. Qwen Studio offre l'uso interattivo gratuito dopo il login e la regione API di Pechino include 10 immagini gratuite valide per 90 giorni. Alcuni gateway propongono un livello gratuito a tempo limitato, che la model card indica esplicitamente come prova soggetta a quota massima.
Posso scaricare qwen-image-3.0-pro o eseguirlo in locale?
No. La generazione 3.0 non ha pesi pubblicati. Il più recente modello immagini Qwen con pesi aperti è Qwen-Image-2512 del dicembre 2025, disponibile su Hugging Face sotto licenza Apache 2.0.
Qual è la differenza tra qwen-image-3.0-pro e qwen-image-2.0-pro?
3.0 Pro porta la capacità del prompt a 4.5k token, contro circa 1k per 2.0, e aggiunge il rendering di testo piccolo a 10px e il supporto per 12 lingue. Nel listino ufficiale, entrambi costano ¥0.5 a 2K a Pechino, ma l'output 1K di 3.0 Pro costa ¥0.25 contro i ¥0.5 fissi di 2.0 Pro.
Qwen Image 3 Pro supporta l'image editing?
Sì. Lo stesso ID modello qwen-image-3.0-pro accetta da 1 a 3 immagini di riferimento insieme a un'istruzione per l'editing image-to-image. L'input con immagini di riferimento è però stato segnalato come non funzionante su almeno un gateway di terze parti compatibile con OpenAI: conviene quindi testare l'editing prima attraverso l'API DashScope nativa.