AIREITER

Il miglior modello GPT per generare immagini: Image 2 vs 1.5 (testati)

Ultimo Aggiornamento: 2026-08-06 02:13:16

GPT Image 2 domina le tre principali arene di valutazione delle immagini a voto cieco: su Artificial Analysis raggiunge un Elo di 1.340, ben 78 punti sopra GPT Image 1.5. Il rovescio della medaglia è il prezzo, che alla qualità alta può arrivare a $0.21 per immagine; gpt-image-1-mini, invece, scende sotto $0.01. Tra creatività per campagne, prototipi su larga scala e ritocco di foto prodotto, il modello giusto cambia: qui mettiamo a confronto tutti gli attuali modelli OpenAI per qualità, costi, risoluzione e capacità di editing.

Ambito: questa pagina riguarda esclusivamente la gamma OpenAI per la generazione di immagini — GPT Image 2, GPT Image 1.5, gpt-image-1-mini e il precedente GPT-4o. Per un confronto tra ecosistemi che include Midjourney, FLUX e Stable Diffusion, consulta il nostro confronto tra generatori di immagini AI del 2026.

I modelli OpenAI per immagini disponibili oggi

OpenAI propone quattro modelli per la generazione di immagini via API, descritti nella sua guida ai prompt. Ognuno è pensato per una diversa fascia di qualità e costo.

GPT Image 2 è arrivato il 21 aprile 2026 come modello di punta di OpenAI. Nella guida OpenAI viene definito "the strongest overall model": integra un passaggio di reasoning, supporta risoluzioni flessibili fino a circa 4K sperimentale e accetta qualsiasi rapporto d'aspetto entro i suoi limiti di pixel. OpenAI lo raccomanda "as the default for most production workflows."

GPT Image 1.5 è stato rilasciato nel dicembre 2025. Non dispone del passaggio di reasoning, ma supporta il parametro input_fidelity (low/high), che consente di decidere quanto dettaglio dell'immagine sorgente mantenere durante le modifiche. La risoluzione è limitata a formati fissi: 1024×1024, 1024×1536, 1536×1024 oppure auto. La guida OpenAI consiglia di mantenerlo "only for backward compatibility while you validate prompt migrations."

gpt-image-1-mini è l'opzione più economica, ottimizzata per "cost and throughput" secondo la documentazione OpenAI: generazione in batch di varianti, ideazione rapida, anteprime e asset di bozza che non richiedono la qualità più alta.

La generazione di immagini di GPT-4o, ovvero il primo ChatGPT Images, continua a funzionare nell'app consumer. Il modello API che ne è alla base, GPT Image 1, è classificato da OpenAI come "legacy compatibility only", con una raccomandazione esplicita a migrare a GPT Image 2.

Qualità e fedeltà al prompt: quanto pesa il divario Elo

Le arene a voto cieco sono quanto di più vicino esista a una misura oggettiva della qualità: valutatori umani scelgono l'output migliore senza sapere quale modello lo abbia generato.

Ad agosto 2026, GPT Image 2 è al primo posto in tutte e tre le principali classifiche:

ArenaGPT Image 2GPT Image 1.5Divario
Artificial Analysis (13.289 voti)1.340 Elo1.262 Elo78 punti
arena.ai (LMArena)610–631 EloNon classificato separatamente—
llm-stats.com (13.552 voti)661 Arena score333 Arena score328 punti

Il vantaggio di 78 punti su Artificial Analysis è il più ampio margine tra primo e secondo mai registrato da quella classifica.

La resa del testo è il terreno su cui la differenza emerge di più. GPT Image 2 gestisce con precisione il testo multilingue, inclusi gli alfabeti latino e CJK, al punto che Artificial Analysis lo valuta "near-perfect". È quindi la scelta predefinita per loghi, infografiche e immagini che contengono parole. GPT Image 1.5 si comporta bene con layout testuali semplici, ma perde caratteri nelle composizioni fitte che usano più font.

"GPT-Image-2 is out the model is insanely good at rendering text and generating all the tiny details in complex software interfaces" — u/Glittering-Neck-2505, r/singularity

Il fotorealismo è migliorato, ma con un compromesso. Alcuni utenti Reddit hanno osservato che GPT Image 2 colpisce subito per realismo, ma talvolta crea "repeating patterns/textures" negli elementi naturali. Un utente ha descritto le texture delle rocce come simili a "procedural generated textures in a video game." GPT Image 1.5 non presenta questo specifico artefatto, ma produce in generale meno dettaglio.

Ecco un test che ho eseguito con GPT Image 2: una scena in un caffè di Tokyo, con insegna al neon "COFFEE", pensata per mettere alla prova la resa del testo (gpt-image-2, qualità alta, 16:9):

Test di GPT Image 2: caffè di Tokyo di notte con finestra coperta di pioggia e insegna al neon COFFEE

Il testo al neon è stato renderizzato correttamente al primo tentativo, mentre le gocce di pioggia mostrano dettagli individuali anziché trasformarsi in una sfocatura uniforme.

Quanto costa ogni modello GPT per immagine

OpenAI applica prezzi in base ai token, non alla singola immagine. Qui sotto trovi le tariffe per token della pagina prezzi di OpenAI, verificate ad agosto 2026, insieme alle stime del costo per immagine.

Tariffe token (per 1M di token)

ModelloInput testoInput immagineInput immagine in cacheOutput immagine
gpt-image-2$5.00$8.00$2.00$30.00
gpt-image-1.5$5.00$8.00$2.00$32.00
gpt-image-1-mini$2.00$2.50$0.25$8.00

Costo stimato per immagine in base alla qualità

Le stime assumono una generazione testo-immagine a 1024×1024 con un prompt di 50–100 parole. Il costo reale varia in funzione della risoluzione e della complessità del prompt.

Qualitàgpt-image-2gpt-image-1.5gpt-image-1-mini
Bassa~$0.006~$0.009~$0.003
Media~$0.03–0.07~$0.04–0.08~$0.01
Alta~$0.10–0.21~$0.10–0.20~$0.03–0.05

"Low", "medium" e "high" corrispondono al parametro quality nella richiesta API, ad esempio quality="low". Ogni impostazione stabilisce il budget di token che il modello dedica al rendering dei dettagli: con low vengono generati meno token in output e il costo si riduce.

Grafico comparativo dei prezzi dei modelli GPT per immagini

C'è un dettaglio controintuitivo: i token di output di GPT Image 1.5 costano $32/1M, contro i $30/1M di GPT Image 2. Per la prototipazione veloce a qualità bassa, GPT Image 2 costa $0.006 per immagine, meno dei $0.009 di GPT Image 1.5.

gpt-image-1-mini costa approssimativamente un terzo. Nei flussi ad alto volume, ad esempio 10.000 anteprime di varianti prodotto, la differenza tra $0.003 e $0.006 consente di risparmiare $30 per batch.

Risoluzione, formati e strumenti di editing

GPT Image 2 accetta qualsiasi risoluzione tramite il parametro size, purché rispetti questi vincoli, indicati nella documentazione OpenAI:

  • Lato massimo < 3.840 px
  • Entrambi i lati devono essere multipli di 16
  • Rapporto d'aspetto ≤ 3:1
  • Pixel totali compresi tra 655.360 e 8.294.400

Tra i formati più comuni: 1024×1024 per il quadrato, 2560×1440 per un 2K affidabile e 3824×2144 per un quasi-4K sperimentale. OpenAI segnala che i risultati oltre il 2K sono "more variable."

GPT Image 1.5 è vincolato a quattro dimensioni fisse: 1024×1024, 1024×1536, 1536×1024 oppure auto. Non supporta risoluzioni personalizzate.

Sul fronte dell'editing, GPT Image 2 è in testa all'arena di image editing di Artificial Analysis con un Elo di 1.255, davanti a Nano Banana Pro di Google, fermo a 1.247. Il parametro input_fidelity di GPT Image 1.5 permette invece di controllare esplicitamente la conservazione dell'immagine sorgente durante le modifiche. GPT Image 2 non supporta questo parametro perché, secondo OpenAI, "output is already high fidelity by default."

Funzionegpt-image-2gpt-image-1.5gpt-image-1-mini
Risoluzione massima~4K (sperimentale)1536×1024 (fissa)1536×1024 (fissa)
Rapporti d'aspetto personalizzatiSìNo (4 preset + auto)No (4 preset + auto)
Passaggio di reasoningSìNoNo
input_fidelityDisabilitato (sempre alto)Low / HighLow / High
Elo nell'arena di editing1.255 (#1)Non classificato separatamenteNon classificato

Quale modello GPT scegliere per ogni lavoro

Marketing e creatività pubblicitaria

Scegli GPT Image 2 con qualità media o alta. Il passaggio di reasoning produce layout e testo più accurati quando il prompt è strutturato come un brief creativo. La guida di OpenAI consiglia infatti di scrivere prompt "like a creative brief rather than a purely technical image spec" per questo modello.

Mockup prodotto ed e-commerce

GPT Image 2 per le immagini hero, gpt-image-1-mini per le anteprime delle varianti. Usa GPT Image 2 ad alta qualità per l'immagine prodotto principale, sfruttando la risoluzione flessibile per adattarti alle dimensioni esatte dello store; poi passa a gpt-image-1-mini per varianti di colore, angolazione o sfondo da $0.003 l'una. Una linea da 50 SKU con 5 varianti per SKU costa circa $0.75 in totale con mini a qualità bassa.

Infografiche e immagini ricche di testo

GPT Image 2. Secondo Artificial Analysis, offre una resa del testo quasi perfetta con alfabeti latini e CJK. GPT Image 1.5 gestisce il testo semplice, ma può perdere caratteri nei layout densi con più font. Imposta la qualità su media o alta: a qualità bassa, la leggibilità del testo cala con tutti i modelli.

Generazione in batch ad alto volume

gpt-image-1-mini a qualità bassa. A $0.003 per immagine, 100.000 immagini costano $300. GPT Image 2 a qualità low, $0.006, resta una scelta sensata quando la qualità conta più della velocità di produzione. GPT Image 1.5 non offre vantaggi di costo in questo caso: i suoi token di output costano $2/1M in più di GPT Image 2.

Editing iterativo

GPT Image 2 per l'editing generale, GPT Image 1.5 quando serve il controllo di input_fidelity. GPT Image 2 guida l'arena di editing, ma il selettore di fedeltà di GPT Image 1.5 permette di passare da "preserve everything" a "reimagine loosely." Se la pipeline dipende da questo controllo, GPT Image 1.5 ha un vantaggio strutturale.

FAQ

GPT Image 2 è sempre migliore di GPT Image 1.5?

Non per ogni flusso di lavoro. GPT Image 1.5 offre il controllo input_fidelity per l'editing e il suo output evita gli artefatti a texture ripetuta che alcuni utenti hanno segnalato con GPT Image 2 nelle scene naturali, come rocce, fogliame e pelliccia. Quando è essenziale preservare fedelmente l'immagine sorgente, GPT Image 1.5 può essere migliore. Per resa del testo, fedeltà al prompt e fotorealismo, vince GPT Image 2.

Dovrei ancora usare GPT-4o per generare immagini?

No, a meno che non ti serva l'interfaccia consumer di ChatGPT senza accesso API. OpenAI classifica GPT Image 1, il modello dietro GPT-4o, come "legacy compatibility only" e consiglia la migrazione a GPT Image 2.

Posso usare GPT Image 2 gratuitamente?

La generazione di immagini limitata è disponibile nel piano gratuito di ChatGPT e nel piano Go da $8/mese. Per l'accesso API, i nuovi account OpenAI ricevono $5 di crediti gratuiti, sufficienti per circa 25–800 immagini in base all'impostazione di qualità.

Per cosa è utile gpt-image-1-mini?

Per lavori ad alto volume e sensibili ai costi: ideazione rapida, varianti per test A/B, asset segnaposto, anteprime thumbnail e personalizzazione in batch. A circa $0.003 per immagine a qualità bassa, costa approssimativamente 10× meno di GPT Image 2 a qualità media. Evitalo per immagini molto ricche di testo o asset destinati ai clienti, dove una buona qualità già al primo passaggio riduce i cicli di revisione.