AIREITER

Guida ai prompt per GPT Image 2: testo, modifiche e immagini di riferimento

Ultimo Aggiornamento: 2026-09-29 01:52:38

Un prompt per GPT Image 2 va scritto come un brief di produzione, non come un semplice elenco di aggettivi.

Il formato di prompt più efficace per GPT Image 2

Parti dall’output finale, poi specifica soggetto, composizione, scena, testo, stile e vincoli. L’OpenAI Cookbook consiglia un ordine coerente — scena, soggetto, dettagli principali e vincoli — mentre gli esempi mostrano anche l’utilità di sezioni con etichette per le richieste più complesse (OpenAI Cookbook).

TASK: Create a [poster / product photo / UI mockup / editorial image].
SUBJECT: [the person, object, or scene that must remain accurate].
COMPOSITION: [aspect ratio, viewpoint, framing, placement, negative space].
SCENE AND LIGHT: [location, materials, light direction, color].
TEXT: [exact words in quotes, role, placement, line count].
STYLE: [photorealistic or medium, lens feel, palette, texture].
CONSTRAINTS: [what to avoid and what must remain unchanged].

Usa solo i campi che servono davvero al lavoro e aggiungine altri quando qualcosa non funziona.

I dettagli visivi concreti sono più utili di “stupendo”, “premium” o “ultradettagliato”. Indicazioni come “luce morbida dalla finestra a sinistra della fotocamera, ceramica opaca, resa da 50 mm, terzo superiore destro libero” danno a GPT Image 2 elementi su cui prendere decisioni.

Testo nelle immagini: descrivi l’impaginazione, non solo le parole

GPT Image 2 merita di essere messo alla prova quando un’immagine deve contenere un titolo, un’etichetta, un’insegna o un’interfaccia. Mantieni il testo breve, racchiudi tra virgolette quello davvero importante, indicane il ruolo e chiedi di riprodurlo alla lettera, senza aggiunte.

Puoi usare questo schema:

TEXT: Main headline reads exactly "NIGHT MARKET".
ROLE: Large condensed sans-serif headline across the upper-left.
LAYOUT: One line, white lettering, high contrast, centered vertically in its zone.
CONSTRAINTS: Render the quoted text verbatim. No extra words, duplicate text, logos, or watermark.

Se ci sono più blocchi, assegna a ciascuno una riga dedicata. In un poster, per esempio, è meglio distinguere “headline”, “subhead” e “footer” invece di descrivere tutto il testo in un’unica frase. Per i contenuti multilingue, indica la lingua di ogni blocco e incolla i caratteri esatti: non chiedere al modello di tradurli.

Quando l’ortografia è importante, limita la lunghezza del testo. Se una stringa continua a essere generata male, isolala e al tentativo successivo modifica solo quella variabile.

ProblemaProbabile causaSoluzione
Parola scritta maleIl testo è lungo o non è isolatoAccorcia la stringa, racchiudila tra virgolette e indicane il ruolo
Compaiono parole extraI confini del testo non sono definitiSpecifica “nessun testo aggiuntivo” e limita il numero di blocchi testuali
Manca una rigaPosizione o numero di righe non sono chiariIndica l’area e il numero di righe

Controlla a dimensione reale ogni etichetta, prezzo, URL e controllo dell’interfaccia; per la tipografia legale o destinata alla produzione, completa il lavoro in un software di design.

Immagini di riferimento multiple e modifiche locali

Assegna a ogni immagine di riferimento un ruolo preciso, specificando cosa prendere e cosa ignorare. La guida di fal per GPT Image 2 indica che il flusso di modifica può accettare fino a 16 immagini di riferimento; verifica comunque il limite nell’interfaccia o nell’API del provider che stai usando (guida di fal).

REFERENCE ROLES:
Image 1: base portrait. Preserve the face, pose, body proportions, framing, and background.
Image 2: jacket reference. Copy only the jacket cut, fabric, and color.
Image 3: boots reference. Copy only the boot shape and material.

CHANGE: Dress the person in Image 1 using the jacket from Image 2 and boots from Image 3.
PRESERVE: Face, hairstyle, hands, pose, camera angle, lighting, and body proportions.
CONSTRAINTS: No extra accessories, logos, or redesigned clothing.

Per una modifica locale, descrivi una sola area e una sola operazione. Se lo strumento supporta una maschera, applicala alla regione interessata e chiedi a GPT Image 2 di modificare esclusivamente quella zona. In assenza di maschera, usa riferimenti spaziali come “l’insegna in alto a destra” o “la tazza rossa sul lato sinistro”. Ripeti l’elenco degli elementi da preservare in ogni prompt successivo.

CHANGE ONLY: Replace the red sign in the upper-right with a blank cream sign.
PRESERVE: Building geometry, window reflections, people, shadows, camera angle, and color balance.
DO NOT: Recompose the storefront or add new text.

Un ciclo di iterazione efficace è semplice: genera l’immagine, individua l’errore più evidente, modifica una sola variabile e lascia invariato il resto del brief. Se una modifica introduce dettagli inventati, rafforza l’elenco degli elementi da conservare prima di intervenire sull’area target.

Cosa fare quando GPT Image 2 rifiuta una richiesta

Non cercare di aggirare una richiesta vietata con eufemismi, role-play o istruzioni per ignorare le protezioni. Elimina l’elemento rischioso oppure riformula l’obiettivo creativo legittimo.

Se la richiesta contiene…Usa invece un brief più sicuro…
Nudità sessualizzata o una persona dall’età ambiguaUn soggetto adulto con abiti comuni e non espliciti; indica chiaramente l’età quando è rilevante
La somiglianza di una persona vivente in una scena sensibile o ingannevoleUn personaggio adulto di fantasia con tratti non identificativi
Un personaggio protetto da copyright o l’identità di un brandUn personaggio originale descritto attraverso caratteristiche visive generali, senza loghi o nomi registrati
Ferite grafiche o violenza sessualeConseguenze non grafiche, narrazione simbolica o una scena neutra in stile documentaristico
Istruzioni per eludere la moderazioneUna descrizione diretta e conforme alle policy della scena desiderata

Se una richiesta innocua viene bloccata, semplificala ed elimina i termini sensibili non necessari. Per esempio, sostituisci “rendi nuda questa persona” con “cambia l’abbigliamento con una semplice camicia a maniche lunghe e pantaloni”, mantenendo posa e illuminazione. Se la piattaforma continua a rifiutare, usa il canale di assistenza o quello previsto dalle policy: nessun prompt può garantire l’approvazione.

GPT Image 2 e Nano Banana 2: due approcci ai prompt, non una sintassi magica

Le righe con etichette o i blocchi simili al JSON sono semplici strumenti organizzativi, non una sintassi speciale. L’OpenAI Cookbook accetta prompt minimi, paragrafi descrittivi, sezioni con etichette e strutture simili al JSON, purché intenzione e vincoli restino chiari (OpenAI Cookbook). Anche le indicazioni di Google per Nano Banana usano il linguaggio naturale: soggetto, azione, contesto, composizione, stile e relazioni esplicite tra le immagini di riferimento (guida ai prompt di Google DeepMind).

La differenza utile è soprattutto operativa:

AttivitàApproccio con GPT Image 2Approccio con Nano Banana 2
Nuova immagine fotorealisticaUsa un brief creativo con sezioni e indica photorealistic quando l’obiettivo è il realismoParti da soggetto, azione, contesto, composizione e stile
Più immagini di riferimentoAssegna un ruolo a ogni immagine e specifica gli elementi invarianti da preservareDescrivi il rapporto tra ogni riferimento e la nuova scena
Modifica locale“Modifica solo X; preserva Y” e usa una maschera quando disponibileIndica in linguaggio naturale la modifica e le regole di conservazione
IterazioneModifica una variabile e ripeti l’elenco degli elementi da preservareProcedi in modo conversazionale, mantenendo ben visibili le identità dei riferimenti

La distinzione pratica riguarda quindi il flusso di lavoro: parti da GPT Image 2 per immagini con molto testo o brief strutturati, e prova Nano Banana 2 quando la fedeltà ai riferimenti è la priorità. È un criterio iniziale, non il risultato di un benchmark.

Pattern di prompt in base all’obiettivo

Immagine fotorealistica di prodotto

Create a 4:5 ecommerce hero image of a matte navy ceramic mug on a pale stone surface. Three-quarter view, mug in the lower-right third, empty upper-left for copy. Softbox from upper left, gentle fill from the right, photorealistic product photography, 50mm feel. Preserve the mug’s cylindrical shape and cream handle. No text, logo, watermark, extra products, or hands.

Poster ricco di testo

Create a vertical 9:16 event poster. A lone figure stands on an empty street under one warm lamp at twilight. Main headline reads exactly "THE NIGHT BEGINS AT EIGHT" in large gold serif type across the lower third. Subhead reads exactly "A STORY ABOUT WAITING" beneath it in small white sans serif. Two text lines only; render both verbatim. No extra text, QR code, logo, or watermark.

Modifica locale dello sfondo

Change only the background to a quiet beach at sunset. Preserve the person’s face, hair, clothing, pose, expression, camera angle, subject lighting, and framing. Match the new background perspective to the original image. Do not add people, text, logos, or extra objects.

Modifica dell’abbigliamento basata su un riferimento

Image 1 is the base person. Image 2 is the clothing reference. Replace only the outfit using Image 2’s jacket color, cut, and fabric. Preserve Image 1’s face, hair, body proportions, hands, pose, background, lighting, and framing. Add no jewelry, text, or logos.

FAQ

Quanto deve essere lungo un prompt per GPT Image 2?

Non esiste un numero di parole prestabilito. Un prompt efficace deve essere abbastanza dettagliato da definire output, soggetto, composizione, testo esatto e vincoli; elimina ogni frase che non aggiunge una decisione visiva.

Quante immagini di riferimento può usare GPT Image 2?

La guida di fal indica che le modifiche con GPT Image 2 possono accettare fino a 16 immagini di riferimento, ma i limiti possono cambiare da un provider all’altro. Controlla l’endpoint che stai chiamando e assegna a ogni immagine un ruolo chiaro.

Cosa devo fare se GPT Image 2 rifiuta una richiesta sicura?

Elimina i dettagli sensibili ambigui, descrivi direttamente l’obiettivo visivo legittimo e prova con un soggetto di fantasia o non identificabile. Non chiedere al modello di aggirare le protezioni.

La scelta pratica

Prima di generare, controlla quattro elementi: testo esatto, identità del soggetto, aree da preservare e aggiunte indesiderate. Poi scrivi un brief strutturato, blocca le parti importanti e modifica una variabile alla volta.

Per verificare la disponibilità del modello via API e i prezzi attuali, consulta prezzi dell’API di GPT Image 2. Per scegliere il modello, più che per ottimizzare i prompt, leggi GPT Image 2 vs Nano Banana.