Un prompt per GPT Image 2 va scritto come un brief di produzione, non come un semplice elenco di aggettivi.
Il formato di prompt più efficace per GPT Image 2
Parti dall’output finale, poi specifica soggetto, composizione, scena, testo, stile e vincoli. L’OpenAI Cookbook consiglia un ordine coerente — scena, soggetto, dettagli principali e vincoli — mentre gli esempi mostrano anche l’utilità di sezioni con etichette per le richieste più complesse (OpenAI Cookbook).
TASK: Create a [poster / product photo / UI mockup / editorial image].
SUBJECT: [the person, object, or scene that must remain accurate].
COMPOSITION: [aspect ratio, viewpoint, framing, placement, negative space].
SCENE AND LIGHT: [location, materials, light direction, color].
TEXT: [exact words in quotes, role, placement, line count].
STYLE: [photorealistic or medium, lens feel, palette, texture].
CONSTRAINTS: [what to avoid and what must remain unchanged].
Usa solo i campi che servono davvero al lavoro e aggiungine altri quando qualcosa non funziona.
I dettagli visivi concreti sono più utili di “stupendo”, “premium” o “ultradettagliato”. Indicazioni come “luce morbida dalla finestra a sinistra della fotocamera, ceramica opaca, resa da 50 mm, terzo superiore destro libero” danno a GPT Image 2 elementi su cui prendere decisioni.
Testo nelle immagini: descrivi l’impaginazione, non solo le parole
GPT Image 2 merita di essere messo alla prova quando un’immagine deve contenere un titolo, un’etichetta, un’insegna o un’interfaccia. Mantieni il testo breve, racchiudi tra virgolette quello davvero importante, indicane il ruolo e chiedi di riprodurlo alla lettera, senza aggiunte.
Puoi usare questo schema:
TEXT: Main headline reads exactly "NIGHT MARKET".
ROLE: Large condensed sans-serif headline across the upper-left.
LAYOUT: One line, white lettering, high contrast, centered vertically in its zone.
CONSTRAINTS: Render the quoted text verbatim. No extra words, duplicate text, logos, or watermark.
Se ci sono più blocchi, assegna a ciascuno una riga dedicata. In un poster, per esempio, è meglio distinguere “headline”, “subhead” e “footer” invece di descrivere tutto il testo in un’unica frase. Per i contenuti multilingue, indica la lingua di ogni blocco e incolla i caratteri esatti: non chiedere al modello di tradurli.
Quando l’ortografia è importante, limita la lunghezza del testo. Se una stringa continua a essere generata male, isolala e al tentativo successivo modifica solo quella variabile.
| Problema | Probabile causa | Soluzione |
|---|---|---|
| Parola scritta male | Il testo è lungo o non è isolato | Accorcia la stringa, racchiudila tra virgolette e indicane il ruolo |
| Compaiono parole extra | I confini del testo non sono definiti | Specifica “nessun testo aggiuntivo” e limita il numero di blocchi testuali |
| Manca una riga | Posizione o numero di righe non sono chiari | Indica l’area e il numero di righe |
Controlla a dimensione reale ogni etichetta, prezzo, URL e controllo dell’interfaccia; per la tipografia legale o destinata alla produzione, completa il lavoro in un software di design.
Immagini di riferimento multiple e modifiche locali
Assegna a ogni immagine di riferimento un ruolo preciso, specificando cosa prendere e cosa ignorare. La guida di fal per GPT Image 2 indica che il flusso di modifica può accettare fino a 16 immagini di riferimento; verifica comunque il limite nell’interfaccia o nell’API del provider che stai usando (guida di fal).
REFERENCE ROLES:
Image 1: base portrait. Preserve the face, pose, body proportions, framing, and background.
Image 2: jacket reference. Copy only the jacket cut, fabric, and color.
Image 3: boots reference. Copy only the boot shape and material.
CHANGE: Dress the person in Image 1 using the jacket from Image 2 and boots from Image 3.
PRESERVE: Face, hairstyle, hands, pose, camera angle, lighting, and body proportions.
CONSTRAINTS: No extra accessories, logos, or redesigned clothing.
Per una modifica locale, descrivi una sola area e una sola operazione. Se lo strumento supporta una maschera, applicala alla regione interessata e chiedi a GPT Image 2 di modificare esclusivamente quella zona. In assenza di maschera, usa riferimenti spaziali come “l’insegna in alto a destra” o “la tazza rossa sul lato sinistro”. Ripeti l’elenco degli elementi da preservare in ogni prompt successivo.
CHANGE ONLY: Replace the red sign in the upper-right with a blank cream sign.
PRESERVE: Building geometry, window reflections, people, shadows, camera angle, and color balance.
DO NOT: Recompose the storefront or add new text.
Un ciclo di iterazione efficace è semplice: genera l’immagine, individua l’errore più evidente, modifica una sola variabile e lascia invariato il resto del brief. Se una modifica introduce dettagli inventati, rafforza l’elenco degli elementi da conservare prima di intervenire sull’area target.
Cosa fare quando GPT Image 2 rifiuta una richiesta
Non cercare di aggirare una richiesta vietata con eufemismi, role-play o istruzioni per ignorare le protezioni. Elimina l’elemento rischioso oppure riformula l’obiettivo creativo legittimo.
| Se la richiesta contiene… | Usa invece un brief più sicuro… |
|---|---|
| Nudità sessualizzata o una persona dall’età ambigua | Un soggetto adulto con abiti comuni e non espliciti; indica chiaramente l’età quando è rilevante |
| La somiglianza di una persona vivente in una scena sensibile o ingannevole | Un personaggio adulto di fantasia con tratti non identificativi |
| Un personaggio protetto da copyright o l’identità di un brand | Un personaggio originale descritto attraverso caratteristiche visive generali, senza loghi o nomi registrati |
| Ferite grafiche o violenza sessuale | Conseguenze non grafiche, narrazione simbolica o una scena neutra in stile documentaristico |
| Istruzioni per eludere la moderazione | Una descrizione diretta e conforme alle policy della scena desiderata |
Se una richiesta innocua viene bloccata, semplificala ed elimina i termini sensibili non necessari. Per esempio, sostituisci “rendi nuda questa persona” con “cambia l’abbigliamento con una semplice camicia a maniche lunghe e pantaloni”, mantenendo posa e illuminazione. Se la piattaforma continua a rifiutare, usa il canale di assistenza o quello previsto dalle policy: nessun prompt può garantire l’approvazione.
GPT Image 2 e Nano Banana 2: due approcci ai prompt, non una sintassi magica
Le righe con etichette o i blocchi simili al JSON sono semplici strumenti organizzativi, non una sintassi speciale. L’OpenAI Cookbook accetta prompt minimi, paragrafi descrittivi, sezioni con etichette e strutture simili al JSON, purché intenzione e vincoli restino chiari (OpenAI Cookbook). Anche le indicazioni di Google per Nano Banana usano il linguaggio naturale: soggetto, azione, contesto, composizione, stile e relazioni esplicite tra le immagini di riferimento (guida ai prompt di Google DeepMind).
La differenza utile è soprattutto operativa:
| Attività | Approccio con GPT Image 2 | Approccio con Nano Banana 2 |
|---|---|---|
| Nuova immagine fotorealistica | Usa un brief creativo con sezioni e indica photorealistic quando l’obiettivo è il realismo | Parti da soggetto, azione, contesto, composizione e stile |
| Più immagini di riferimento | Assegna un ruolo a ogni immagine e specifica gli elementi invarianti da preservare | Descrivi il rapporto tra ogni riferimento e la nuova scena |
| Modifica locale | “Modifica solo X; preserva Y” e usa una maschera quando disponibile | Indica in linguaggio naturale la modifica e le regole di conservazione |
| Iterazione | Modifica una variabile e ripeti l’elenco degli elementi da preservare | Procedi in modo conversazionale, mantenendo ben visibili le identità dei riferimenti |
La distinzione pratica riguarda quindi il flusso di lavoro: parti da GPT Image 2 per immagini con molto testo o brief strutturati, e prova Nano Banana 2 quando la fedeltà ai riferimenti è la priorità. È un criterio iniziale, non il risultato di un benchmark.
Pattern di prompt in base all’obiettivo
Immagine fotorealistica di prodotto
Create a 4:5 ecommerce hero image of a matte navy ceramic mug on a pale stone surface. Three-quarter view, mug in the lower-right third, empty upper-left for copy. Softbox from upper left, gentle fill from the right, photorealistic product photography, 50mm feel. Preserve the mug’s cylindrical shape and cream handle. No text, logo, watermark, extra products, or hands.
Poster ricco di testo
Create a vertical 9:16 event poster. A lone figure stands on an empty street under one warm lamp at twilight. Main headline reads exactly "THE NIGHT BEGINS AT EIGHT" in large gold serif type across the lower third. Subhead reads exactly "A STORY ABOUT WAITING" beneath it in small white sans serif. Two text lines only; render both verbatim. No extra text, QR code, logo, or watermark.
Modifica locale dello sfondo
Change only the background to a quiet beach at sunset. Preserve the person’s face, hair, clothing, pose, expression, camera angle, subject lighting, and framing. Match the new background perspective to the original image. Do not add people, text, logos, or extra objects.
Modifica dell’abbigliamento basata su un riferimento
Image 1 is the base person. Image 2 is the clothing reference. Replace only the outfit using Image 2’s jacket color, cut, and fabric. Preserve Image 1’s face, hair, body proportions, hands, pose, background, lighting, and framing. Add no jewelry, text, or logos.
FAQ
Quanto deve essere lungo un prompt per GPT Image 2?
Non esiste un numero di parole prestabilito. Un prompt efficace deve essere abbastanza dettagliato da definire output, soggetto, composizione, testo esatto e vincoli; elimina ogni frase che non aggiunge una decisione visiva.
Quante immagini di riferimento può usare GPT Image 2?
La guida di fal indica che le modifiche con GPT Image 2 possono accettare fino a 16 immagini di riferimento, ma i limiti possono cambiare da un provider all’altro. Controlla l’endpoint che stai chiamando e assegna a ogni immagine un ruolo chiaro.
Cosa devo fare se GPT Image 2 rifiuta una richiesta sicura?
Elimina i dettagli sensibili ambigui, descrivi direttamente l’obiettivo visivo legittimo e prova con un soggetto di fantasia o non identificabile. Non chiedere al modello di aggirare le protezioni.
La scelta pratica
Prima di generare, controlla quattro elementi: testo esatto, identità del soggetto, aree da preservare e aggiunte indesiderate. Poi scrivi un brief strutturato, blocca le parti importanti e modifica una variabile alla volta.
Per verificare la disponibilità del modello via API e i prezzi attuali, consulta prezzi dell’API di GPT Image 2. Per scegliere il modello, più che per ottimizzare i prompt, leggi GPT Image 2 vs Nano Banana.