Trate o prompt do GPT Image 2 como um briefing de produção — não como uma simples lista de adjetivos.
O formato de prompt que funciona no GPT Image 2
Comece pelo resultado final e, em seguida, descreva o assunto, a composição, a cena, o texto, o estilo e as restrições. O Cookbook da OpenAI recomenda uma ordem consistente — cena, assunto, detalhes principais e restrições —, enquanto os exemplos também mostram que seções nomeadas ajudam em pedidos mais complexos (OpenAI Cookbook).
TASK: Create a [poster / product photo / UI mockup / editorial image].
SUBJECT: [the person, object, or scene that must remain accurate].
COMPOSITION: [aspect ratio, viewpoint, framing, placement, negative space].
SCENE AND LIGHT: [location, materials, light direction, color].
TEXT: [exact words in quotes, role, placement, line count].
STYLE: [photorealistic or medium, lens feel, palette, texture].
CONSTRAINTS: [what to avoid and what must remain unchanged].
Use apenas os campos necessários para cada trabalho e acrescente outros quando algo der errado.
Fatos visuais concretos valem mais do que “impressionante”, “premium” ou “ultradetalhado”. “Luz suave de janela vindo da esquerda da câmera, cerâmica fosca, aparência de lente de 50 mm, terço superior direito vazio” dá ao GPT Image 2 decisões que ele consegue representar.
Renderização de texto: descreva o layout, não apenas as palavras
Vale testar o GPT Image 2 quando a imagem precisa carregar uma manchete, etiqueta, placa ou interface. Mantenha o texto curto, coloque entre aspas o que for essencial, indique a função daquele trecho e exija uma reprodução literal, sem palavras extras.
Use este padrão:
TEXT: Main headline reads exactly "NIGHT MARKET".
ROLE: Large condensed sans-serif headline across the upper-left.
LAYOUT: One line, white lettering, high contrast, centered vertically in its zone.
CONSTRAINTS: Render the quoted text verbatim. No extra words, duplicate text, logos, or watermark.
Quando houver vários blocos, dê uma linha própria para cada um. Em um prompt de pôster, por exemplo, é melhor separar “headline”, “subhead” e “footer” do que descrever todo o texto em uma única frase. Em trabalhos multilíngues, identifique cada idioma e cole os caracteres exatos, em vez de pedir que o modelo faça a tradução.
Se a grafia for importante, mantenha o texto curto. Quando uma sequência falhar repetidamente, isole-a e altere apenas essa variável na tentativa seguinte.
| Sintoma | Causa provável | Como corrigir |
|---|---|---|
| Palavra escrita errado | O texto é longo ou não foi isolado | Encurte a sequência, coloque-a entre aspas e indique sua função |
| Palavras extras | O layout não define um limite para o texto | Diga “sem texto extra” e limite o número de blocos de texto |
| Uma linha desaparece | A posição ou a quantidade de linhas não está clara | Especifique a área e o número de linhas |
Confira em tamanho real toda etiqueta, preço, URL e controle de interface. Deixe a tipografia legal ou de produção para finalizar em uma ferramenta de design.
Referências com várias imagens e edições locais
Dê a cada imagem de referência uma função claramente identificada, dizendo o que deve ser aproveitado e o que deve ser ignorado. O guia da fal para GPT Image 2 afirma que o fluxo de edição pode aceitar até 16 imagens de referência; confirme esse limite na interface ou na API do seu provedor (fal guide).
REFERENCE ROLES:
Image 1: base portrait. Preserve the face, pose, body proportions, framing, and background.
Image 2: jacket reference. Copy only the jacket cut, fabric, and color.
Image 3: boots reference. Copy only the boot shape and material.
CHANGE: Dress the person in Image 1 using the jacket from Image 2 and boots from Image 3.
PRESERVE: Face, hairstyle, hands, pose, camera angle, lighting, and body proportions.
CONSTRAINTS: No extra accessories, logos, or redesigned clothing.
Em uma edição localizada, descreva uma única área-alvo e uma única operação. Se a ferramenta aceitar máscara, aplique-a na região e diga ao GPT Image 2 para alterar somente aquele trecho. Sem máscara, use referências espaciais como “a placa no canto superior direito” ou “o copo vermelho do lado esquerdo”. Repita a lista de preservação em todos os prompts seguintes.
CHANGE ONLY: Replace the red sign in the upper-right with a blank cream sign.
PRESERVE: Building geometry, window reflections, people, shadows, camera angle, and color balance.
DO NOT: Recompose the storefront or add new text.
Um ciclo de iteração eficiente é: gerar, identificar o maior erro, alterar uma variável e manter o restante do briefing igual. Se a edição inventar detalhes, reforce a lista de elementos que devem ser preservados antes de mexer no alvo.
O que fazer quando o GPT Image 2 recusa um pedido
Não tente disfarçar um pedido proibido com eufemismos, encenação ou instruções para ignorar as proteções. Remova o elemento de risco ou reformule o objetivo criativo legítimo.
| Se o pedido contiver... | Prefira um briefing mais seguro... |
|---|---|
| Nudez sexualizada ou uma pessoa de idade ambígua | Uma pessoa adulta com roupas comuns e não explícitas; deixe a idade clara quando isso for relevante |
| A aparência de uma pessoa viva em uma cena sensível ou enganosa | Uma personagem adulta fictícia, com características não identificáveis |
| Um personagem protegido por direitos autorais ou uma identidade de marca | Uma personagem original descrita por características visuais gerais, sem logotipos ou nomes de marcas registradas |
| Ferimentos gráficos ou violência sexual | Consequências não gráficas, narrativa simbólica ou uma cena documental neutra |
| Instruções para burlar a moderação | Uma descrição direta e compatível com as políticas para a cena desejada |
Se um pedido inofensivo for bloqueado, simplifique-o e remova termos sensíveis desnecessários. Por exemplo, troque “deixe essa pessoa nua” por “mude a roupa para uma camisa lisa de manga comprida e calça”, preservando a pose e a iluminação. Se a plataforma continuar recusando, use o canal de suporte ou de políticas do serviço; nenhum prompt garante aprovação.
GPT Image 2 e Nano Banana 2: dois hábitos de prompting, não uma sintaxe mágica
Linhas nomeadas ou blocos no estilo JSON são organizadores opcionais, não uma sintaxe especial. O Cookbook da OpenAI aceita prompts mínimos, parágrafos descritivos, segmentos nomeados e estruturas semelhantes a JSON quando a intenção e as restrições continuam claras (OpenAI Cookbook). O guia do Nano Banana, do Google, também usa linguagem natural comum: assunto, ação, contexto, composição, estilo e relações explícitas entre as imagens de referência (Google DeepMind prompt guide).
A diferença útil está na operação:
| Trabalho | Abordagem com GPT Image 2 | Abordagem com Nano Banana 2 |
|---|---|---|
| Nova imagem fotorrealista | Use um briefing criativo com seções e escreva photorealistic quando o objetivo for realismo | Comece pelo assunto, ação, contexto, composição e estilo |
| Várias referências | Atribua uma função a cada imagem e liste os elementos invariáveis que devem ser preservados | Explique a relação entre cada referência e a nova cena |
| Edição local | “Altere somente X; preserve Y” e use uma máscara quando disponível | Descreva a edição e as regras de preservação em linguagem natural |
| Iteração | Altere uma variável e repita a lista de preservação | Faça iterações conversacionais, mantendo identificadas as referências |
Na prática, a diferença é uma questão de fluxo de trabalho: comece pelo GPT Image 2 quando o foco estiver em texto na imagem ou em briefings estruturados, e teste o Nano Banana 2 quando a fidelidade às referências for a principal preocupação. É uma heurística inicial, não um resultado de benchmark.
Padrões de prompt por tarefa
Imagem fotorrealista de produto
Create a 4:5 ecommerce hero image of a matte navy ceramic mug on a pale stone surface. Three-quarter view, mug in the lower-right third, empty upper-left for copy. Softbox from upper left, gentle fill from the right, photorealistic product photography, 50mm feel. Preserve the mug’s cylindrical shape and cream handle. No text, logo, watermark, extra products, or hands.
Pôster com muito texto
Create a vertical 9:16 event poster. A lone figure stands on an empty street under one warm lamp at twilight. Main headline reads exactly "THE NIGHT BEGINS AT EIGHT" in large gold serif type across the lower third. Subhead reads exactly "A STORY ABOUT WAITING" beneath it in small white sans serif. Two text lines only; render both verbatim. No extra text, QR code, logo, or watermark.
Edição localizada do fundo
Change only the background to a quiet beach at sunset. Preserve the person’s face, hair, clothing, pose, expression, camera angle, subject lighting, and framing. Match the new background perspective to the original image. Do not add people, text, logos, or extra objects.
Edição de roupa baseada em referência
Image 1 is the base person. Image 2 is the clothing reference. Replace only the outfit using Image 2’s jacket color, cut, and fabric. Preserve Image 1’s face, hair, body proportions, hands, pose, background, lighting, and framing. Add no jewelry, text, or logos.
Perguntas frequentes
Qual deve ser o tamanho de um prompt para GPT Image 2?
Não existe uma quantidade fixa de palavras. Um bom prompt é longo o suficiente para especificar o artefato, o assunto, a composição, o texto exato e as restrições. Apague qualquer frase que não acrescente uma decisão visual.
Quantas imagens de referência o GPT Image 2 aceita?
O guia da fal afirma que as edições do GPT Image 2 podem aceitar até 16 imagens de referência, mas os limites podem variar entre provedores. Verifique o endpoint que você está chamando e atribua uma função clara a cada imagem.
O que fazer se o GPT Image 2 recusar um pedido seguro?
Remova detalhes sensíveis ou ambíguos, descreva diretamente o objetivo visual legítimo e tente usar uma pessoa fictícia ou não identificável. Não peça ao modelo para burlar as proteções.
A escolha prática
Antes de gerar, confira quatro pontos: texto exato, identidade do assunto, áreas que devem ser preservadas e elementos indesejados. Depois, escreva um briefing estruturado, trave as partes importantes e revise uma variável por vez.
Para consultar a disponibilidade da API e os preços atuais do modelo, veja GPT Image 2 API pricing. Para escolher o modelo, e não o prompt, use GPT Image 2 vs Nano Banana.