AIREITER

GPT Image 2 Prompt Guide: Texte, Edits und Referenzen

Zuletzt aktualisiert: 2026-09-29 01:52:38

Ein Prompt für GPT Image 2 ist kein Sammelsurium von Adjektiven, sondern ein Produktionsbriefing.

Das Prompt-Format, mit dem GPT Image 2 zuverlässig arbeitet

Beginne mit dem gewünschten Endprodukt und beschreibe danach Motiv, Komposition, Szene, Text, Stil und Einschränkungen. Das OpenAI Cookbook empfiehlt eine feste Reihenfolge aus Szene, Motiv, wichtigen Details und Constraints. Für komplexere Aufgaben eignen sich außerdem klar beschriftete Abschnitte (OpenAI Cookbook).

TASK: Create a [poster / product photo / UI mockup / editorial image].
SUBJECT: [the person, object, or scene that must remain accurate].
COMPOSITION: [aspect ratio, viewpoint, framing, placement, negative space].
SCENE AND LIGHT: [location, materials, light direction, color].
TEXT: [exact words in quotes, role, placement, line count].
STYLE: [photorealistic or medium, lens feel, palette, texture].
CONSTRAINTS: [what to avoid and what must remain unchanged].

Nutze nur die Felder, die du für die jeweilige Aufgabe brauchst. Wenn etwas nicht funktioniert, ergänzt du gezielt weitere Angaben.

Konkrete visuelle Fakten bringen mehr als Begriffe wie „stunning“, „premium“ oder „ultra-detailed“. Angaben wie „weiches Fensterlicht von links aus Kameraperspektive, matte Keramik, 50-mm-Anmutung, das obere rechte Drittel bleibt frei“ geben GPT Image 2 verwertbare Entscheidungen vor.

Text im Bild: Layout und Funktion mitprompten

GPT Image 2 lohnt sich besonders dann, wenn ein Bild eine Überschrift, ein Label, ein Schild oder eine Benutzeroberfläche enthalten soll. Halte den Text kurz, setze entscheidende Passagen in Anführungszeichen, benenne ihre Funktion und verlange eine wortgetreue Ausgabe ohne zusätzliche Wörter.

Ein bewährtes Muster sieht so aus:

TEXT: Main headline reads exactly "NIGHT MARKET".
ROLE: Large condensed sans-serif headline across the upper-left.
LAYOUT: One line, white lettering, high contrast, centered vertically in its zone.
CONSTRAINTS: Render the quoted text verbatim. No extra words, duplicate text, logos, or watermark.

Bei mehreren Textblöcken bekommt jeder Block eine eigene Zeile. Bei einem Poster solltest du also „headline“, „subhead“ und „footer“ getrennt angeben, statt den gesamten Text in einem Satz zu beschreiben. Für mehrsprachige Aufgaben kennzeichnest du jede Sprache und fügst die exakten Zeichen ein, anstatt das Modell um eine Übersetzung zu bitten.

Wenn die Schreibweise wichtig ist, sollte der Text möglichst kurz bleiben. Scheitert eine Zeichenfolge wiederholt, isolierst du sie und änderst beim nächsten Versuch nur diese eine Variable.

SymptomWahrscheinliche UrsacheLösung
Wort falsch geschriebenDer Text ist zu lang oder nicht isoliertZeichenfolge kürzen, in Anführungszeichen setzen und ihre Funktion benennen
Zusätzliche WörterFür den Text gibt es keine klare Begrenzung„Kein zusätzlicher Text“ festlegen und die Zahl der Textblöcke begrenzen
Zeile fehltPosition oder Zeilenanzahl ist unklarBereich und Anzahl der Zeilen angeben

Prüfe jedes Label, jeden Preis, jede URL und jedes UI-Element in voller Größe. Rechtliche oder produktionsreife Typografie solltest du anschließend in einem Design-Tool fertigstellen.

Mehrere Referenzbilder und lokale Edits

Gib jedem Referenzbild eine klar benannte Aufgabe und sage ausdrücklich, was übernommen und was ignoriert werden soll. Laut dem GPT Image 2 Guide von fal kann der Edit-Workflow bis zu 16 Referenzbilder annehmen. Prüfe das Limit trotzdem in der Oberfläche oder API deines Anbieters (fal guide).

REFERENCE ROLES:
Image 1: base portrait. Preserve the face, pose, body proportions, framing, and background.
Image 2: jacket reference. Copy only the jacket cut, fabric, and color.
Image 3: boots reference. Copy only the boot shape and material.

CHANGE: Dress the person in Image 1 using the jacket from Image 2 and boots from Image 3.
PRESERVE: Face, hairstyle, hands, pose, camera angle, lighting, and body proportions.
CONSTRAINTS: No extra accessories, logos, or redesigned clothing.

Bei einem lokalen Edit beschreibst du genau einen Zielbereich und genau eine Änderung. Wenn das Tool Masken unterstützt, maskierst du den Bereich und weist GPT Image 2 an, ausschließlich dort einzugreifen. Ohne Maske helfen räumliche Angaben wie „das Schild oben rechts“ oder „der rote Becher auf der linken Seite“. Wiederhole die Liste der unveränderten Elemente in jedem Folgeprompt.

CHANGE ONLY: Replace the red sign in the upper-right with a blank cream sign.
PRESERVE: Building geometry, window reflections, people, shadows, camera angle, and color balance.
DO NOT: Recompose the storefront or add new text.

Ein sinnvoller Iterationsablauf sieht so aus: Bild erzeugen, den größten einzelnen Fehler bestimmen, eine Variable ändern und den restlichen Prompt unverändert lassen. Erfindet ein Edit neue Details, solltest du zuerst die Erhaltungsliste präzisieren, statt das Zielmotiv weiter zu verändern.

Was tun, wenn GPT Image 2 eine Anfrage ablehnt?

Versuche nicht, eine unzulässige Anfrage durch Euphemismen, Rollenspiel oder Anweisungen zum Ignorieren von Schutzmechanismen zu tarnen. Entferne das problematische Element oder formuliere das legitime kreative Ziel neu.

Wenn die Anfrage … enthältVerwende stattdessen ein sichereres Briefing …
sexualisierte Nacktheit oder eine Person mit unklarem Altereine erwachsene Person in gewöhnlicher, nicht expliziter Kleidung; nenne das Alter bei Bedarf eindeutig
das Abbild einer lebenden Person in einer sensiblen oder täuschenden Szeneeine fiktive erwachsene Figur mit nicht identifizierenden Merkmalen
eine urheberrechtlich geschützte Figur oder Markenidentitäteine eigene Figur, beschrieben über allgemeine visuelle Merkmale und ohne Logos oder geschützte Namen
grafische Verletzungen oder sexualisierte Gewaltnicht-grafische Folgen, symbolisches Erzählen oder eine neutrale Szene im Dokumentarstil
Anweisungen zum Umgehen der Moderationeine direkte, richtlinienkonforme Beschreibung der gewünschten Szene

Wird eine harmlose Anfrage blockiert, vereinfache sie und entferne unnötige sensible Begriffe. Ersetze zum Beispiel „make this person look nude“ durch „change the outfit to a plain long-sleeve shirt and trousers“ und erhalte dabei Pose und Licht. Lehnt die Plattform die Anfrage weiterhin ab, nutze den vorgesehenen Support- oder Richtlinienweg. Kein Prompt kann eine Freigabe garantieren.

GPT Image 2 und Nano Banana 2: zwei Arbeitsweisen statt magischer Syntax

Beschriftete Zeilen oder JSON-ähnliche Blöcke sind optionale Ordnungshilfen, keine besondere Syntax. Das OpenAI Cookbook unterstützt Minimal-Prompts, beschreibende Absätze, beschriftete Abschnitte und JSON-ähnliche Strukturen, solange Absicht und Einschränkungen klar bleiben (OpenAI Cookbook). Auch Googles Nano-Banana-Leitfaden setzt auf normale Alltagssprache: Motiv, Handlung, Kontext, Komposition, Stil und klar benannte Beziehungen zwischen Referenzbildern (Google DeepMind prompt guide).

Der praktische Unterschied liegt in der Arbeitsweise:

AufgabeArbeitsweise mit GPT Image 2Arbeitsweise mit Nano Banana 2
Neues fotorealistisches BildEin beschriftetes kreatives Briefing verwenden und photorealistic angeben, wenn Realismus das Ziel istMit Motiv, Handlung, Kontext, Komposition und Stil beginnen
Mehrere ReferenzenJedem Bild eine Rolle zuweisen und unveränderliche Merkmale auflistenDie Beziehung jeder Referenz zur neuen Szene benennen
Lokaler Edit„Nur X ändern; Y erhalten“ und, falls möglich, eine Maske verwendenÄnderung und Erhaltungsregeln in natürlicher Sprache formulieren
IterationEine Variable ändern und die Erhaltungsliste wiederholenKonversationell iterieren und die Identitäten der Referenzen weiter benennen

Die praktische Faustregel lautet: Starte mit GPT Image 2 bei textlastigen Bildern oder strukturierten Briefings. Teste Nano Banana 2, wenn die Treue zu Referenzbildern im Mittelpunkt steht. Das ist eine erste Heuristik, kein Benchmark-Ergebnis.

Prompt-Muster für typische Aufgaben

Fotorealistisches Produktbild

Create a 4:5 ecommerce hero image of a matte navy ceramic mug on a pale stone surface. Three-quarter view, mug in the lower-right third, empty upper-left for copy. Softbox from upper left, gentle fill from the right, photorealistic product photography, 50mm feel. Preserve the mug’s cylindrical shape and cream handle. No text, logo, watermark, extra products, or hands.

Poster mit viel Text

Create a vertical 9:16 event poster. A lone figure stands on an empty street under one warm lamp at twilight. Main headline reads exactly "THE NIGHT BEGINS AT EIGHT" in large gold serif type across the lower third. Subhead reads exactly "A STORY ABOUT WAITING" beneath it in small white sans serif. Two text lines only; render both verbatim. No extra text, QR code, logo, or watermark.

Lokaler Edit des Hintergrunds

Change only the background to a quiet beach at sunset. Preserve the person’s face, hair, clothing, pose, expression, camera angle, subject lighting, and framing. Match the new background perspective to the original image. Do not add people, text, logos, or extra objects.

Outfit-Edit anhand einer Referenz

Image 1 is the base person. Image 2 is the clothing reference. Replace only the outfit using Image 2’s jacket color, cut, and fabric. Preserve Image 1’s face, hair, body proportions, hands, pose, background, lighting, and framing. Add no jewelry, text, or logos.

FAQ

Wie lang sollte ein GPT Image 2 Prompt sein?

Eine feste Wortzahl gibt es nicht. Ein guter Prompt ist lang genug, um Endprodukt, Motiv, Komposition, exakten Text und Einschränkungen festzulegen. Alles, was keine visuelle Entscheidung hinzufügt, kann entfallen.

Wie viele Referenzbilder kann GPT Image 2 verwenden?

Im fal Guide heißt es, dass GPT Image 2 bei Edits bis zu 16 Referenzbilder akzeptieren kann. Die Grenzen können je nach Anbieter abweichen. Prüfe deshalb den verwendeten Endpoint und weise jedem Bild eine eindeutige Rolle zu.

Was tun, wenn GPT Image 2 eine sichere Anfrage ablehnt?

Entferne missverständliche sensible Details, beschreibe das legitime visuelle Ziel direkt und versuche es mit einer fiktiven oder nicht identifizierenden Figur. Bitte das Modell nicht, Schutzmechanismen zu umgehen.

Die praktische Entscheidung

Prüfe vor der Generierung vier Punkte: exakter Text, Identität des Motivs, zu erhaltende Bereiche und unerwünschte Ergänzungen. Formuliere anschließend ein strukturiertes Briefing, sperre die wichtigen Elemente und ändere pro Iteration nur eine Variable.

Informationen zur API-Verfügbarkeit und den aktuellen Preisen findest du unter GPT Image 2 API pricing. Wenn du Modelle statt Prompts vergleichen willst, hilft dir GPT Image 2 vs Nano Banana.