AIREITER

Guide des prompts GPT Image 2 : texte, retouches et images de référence

Dernière mise à jour: 2026-09-29 01:54:11

Avec GPT Image 2, pensez brief de production plutôt que simple liste d’adjectifs.

La structure de prompt qui fonctionne avec GPT Image 2

Commencez par décrire le livrable final, puis précisez le sujet, la composition, la scène, le texte, le style et les contraintes. L’OpenAI Cookbook recommande un ordre constant — scène, sujet, détails importants, contraintes — et ses exemples montrent aussi l’intérêt de sections nommées pour les demandes complexes (OpenAI Cookbook).

TASK: Create a [poster / product photo / UI mockup / editorial image].
SUBJECT: [the person, object, or scene that must remain accurate].
COMPOSITION: [aspect ratio, viewpoint, framing, placement, negative space].
SCENE AND LIGHT: [location, materials, light direction, color].
TEXT: [exact words in quotes, role, placement, line count].
STYLE: [photorealistic or medium, lens feel, palette, texture].
CONSTRAINTS: [what to avoid and what must remain unchanged].

N’utilisez que les rubriques utiles à votre tâche ; ajoutez-en lorsque vous identifiez un problème.

Les faits visuels concrets sont plus efficaces que « spectaculaire », « haut de gamme » ou « ultra-détaillé ». « Lumière douce venant d’une fenêtre à gauche de l’appareil, céramique mate, rendu type 50 mm, tiers supérieur droit laissé vide » donne à GPT Image 2 des éléments directement exploitables.

Générer du texte : décrivez aussi la mise en page

GPT Image 2 mérite d’être testé dès qu’une image doit afficher un titre, une étiquette, une enseigne ou une interface. Limitez le texte, mettez entre guillemets les éléments essentiels, précisez leur rôle et exigez une reproduction à l’identique, sans ajout.

Utilisez par exemple cette structure :

TEXT: Main headline reads exactly "NIGHT MARKET".
ROLE: Large condensed sans-serif headline across the upper-left.
LAYOUT: One line, white lettering, high contrast, centered vertically in its zone.
CONSTRAINTS: Render the quoted text verbatim. No extra words, duplicate text, logos, or watermark.

Si l’image contient plusieurs blocs, consacrez une ligne à chacun. Pour une affiche, distinguez par exemple le « titre », le « sous-titre » et le « pied de page », au lieu de rassembler tout le contenu dans une seule phrase. Pour les créations multilingues, indiquez la langue de chaque bloc et fournissez les caractères exacts plutôt que de demander au modèle de traduire.

Lorsque l’orthographe est importante, gardez les textes courts. Si une chaîne échoue plusieurs fois, isolez-la et ne modifiez que cette variable lors de l’essai suivant.

Problème constatéCause probableCorrection
Mot mal orthographiéTexte trop long ou insuffisamment isoléRaccourcissez la chaîne, mettez-la entre guillemets et précisez son rôle
Mots ajoutésLes limites de la zone de texte ne sont pas définiesIndiquez « aucun texte supplémentaire » et limitez le nombre de blocs
Ligne manquantePosition ou nombre de lignes imprécisPrécisez la zone et le nombre de lignes

Vérifiez chaque libellé, prix, URL et commande d’interface en taille réelle ; finalisez la typographie juridique ou destinée à la production dans un outil de design.

Images de référence multiples et retouches locales

Attribuez à chaque image de référence un rôle explicite, en précisant ce qu’il faut reprendre et ce qu’il faut ignorer. Le guide GPT Image 2 de fal indique que son workflow d’édition peut accepter jusqu’à 16 images de référence ; vérifiez cette limite dans l’interface ou l’API de votre fournisseur (guide fal).

REFERENCE ROLES:
Image 1: base portrait. Preserve the face, pose, body proportions, framing, and background.
Image 2: jacket reference. Copy only the jacket cut, fabric, and color.
Image 3: boots reference. Copy only the boot shape and material.

CHANGE: Dress the person in Image 1 using the jacket from Image 2 and boots from Image 3.
PRESERVE: Face, hairstyle, hands, pose, camera angle, lighting, and body proportions.
CONSTRAINTS: No extra accessories, logos, or redesigned clothing.

Pour une retouche locale, décrivez une seule zone cible et une seule opération. Si l’outil gère les masques, masquez la zone concernée et demandez à GPT Image 2 de ne modifier qu’elle. Sans masque, utilisez des indications spatiales comme « l’enseigne en haut à droite » ou « le gobelet rouge sur la gauche ». Répétez la liste des éléments à préserver dans chaque prompt de suivi.

CHANGE ONLY: Replace the red sign in the upper-right with a blank cream sign.
PRESERVE: Building geometry, window reflections, people, shadows, camera angle, and color balance.
DO NOT: Recompose the storefront or add new text.

Une boucle d’itération efficace tient en quatre étapes : générer, repérer l’erreur principale, modifier une seule variable, puis conserver le reste du brief. Si la retouche invente des détails, renforcez la liste des éléments à préserver avant de toucher à la zone cible.

Que faire lorsque GPT Image 2 refuse une demande ?

Ne cherchez pas à contourner un refus avec des euphémismes, du jeu de rôle ou des instructions demandant d’ignorer les garde-fous. Retirez l’élément à risque ou reformulez l’objectif créatif légitime.

Si la demande contient…Préférez un brief plus sûr…
Nudité sexualisée ou personne dont l’âge est ambiguUn sujet adulte portant une tenue ordinaire et non explicite ; indiquez clairement l’âge lorsque c’est pertinent
Le visage d’une personne réelle dans une scène sensible ou trompeuseUn personnage adulte fictif aux traits non identifiants
Un personnage protégé par le droit d’auteur ou l’identité d’une marqueUn personnage original décrit par des caractéristiques visuelles générales, sans logo ni nom déposé
Blessure graphique ou violence sexuelleUne conséquence non graphique, une narration symbolique ou une scène documentaire neutre
Instructions visant à contourner la modérationUne description directe de la scène, conforme aux règles

Si une demande inoffensive est bloquée, simplifiez-la et retirez les termes sensibles qui ne sont pas indispensables. Remplacez par exemple « rends cette personne nue » par « remplace la tenue par une chemise unie à manches longues et un pantalon », en conservant la pose et la lumière. Si la plateforme refuse toujours, passez par son support ou son canal dédié aux règles ; aucun prompt ne garantit l’approbation.

GPT Image 2 et Nano Banana 2 : deux méthodes de prompting, pas une syntaxe magique

Les lignes nommées et les blocs proches du JSON sont des outils d’organisation facultatifs, pas une syntaxe spéciale. L’OpenAI Cookbook accepte les prompts minimalistes, les paragraphes descriptifs, les sections nommées et les structures proches du JSON, tant que l’intention et les contraintes restent claires (OpenAI Cookbook). Les recommandations de Google pour Nano Banana reposent elles aussi sur le langage naturel : sujet, action, contexte, composition, style et relations explicites entre les images de référence (guide de prompting Google DeepMind).

La différence utile se situe surtout dans la méthode :

UsageRéflexe avec GPT Image 2Réflexe avec Nano Banana 2
Nouvelle image photoréalisteUtiliser un brief créatif structuré et écrire photorealistic lorsque le réalisme est recherchéCommencer par le sujet, l’action, le contexte, la composition et le style
Plusieurs référencesAttribuer un rôle à chaque image et lister les éléments invariants à préserverDécrire la relation entre chaque référence et la nouvelle scène
Retouche localeÉcrire « modifier uniquement X ; préserver Y » et utiliser un masque lorsqu’il est disponibleDécrire naturellement la retouche et les règles de préservation
ItérationsModifier une variable et répéter la liste des éléments à préserverItérer de manière conversationnelle en rappelant l’identité des références

En pratique, commencez par GPT Image 2 pour les images contenant du texte ou les briefs très structurés, et testez Nano Banana 2 lorsque la fidélité aux références est votre priorité. Il s’agit d’un point de départ, pas d’un résultat de benchmark.

Modèles de prompts selon le besoin

Image produit photoréaliste

Create a 4:5 ecommerce hero image of a matte navy ceramic mug on a pale stone surface. Three-quarter view, mug in the lower-right third, empty upper-left for copy. Softbox from upper left, gentle fill from the right, photorealistic product photography, 50mm feel. Preserve the mug’s cylindrical shape and cream handle. No text, logo, watermark, extra products, or hands.

Affiche riche en texte

Create a vertical 9:16 event poster. A lone figure stands on an empty street under one warm lamp at twilight. Main headline reads exactly "THE NIGHT BEGINS AT EIGHT" in large gold serif type across the lower third. Subhead reads exactly "A STORY ABOUT WAITING" beneath it in small white sans serif. Two text lines only; render both verbatim. No extra text, QR code, logo, or watermark.

Retouche locale de l’arrière-plan

Change only the background to a quiet beach at sunset. Preserve the person’s face, hair, clothing, pose, expression, camera angle, subject lighting, and framing. Match the new background perspective to the original image. Do not add people, text, logos, or extra objects.

Retouche de tenue à partir d’une référence

Image 1 is the base person. Image 2 is the clothing reference. Replace only the outfit using Image 2’s jacket color, cut, and fabric. Preserve Image 1’s face, hair, body proportions, hands, pose, background, lighting, and framing. Add no jewelry, text, or logos.

FAQ

Quelle doit être la longueur d’un prompt GPT Image 2 ?

Il n’existe pas de nombre de mots fixe. Un bon prompt doit être assez détaillé pour préciser le livrable, le sujet, la composition, le texte exact et les contraintes ; supprimez toute phrase qui n’apporte aucune décision visuelle.

Combien d’images de référence GPT Image 2 peut-il utiliser ?

Le guide de fal indique que les retouches avec GPT Image 2 peuvent accepter jusqu’à 16 images de référence, mais les limites peuvent varier selon le fournisseur. Vérifiez l’endpoint appelé et attribuez un rôle précis à chaque image.

Que faire si GPT Image 2 refuse une demande sans danger ?

Retirez les détails sensibles ambigus, décrivez directement l’objectif visuel légitime et essayez avec un sujet fictif ou non identifiable. Ne demandez pas au modèle de contourner ses garde-fous.

Le choix pratique

Avant de lancer la génération, vérifiez quatre points : le texte exact, l’identité du sujet, les zones à préserver et les ajouts indésirables. Rédigez ensuite un brief structuré, verrouillez les éléments importants et ne modifiez qu’une variable à la fois.

Pour connaître la disponibilité de l’API et les tarifs actuels du modèle, consultez les tarifs de l’API GPT Image 2. Pour choisir un modèle plutôt que pour travailler le prompting, consultez GPT Image 2 vs Nano Banana.