AIREITER
DOC APIPREZZI
TEMPLATE
  • AIReiter
  • Blog
  • Guida ai prompt per Z Image Turbo: schemi pronti a scalare

Guida ai prompt per Z Image Turbo: schemi pronti a scalare

Ultimo Aggiornamento: 2026-09-06 01:58:47

Con Z-Image Turbo non esiste un campo negativo separato su cui scaricare i problemi da evitare: tutto passa dal prompt principale. L'approccio documentato da Tongyi-MAI e fal è semplice ma richiede precisione: descrivi l'immagine come un brief creativo compatto e inserisci nello stesso testo anche i requisiti di pulizia e controllo.

interfaccia fal Z-Image Turbo playground con prompt e risultato

La scelta nel prompt che cambia ogni risultato di Z-Image Turbo

Invece di accumulare tag, scrivi un unico brief in linguaggio naturale: apri con tipo di immagine e soggetto, quindi definisci composizione, ambientazione, luce, stile e vincoli. La model card ufficiale descrive Turbo come un modello distillato a 8 NFE con guidance_scale=0.0; anche la guida ai prompt di fal conferma che i negative prompt non sono supportati.

Come struttura iniziale affidabile, usa questo ordine:

  1. Tipo d'immagine e composizione: ritratto ravvicinato, fotografia di prodotto, illustrazione editoriale o scena cinematografica in 16:9.
  2. Soggetto e azione: chi o che cosa compare, cosa sta facendo e quali dettagli fisici lo definiscono.
  3. Ambiente: luogo, momento della giornata, sfondo e uno o due oggetti di scena rilevanti.
  4. Luce e palette: fonte luminosa, direzione, morbidezza, temperatura e colori dominanti.
  5. Riferimento stilistico: fotografia documentaristica, fotografia di prodotto pulita, acquerello oppure un altro unico medium.
  6. Vincoli nel prompt principale: fuoco nitido, sfondo pulito, mani naturali, testo esatto tra virgolette, nessuna filigrana né branding.

Come trasformare un prompt vago in un prompt pronto per la produzione

Queste riscritture isolano un requisito produttivo alla volta: così puoi individuare l'origine di un errore, invece di aggiungere aggettivi casuali.

Prima la gerarchia visiva, poi gli aggettivi

Prompt generico:

Beautiful woman in a garden, cinematic, highly detailed, 8K.

Prompt per la produzione:

Medium portrait of an adult woman pruning red roses in a Victorian garden, three-quarter view, her hands and pruning shears visible in the foreground. Moss-covered stone wall behind her, early morning, dappled sunlight through oak leaves, muted green and warm red palette, documentary lifestyle photography, soft natural skin texture, sharp focus on her face and hands, clean composition with no logo or watermark.

Il secondo prompt mette subito in chiaro inquadratura, azione, profondità, luce e palette. Aggettivi generici come “beautiful”, invece, non offrono a Z-Image Turbo elementi concreti da rappresentare.

Sostituisci i negative prompt con vincoli espliciti

Nella pipeline Turbo non fare affidamento su un campo separato come negative_prompt: "blur, extra fingers, clutter". Inserisci nel prompt principale sia le caratteristiche desiderate sia le esclusioni:

Problema da evitareFormula da provare nel prompt principale
Soggetto sfocatosharp focus on the subject, crisp fine detail
Sfondo troppo affollatosimple clean backdrop, uncluttered negative space
Mani innaturalinatural hands with five clearly separated fingers
Branding indesideratoplain unbranded surface, no visible logo or watermark
Testo casualeno extra lettering, only the quoted title is readable

Turbo non dispone di un campo separato per i negative prompt, ma un'esclusione come “no watermark” può e deve comparire nel prompt principale.

Un riferimento fotografico basta e avanza

Inserisci un solo riferimento a fotocamera o pellicola e lascia spazio al soggetto e al layout, per esempio 35mm street-photography framing, cool window light, visible fabric texture.

La base a otto passaggi e quando non inseguire la velocità

L'esempio ufficiale di Z-Image-Turbo usa num_inference_steps=9, valore che la model card di Tongyi-MAI traduce in otto forward pass DiT. Lo stesso esempio imposta guidance_scale=0.0, un seed fisso e un'immagine da 1024 × 1024. Non confondere però questa configurazione riproducibile con una promessa universale sui tempi: l'affermazione di latenza inferiore al secondo del progetto è legata a hardware enterprise H800, mentre sui sistemi consumer l'esecuzione può essere molto più lenta.

La pagina del modello su fal indica un intervallo configurabile da 1 a 8 passaggi, fino a 4 immagini per richiesta e output fino a 4 megapixel. Per un flusso di produzione, il suggerimento è sensato: usa il minimo numero di passaggi per le bozze rapide e avvicinati a otto per gli asset che vuoi conservare.

ControlloPunto di partenza praticoCosa modifica
Passaggi di inferenza8 forward pass, spesso esposti come 9 impostazioniIl principale compromesso qualità/latenza di Turbo
Guidance scale0.0Turbo è distillato senza il normale controllo CFG
Risoluzione1024 × 1024 per un test bilanciatoOutput più grandi costano di più e rendono evidenti gli errori di composizione
Rapporto d'aspettoPreset quadrato, verticale o orizzontaleAdatta la tela al canale di pubblicazione
SeedFisso durante la revisione del promptRende più semplice confrontare le modifiche al testo
Batch2–4 varianti quando supportatoPermette di selezionare, anziché fidarsi di un solo campione
Espansione del promptFacoltativa, soprattutto per prompt breviPuò aggiungere dettagli, ma anche elaborare troppo un brief già dettagliato

Le differenze rispetto alle alternative veloci

Le fonti pubbliche adottano hardware e impostazioni non comparabili: quello che segue è quindi un confronto di workflow, non di velocità sulla stessa GPU.

ModelloPercorso rapido documentatoCompromesso fra prompt e qualitàQuando sceglierlo
Z-Image Turbo8 NFE; viene dichiarata compatibilità con dispositivi consumer da 16 GB e latenza sotto il secondo su H800Forti dichiarazioni su fotorealismo e testo in inglese/cinese, ma la tabella del modello valuta bassa la diversità e Turbo non usa CFGSceglilo per primi passaggi ad alto volume e concept commerciali bilingui
FLUX.1-schnell1–4 passaggi; l'esempio ufficiale Diffusers usa 4 e guidance_scale=0.0Modello da 12B con un vasto ecosistema locale e licenza Apache 2.0; la model card non pubblica benchmark in tempo realeSceglilo quando il workflow da 1–4 passaggi e strumenti locali consolidati contano più dell'enfasi di Z-Image sul testo
SDXL Turbo1–4 passaggi, guidance_scale=0.0, addestrato/impostato di default a 512 × 512La documentazione Diffusers avverte che 768² e 1024² possono peggiorare il risultato; la licenza commerciale va verificataSceglilo per anteprime in tempo reale a 512px o per una pipeline SDXL già esistente

La tabella del modello e la documentazione degli endpoint non sono perfettamente allineate sugli adapter: lo zoo ufficiale dei modelli indica la fine-tunability di Turbo come N/A, mentre la guida fal documenta un endpoint Turbo LoRA. Considera quindi la disponibilità di LoRA specifica del wrapper; se l'addestramento di adapter è centrale, il modello base Z-Image è il punto di partenza più sicuro.

Schemi di prompt che reggono la produzione in batch

Nella produzione in batch, mantieni fisso il seed mentre perfezioni il testo e modificalo solo dopo aver stabilizzato la composizione.

Usa un ciclo in tre fasi:

  1. Esplora: parti da un prompt breve e strutturato, con più seed a un'impostazione di passaggi bassa o bilanciata.
  2. Seleziona: conserva la composizione che comunica l'idea, poi perfeziona testo, mani e posizione del prodotto mantenendo fisso il seed.
  3. Finalizza: sposta il concept scelto su un modello più lento o controllabile quando un'immagine di campagna richiede massimo dettaglio, diversità o fine-tuning.

Visual editoriali e social

Usa una sola metafora visiva e un unico punto focale che resti leggibile anche in miniatura.

Modello: Editorial illustration of [subject] showing [visual metaphor], [foreground focal object] placed at [left/center/right], [simple background], [two-color palette], [lighting], clean thumbnail-readable composition, no text, no watermark.

Esempio: Editorial illustration of a crowded AI content pipeline narrowing into a single human editor’s desk, a bright blue funnel on the right guiding scattered paper drafts toward one selected page, warm orange and teal palette, clean isometric composition, soft studio lighting, no text, no watermark.

Prodotti e packaging

Nelle immagini di prodotto, dai priorità alla geometria e al comportamento delle superfici rispetto all'atmosfera. Specifica posizione del prodotto, materiale, direzione della luce e testo esatto che deve apparire.

Esempio: Photorealistic matte-black coffee bag standing upright on a warm-gray stone surface, front-facing three-quarter product view, softbox from the upper left, controlled shadow to the right, subtle paper texture, premium packaging photography. The front label contains only the readable text “YUNNAN COFFEE” in small cream serif capitals, no other lettering, no logo, no watermark.

Nel packaging mantieni breve il testo obbligatorio e riportalo esattamente tra virgolette. La model card ufficiale di Z-Image evidenzia il rendering di testo in inglese e cinese, ma etichette brevi sono un obiettivo produttivo più sicuro rispetto a un menu fitto o a un paragrafo in corpo piccolo.

Ritratti senza effetto pelle levigata

Per i ritratti, aggiungi un'azione quotidiana, un'espressione concreta e un solo dettaglio di texture misurato: affidarsi soltanto a “photorealistic” non basta.

Esempio: Candid medium portrait of an adult man repairing a bicycle outside a neighborhood workshop, slightly uneven eyebrows, natural skin texture, worn navy work jacket, eyes focused on the bicycle rather than the camera, late-afternoon side light, muted blue and rust palette, 35mm documentary photography, sharp hands and face, clean background with no branding.

Immagini con testo

Inserisci il testo esatto abbastanza presto nel prompt da ricevere attenzione, poi descrivine posizione e tipografia. Se nella stessa grafica compaiono inglese e cinese, trattali come elementi separati.

Esempio: Photorealistic tea-bar storefront at dusk, centered hanging sign with the exact Chinese text “山茶” above the exact English text “MOUNTAIN TEA,” both in large cream serif lettering, warm interior light, clean glass facade, menu board with only the short word “OOLONG,” uncluttered urban composition, no extra text, no logo, no watermark.

Titoli brevi e grandi sono più affidabili di etichette piccole; controlla il testo generato prima della pubblicazione.

Come correggere gli errori che si incontrano davvero

La tabella di recupero qui sotto privilegia una modifica al prompt prima di cambiare seed o impostazioni di esecuzione. Un utente ha riassunto l'esperienza così:

“It was Z Image Turbo, it can be janky sometimes, and needs proper prompting but it can deliver really good stuff.” — @RodAndByte

SintomoPrima modifica al promptPoi modifica
Volto plasticoso o sguardo fisso in cameraAggiungi un'azione reale, candid, unposed e una direzione dello sguardo chiaraCambia seed solo dopo aver stabilizzato il testo
Il testo devia o compaiono parole extraMetti tra virgolette il testo breve esatto, specifica dimensione e posizione, quindi elimina le copie secondarieProva un altro seed e controlla alla dimensione finale di output
La scena di prodotto diventa affollataLimita gli oggetti di scena a uno o due e definisci le posizioni di primo piano e sfondoRiduci il linguaggio stilistico prima di aumentare i passaggi
Le mani sono sbagliateDescrivi l'azione visibile della mano e richiedi anatomia naturale a cinque ditaGenera più seed: non aspettarti che un solo campione risolva il problema
La generazione locale è lenta o instabileControlla wrapper, dtype, memoria GPU e risoluzione prima di riscrivere il promptUsa un endpoint ospitato per testare il throughput

Le segnalazioni di @iamzhihui e @9o_zZz_o6 mostrano che la velocità locale varia fra Mac, hardware GTX meno recente e configurazioni diverse. Prima di giudicare il prompt, verifica quindi wrapper, dtype, memoria, risoluzione e stato della compilazione.

FAQ sui prompt di Z-Image Turbo

I negative prompt funzionano con Z-Image Turbo?

Nel workflow Turbo documentato non è supportato un campo separato per i negative prompt; inserisci nel prompt principale le caratteristiche desiderate e le esclusioni, come “no watermark”.

Meglio usare 8 o 9 passaggi di inferenza?

Segui la nomenclatura dell'endpoint: Tongyi-MAI usa num_inference_steps=9 per otto forward pass DiT, mentre fal espone un intervallo da 1 a 8.

Quanto deve essere lungo un prompt per Z-Image Turbo?

Il manuale di prompting della community e la guida MindCraft indicano entrambi circa 80–250 parole come intervallo di lavoro, non come limite ufficiale di token; prima di aggiungere dettagli, elimina i concetti in competizione.

Z-Image Turbo è più veloce di FLUX schnell o SDXL Turbo?

Le fonti pubbliche non offrono un test di latenza equo sullo stesso hardware: Z-Image Turbo usa otto NFE, mentre FLUX.1-schnell e SDXL Turbo documentano da uno a quattro passaggi.

È adatto a un batch di generazione immagini di grandi dimensioni?

Sì, per generare e selezionare concept iniziali: fal indica fino a quattro immagini per richiesta, quindi mantieni fisso il seed per modificare il prompt e varia i seed per la selezione.

Perché le esecuzioni locali diventano lente o instabili?

L'affermazione di tempi inferiori al secondo è legata all'hardware H800; prima di considerare un rallentamento locale un problema del prompt, controlla VRAM, dtype, risoluzione, wrapper e compilazione.

>_Directory modelli AIReiter

Accesso API rapido ai modelli collegati a questa guida

Z-Image Turbo

Image

Text-to-image fotorealistico a costo ultra-basso con rendering nitido del testo in inglese e cinese.

AlibabaCrea API Key >

FLUX.2 Pro

Image

Generazione e modifica di immagini pronta per la produzione con dettaglio fotorealistico e fino a otto riferimenti.

Black Forest LabsCrea API Key >

Krea 2 Turbo

Image

Modello text-to-image ultra veloce che produce immagini ad alta fedeltà, cinematografiche, in pochi secondi.

kreaCrea API Key >

Nano Banana

Image

Ritratti leggeri e creativi

GoogleCrea API Key >

Nano Banana Pro

Image

Modello AI per immagini più veloce, intelligente e ad alta risoluzione

GoogleCrea API Key >

Post recenti

Recensione dell’API GPT-6 Astra (2026): pensata per gli agenti, non per il semplice drop-in

2026-09-07

Kling API: guida all'integrazione ufficiale e tramite aggregatori (2026)

2026-09-07

Chiave API Suno: come ottenerla e quanto costa (2026)

2026-09-07

Recensione di GPT-6 Astra: i prezzi API da $10/$50 valgono la spesa?

2026-09-06
AIREITER

Domande? Contattaci a
[email protected]

新速率有限公司NEWRATE LIMITED香港九龍花園街 2-16 號好景商業中心 2304 室Room 2304, Haojing Commercial Center, 2-16 Garden Street, Kowloon, Hong Kong

LLM

GPT-6 AstraGemini 3.8 FlashClaude Fable 5.1GLM-5.3 FlashGemini 3.6 Flash

Video IA

Gemini Omni 1.1 Flash ExtMiniMax H3Kling 3.0 Motion ControlKling 3.0 TurboKling 3.0

Immagine IA

Grok Imagine Image 2.0Midjourney V8.1Midjourney V7Z-Image TurboKrea 2 Turbo

Blog

Vedi Tutto →

Azienda

Informativa sulla privacyTermini di servizioPolitica di rimborso

© 2026 AIReiter. Tutti i diritti riservati.