V8.1 è rimasto il modello predefinito di Midjourney per appena sei settimane: il 24 luglio 2026 è stato sostituito da V8.2. Oggi, quindi, ogni prompt per Midjourney V8.1 deve terminare esplicitamente con --v 8.1. Il modello dà il meglio con un soggetto indicato subito e una coda di parametri essenziale. Il suo limite documentato è un compromesso tra fedeltà al prompt ed estetica: può privilegiare l'aspetto visivo rispetto all'aderenza alle istruzioni. Più avanti trovi un metodo in quattro passaggi per correggere il problema.
Per usare V8.1 ora devi indicare la versione
Midjourney V8.1 va selezionato manualmente. Puoi aggiungere --v 8.1 a ogni prompt oppure impostare una volta la versione nelle impostazioni della barra Imagine sul web o in Discord con /settings, come indicato nella documentazione ufficiale sulle versioni. In assenza di una di queste impostazioni, un prompt senza parametri viene generato silenziosamente in V8.2, che la documentazione di Midjourney descrive come più audace e grintosa.
Questa è la cronologia, confermata dalla documentazione di Midjourney:
| Data | Evento |
|---|---|
| 14 apr 2026 | Rilascio di V8.1 (alpha) |
| 10 giu 2026 | V8.1 diventa il modello predefinito |
| 16 giu 2026 | Draft Mode arriva in V8.1 (segnalato dalla community) |
| 24 lug 2026 | V8.2 diventa il modello predefinito; V8.0 alpha viene ritirato |
Secondo l'annuncio ufficiale del modello predefinito, V8.1 è "più intelligente, più coerente, segue meglio i prompt dettagliati e genera testo meglio che mai". La modalità HD produce immagini grandi il doppio e con una risoluzione quattro volte superiore a V7; i job arrivano in circa 4 secondi in SD e 12 secondi in HD, mentre i job standard sono circa 4–5 volte più rapidi delle versioni precedenti. Molti utenti continuano comunque a fissare deliberatamente V8.1, e la guida indipendente su 8.1/8.2 la consiglia proprio per questo: Draft Mode, velocità, immagini ricche di testo e pipeline già ottimizzate su questo modello.
La struttura di un prompt efficace per Midjourney V8.1
Un prompt V8.1 funziona meglio quando il soggetto principale e le sue caratteristiche visive più importanti arrivano per primi, i parametri stanno in fondo e tutto ciò che si trova in mezzo è breve, diretto e visibile. La guida della community sul prompting propone quest'ordine:
Soggetto principale con le sue caratteristiche visive più importanti.
Dettagli strettamente legati al soggetto.
Primo piano o azione.
Sfondo o ambiente.
Stile o tecnica.
--ar 3:2 --v 8.1
Come spiega la stessa guida della community, le parole iniziali hanno un peso leggermente maggiore. La prima frase nominale dovrebbe quindi identificare l'elemento che Midjourney deve rendere correttamente a tutti i costi. Anche la grammatica incide sull'immagine: "Un'anatra in piedi in un campo" mette l'anatra al centro, mentre "Un campo con un'anatra in piedi al suo interno" rende il campo il soggetto visivo. Gli elementi non cambiano, ma cambia il risultato.
Con V8.1 convivono due regole sulla lunghezza, entrambe documentate. L'analisi del passaggio da V7 a V8 di blakecrosley.com rileva che i modelli della generazione V8 seguono istruzioni lunghe e dettagliate meglio di V7: un prompt V7 da 15 parole può spesso migliorare arrivando a 40 parole, purché le parole aggiunte diano indicazioni concrete sulla scena.
Le frasi, però, devono restare brevi e specifiche. Il Prompt Shortener entra inevitabilmente in funzione oltre 1.024 caratteri e comprime il prompt con criteri che non hai scelto; ora mostra anche le modifiche effettuate, quindi vale la pena controllare l'output invece di fidarsi alla cieca. La guida ai parametri dello stesso sito colloca il punto ideale tra 50 e 150 token: oltre questa soglia, i benefici si riducono e i descrittori iniziano a ostacolarsi a vicenda.
Come inserire testo in un'immagine V8.1
Il testo viene generato meglio tra virgolette doppie e in un contesto esplicito, per esempio un'insegna al neon con la scritta "OPEN 24/7". L'analisi sul prompting in V8 segnala che le virgolette singole non attivano lo stesso comportamento di rendering del testo. Secondo la stessa fonte, da due a quattro parole vengono riprodotte con buona costanza, mentre le frasi complete peggiorano. Un test pratico su un poster di Marte su Reddit ha rilevato che il titolo grande funzionava, mentre la tipografia più piccola degradava: le righe si spostavano o si corrompevano. Per un testo di corpo affidabile, meglio intervenire in post-produzione.
Parametri supportati da V8.1: guida rapida
V8.1 accetta --ar, --s, --raw, --sd/--hd, --chaos, --weird, --no, --iw, --seed, --sref e --exp; diverse abitudini dell'era V7 vengono invece ignorate o reindirizzate senza avvisi. Ecco intervalli e comportamento di ciascun flag:
| Parametro | Intervallo / predefinito | Comportamento in V8.1 |
|---|---|---|
--v 8.1 | - | Fissa la versione; necessario da quando V8.2 è diventato il modello predefinito |
--ar | Fino a 14:1 in SD, massimo 4:1 in HD | 16:9 e 21:9 rientrano in entrambi i limiti |
--s (stylize) | 0–1000, predefinito 100 | Sotto 100 privilegia l'aderenza; 150–300 applica uno stile percepibile; 500+ è fortemente stilizzato |
--raw | Flag | Sostituisce --style raw di V7; interpretazione letterale e meno stilizzazione automatica |
--sd / --hd | 0.8 / 1.3 GPU-min per job | HD produce 2048px nativi senza passaggio di upscale |
--chaos | 0–100, predefinito 0 | Valori più alti aumentano la variazione tra i quattro output |
--weird | 0–3000, predefinito 0 | Estetiche via via più anticonvenzionali |
--no | Elenco | Le guide della community consigliano 3–5 esclusioni mirate |
--iw | 0–3, predefinito 1 | Secondo la documentazione ufficiale sugli Image Prompts; i prompt composti solo da immagini non possono usare --s né --weird |
--seed | Qualsiasi intero | Stesso prompt + seed ≈ 99% identico, non esatto (documentazione sulle versioni) |
--sref / moodboard | --sw 0–1000 | Nelle note della community, V8.1 viene definito "super stabile" |
--exp | 0–100, predefinito 0 | Consigliato tra 10 e 25; valori più alti sovrastano la stilizzazione |
Intervalli, costi, risoluzioni e dati sulla compatibilità riportati sopra provengono dalla documentazione di Midjourney sulle versioni. Il numero di esclusioni per --no e l'intervallo per --exp sono raccomandazioni della guida indipendente ai parametri, mentre l'osservazione sulla stabilità di sref arriva dalle note di rilascio della community per V8.1.
Quattro flag delle generazioni V6/V7 non funzionano in V8.1: --q (Quality è solo V7), --cref/--cw (solo V6), --niji (V8 non include Niji) e Turbo (V6/V7). --oref e --ow sono accettati dall'interfaccia V8, ma il job viene renderizzato con V7: ecco perché una generazione può sembrare estranea a V8. Nel grafico ufficiale di compatibilità, Draft Mode risulta disponibile solo per V7, anche se un report del 27 luglio registrato in un changelog indipendente descrive esecuzioni Draft in V8.1/V8.2 di 24 immagini a 512×512 per 0.4 GPU-minuti; verifica nella tua app prima di farci affidamento.
Se V8.1 ignora un dettaglio: la scala per recuperare aderenza
Quando V8.1 tralascia un dettaglio presente nel prompt, non riscrivere tutto da capo. Procedi in questo ordine: correggi la prima frase nominale, riduci la stilizzazione, passa a raw, quindi rigenera in HD il risultato migliore. Ogni passaggio agisce su una specifica modalità di errore documentata. Rispetto all'alpha V8.0, V8.1 è stato ribilanciato verso l'estetica, con un lieve costo in termini di aderenza.
- Riscrivi la prima frase nominale. Le prime parole hanno un'influenza leggermente superiore: se la camera mette a fuoco il soggetto sbagliato, fai del soggetto desiderato il soggetto grammaticale della frase.
- Porta
--ssotto 100. I test della community hanno rilevato che una stilizzazione inferiore può spostare le risorse del modello dalla bellezza formale al rispetto del prompt. - Aggiungi
--raw. Le note della community per V8.1 descrivono raw come la sostituzione dello stile predefinito con una versione più essenziale: è la correzione standard per fotorealismo, architettura e brief commerciali letterali. - Esplora in SD, poi usa Run as HD. La qualità SD è già paragonabile alla qualità piena di V7, quindi esamina le griglie economiche e rigenera a 2048px soltanto il risultato selezionato con seed bloccato.
L'analisi del passaggio da V7 a V8 ha inoltre rilevato che le negazioni in inglese semplice a volte funzionano meglio delle catene di --no: descrivere un interno "with no visible windows" viene interpretato da V8.1 in modo più pulito rispetto a una serie di flag di esclusione. Quando invece un prompt viene ripetutamente bloccato dalla moderazione, il thread che ha fatto emergere il problema è arrivato alla conclusione opposta: semplificare il prompt, anziché aggiungere istruzioni su ciò che il modello non deve fare.
Un confronto pratico che ha sottoposto cinque prompt a V8.1, Nano Banana 2 e Grok Imagine riassume bene questo compromesso:
"MidJourney V8.1 Alpha is better at being MidJourney." - u/lukmanfebrianto, r/midjourney
Workflow per thumbnail 16:9: dal prompt a YouTube
Per una thumbnail YouTube a 1280×720, un prompt V8.1 deve fornire tre elementi: --ar 16:9, un singolo soggetto focale dominante che resti leggibile anche in formato francobollo e un testo in sovrimpressione di due-quattro parole tra virgolette. Da lì, conta l'economia della generazione: esplora a basso costo, fai upscale una sola volta.
- Costruisci il prompt attorno a un unico elemento focale, come un volto, un prodotto o un oggetto, mettilo all'inizio e chiudi con
--ar 16:9 --s 100 --v 8.1. - Inserisci il testo in sovrimpressione tra virgolette doppie e con una formulazione contestuale: un poster con la scritta "SEASON 2".
- Esplora in SD: ogni griglia costa 0.8 GPU-minuti e arriva in circa 4 secondi. Esamina, scarta e conserva i seed migliori.
- Rigenera il risultato vincente con Run as HD. Il prompt con seed bloccato viene renderizzato di nuovo a 2048px nativi, più che sufficienti per quel formato 16:9, al costo di 1.3 GPU-minuti.
- Se il testo tra virgolette si è spostato o è diventato troppo stilizzato, porta
--ssotto 100 oppure aggiungi--raw, quindi rigenera con lo stesso seed.
Il calcolo per un ciclo completo di thumbnail, con dieci griglie esplorative SD e un finale HD, è di 9.3 GPU-minuti. Se tutti gli undici job fossero in HD, si arriverebbe invece a 14.3 GPU-minuti. Per un confronto più ampio sui modelli migliori per questa attività specifica, abbiamo realizzato un test dedicato ai modelli per thumbnail.
Sei prompt V8.1 pronti da copiare
Ogni ricetta è una stringa di prompt completa. Sostituisci i nomi dei soggetti, ma conserva struttura e coda di parametri.
Fotogramma cinematografico (21:9)
An engineer in a welding mask leans into the open chest of a colossal robot.
Exposed pistons and processors glow under blue-orange volumetric light.
Empty industrial hangar, drifting sparks. IMAX science-fiction film still.
--ar 21:9 --s 250 --v 8.1
Ritratto beauty editoriale (4:5)
Extreme close-up portrait of a woman with freckles and visible pores.
Golden-hour window light, shallow depth of field, silk couture collarbone detail.
Unretouched luxury-magazine editorial photograph. --ar 4:5 --s 200 --v 8.1
Hero shot di prodotto (1:1)
A frosted-glass serum bottle stands on a travertine ledge, water droplets on glass.
Single softbox from upper left, seamless warm-gray studio background.
Commercial skincare photography. --ar 1:1 --s 75 --raw --v 8.1
Hero shot food (3:2)
A medium-rare wagyu ribeye on a white fine-dining plate, red-wine jus and microgreens.
Candlelight, rising steam, Bordeaux glass slightly out of focus behind.
Michelin-star food photography. --ar 3:2 --s 150 --v 8.1
Paesaggio con image prompt (16:9)
[image URL] Rugged Australian coastline at sunrise, mist over eucalyptus valleys,
long shadows across the cliff trail. --ar 16:9 --iw 2 --s 150 --v 8.1
Ritaglia prima l'immagine di riferimento in 16:9. La guida ufficiale raccomanda di far corrispondere il rapporto d'aspetto del riferimento a quello di destinazione; --iw 2 (intervallo 0–3) orienta maggiormente il rendering verso la tua composizione.
Thumbnail YouTube (16:9)
A wide-eyed streamer in a hoodie reacts to a glowing portal opening behind her,
rim-lit face filling the left third, a poster reading "IT WORKS" on the right.
--ar 16:9 --s 75 --v 8.1
Eseguilo in SD, poi usa Run as HD sul risultato scelto; mantieni il testo in sovrimpressione su due o tre parole.
Usare i prompt V8.1 fuori dall'app Midjourney
Lo stesso workflow per thumbnail può funzionare anche tramite un percorso API. È utile quando non devi creare una sola hero image, ma gestire un batch, come il rinnovo di 12 thumbnail di un canale o varianti A/B di un layout. La pagina dello strumento Midjourney V8.1 di AIReiter offre V8.1 a consumo per immagine invece di un piano mensile: esegui in batch le esplorazioni da 0.8 GPU-minuti e rigenera i risultati migliori in HD.
Le impostazioni V8.1 giuste per ogni lavoro
| Attività | Versione | Modalità | Stylize / raw |
|---|---|---|---|
| Hero image, visual di forte impatto per il brand | V8.2 (predefinito) | HD | --s 300+, senza raw |
| Look V8 più sobrio, pipeline ottimizzate | --v 8.1 | HD | --s 100–300 |
| Brief commerciali letterali | --v 8.1 | SD -> HD | --s <100 + --raw |
| Thumbnail con testo in sovrimpressione | --v 8.1 | SD -> Run as HD | --s 75, testo tra virgolette |
| Anime / manga | --niji 7 | - | Niji non è presente in V8 |
| Blocco dell'identità di un personaggio | V7 + --oref | - | I job V8 vengono comunque instradati a V7 |
Per i lavori V8 in cui l'estetica viene prima di tutto, l'analisi dei cambiamenti riporta che Midjourney consiglia un profilo Personalization addestrato con --stylize 1000. I profili si attivano intorno a 40 valutazioni e si stabilizzano vicino a 200, lasciando al prompt il compito di definire soggetto, azione e ambientazione.
FAQ
Come obbligo Midjourney a usare V8.1 ora che V8.2 è il modello predefinito?
Aggiungi --v 8.1 al prompt oppure imposta V8.1 come predefinito persistente nelle impostazioni della barra Imagine sul web o in Discord con /settings.
Che differenza c'è tra --sd e --hd in V8.1?
SD costa 0.8 GPU-minuti per job e arriva in circa 4 secondi; HD costa 1.3 GPU-minuti, richiede circa 12 secondi e produce 2048px nativi senza passaggio di upscale. La modifica di un'immagine HD con Pan, Zoom Out o Vary Region la riporta in SD, secondo la documentazione sulle versioni.
L'ordine delle parole conta nei prompt V8.1?
In parte sì. Le parole iniziali esercitano un'influenza leggermente maggiore e il soggetto grammaticale della frase tende a diventare il focus visivo. Metti quindi nella prima frase nominale l'elemento che ti interessa di più.
Quando conviene usare --raw in V8.1?
Usa --raw quando l'aspetto predefinito è troppo elaborato per il lavoro: fotorealismo, visualizzazione architettonica, illustrazione editoriale e qualsiasi brief in cui l'aderenza letterale conta più dello stile. Lascialo disattivato nell'esplorazione, quando vuoi sfruttare l'estetica di V8.1.
--style raw è ancora valido in V8.1?
No. La sintassi V7 --style raw è diventata il flag autonomo --raw nella famiglia V8; entrambi servono allo stesso scopo, ridurre la stilizzazione automatica di Midjourney.
Quali parametri non funzionano con V8.1?
--q (Quality), --cref/--cw, --niji e Turbo sono funzioni di V6/V7. --oref e --ow vengono accettati, ma renderizzano il job tramite V7 anziché V8.1.
Approfondimenti correlati: Best AI model for YouTube thumbnails (tested) · Nano Banana Pro prompts guide