Midjourney V8.1 只當了六週預設模型,就在 2026 年 7 月 24 日被 V8.2 取代。現在想用 V8.1,提示詞結尾必須明確加上 --v 8.1。這個模型最適合採用「主體優先、參數收尾」的寫法;唯一已知的取捨,是它為了美感稍微犧牲了提示詞遵循度,而這點可透過下方四步驟修正。
V8.1 現在為何一定要指定 --v 8.1
如今要手動選擇 Midjourney V8.1:每次提示詞末尾加上 --v 8.1,或依官方版本文件,在網頁版 Imagine 輸入列設定或 Discord 的 /settings 預先固定版本。若兩者都沒做,沒有指定版本的提示詞會直接以 V8.2 生成;Midjourney 對 V8.2 的描述是風格更大膽、也更有稜角。
Midjourney 官方版本文件確認的時間線如下:
| 日期 | 事件 |
|---|---|
| 2026 年 4 月 14 日 | V8.1 發布(alpha) |
| 2026 年 6 月 10 日 | V8.1 成為預設模型 |
| 2026 年 6 月 16 日 | Draft Mode 支援 V8.1(社群回報) |
| 2026 年 7 月 24 日 | V8.2 成為預設模型;V8.0 alpha 退役 |
根據官方預設模型公告,V8.1「更聰明、更連貫、更能遵循詳細提示詞,文字渲染能力也勝過以往」。HD 模式的圖像尺寸是 V7 的兩倍、解析度是四倍;SD 工作約 4 秒完成,HD 約 12 秒,標準工作速度約比早期版本快 4–5 倍。即使如此,仍有使用者刻意固定使用 V8.1;獨立的 8.1/8.2 指南也基於相同理由推薦它:Draft Mode、速度、含大量文字的圖片,以及已針對 V8.1 調校完成的工作流程。
V8.1 提示詞怎麼寫才穩
V8.1 的提示詞要穩定,關鍵是先放主體及其最重要的可見特徵,參數統一置於末尾,中間內容保持簡短、直接,而且只描述畫面看得見的事物。社群提示詞指南建議依這個順序安排:
主要主體,以及最重要的可見特徵。
與主體緊密相關的細節。
前景或動作。
背景或環境。
風格或媒材。
--ar 3:2 --v 8.1
同一份社群指南指出,提示詞越前面的字權重會稍高一些。因此,第一個名詞片語就該放你最希望 Midjourney 畫對的元素。語法也會實際影響構圖:A duck standing in a field 會把鴨子設定成主角;A field with a duck standing in it 則會把田野帶到主位。同樣的元素,結果卻會是不同的圖。
V8.1 有兩條同時成立的長度原則,而且都有資料佐證。blakecrosley.com 的V7 至 V8 變化分析發現,V8 系列比 V7 更能理解較長、較詳細的指令:原本 15 個字的 V7 提示詞,若新增的內容確實補足場景指示,擴充至 40 個字通常會更好。
但句子仍應保持短而具體。超過 1,024 個字元時,Prompt Shortener一定會啟動,以你無法控制的方式壓縮提示詞;現在它會顯示修改內容,因此別盲信結果,務必檢查。該網站的參數指南則將實務甜蜜點放在 50–150 tokens;再往上,效益會遞減,形容詞也可能開始彼此抵銷。
讓 V8.1 圖片正確出現文字
要生成文字,最好用雙引號搭配情境描述,例如霓虹招牌寫著 "OPEN 24/7"。V8 提示詞分析指出,單引號不會觸發相同的文字渲染行為。根據同一來源,2 到 4 個字的效果最穩,完整句子則容易劣化。一項 Reddit 的Mars 海報實測也發現,大型標題表現不錯,但較小的字體會開始失真:文字行可能偏移或損毀。需要可靠的內文時,建議後製加入。
V8.1 參數完整速查
V8.1 支援 --ar、--s、--raw、--sd/--hd、--chaos、--weird、--no、--iw、--seed、--sref 與 --exp;另一方面,也有幾個 V7 時代的習慣會被悄悄忽略或改道處理。以下整理各旗標與可用範圍:
| 參數 | 範圍/預設值 | V8.1 行為 |
|---|---|---|
--v 8.1 | - | 固定使用版本;V8.2 接手後為必要設定 |
--ar | SD 最高 14:1,HD 最高 4:1 | 16:9 與 21:9 均在兩種上限範圍內 |
--s(stylize) | 0–1000,預設 100 | 低於 100 時資源更偏向遵循提示詞;150–300 有明顯風格;500 以上高度風格化 |
--raw | 旗標 | 取代 V7 的 --style raw;解讀更直白,自動風格化較少 |
--sd / --hd | 每項工作 0.8 / 1.3 GPU-min | HD 原生輸出 2048px,無須升級解析度步驟 |
--chaos | 0–100,預設 0 | 數值越高,四張輸出圖之間的差異越大 |
--weird | 0–3000,預設 0 | 帶來愈來愈非典型的美學效果 |
--no | 清單 | 社群指南建議聚焦排除 3–5 項 |
--iw | 0–3,預設 1 | 依官方 Image Prompts 文件;純圖片提示詞不能使用 --s 或 --weird |
--seed | 任意整數 | 相同提示詞 + seed 約有 99% 相同,但不會完全一致(版本文件) |
--sref / moodboards | --sw 0–1000 | 社群筆記稱其在 V8.1 中「super stable」 |
--exp | 0–100,預設 0 | 建議使用 10–25;更高會壓過風格化效果 |
上述範圍、成本、解析度與相容性數據來自 Midjourney 版本文件;--no 的建議數量與 --exp 的建議區間,出自獨立參數指南;sref 穩定性的說法則來自V8.1 社群發布筆記。
有四個 V6/V7 時期的旗標在 V8.1 不能使用:--q(Quality 僅限 V7)、--cref/--cw(僅限 V6)、--niji(V8 沒有 Niji),以及 Turbo(V6/V7)。V8 介面雖接受 --oref 與 --ow,但工作會透過 V7 渲染,這也解釋了為何生成結果有時看起來不像 V8。官方相容性表將 Draft Mode 列為僅限 V7;不過獨立更新日誌中的 7 月 27 日報告提到,V8.1/V8.2 可在 Draft 中一次生成 24 張 512×512 圖片,成本為 0.4 GPU-minutes。在依賴這項功能前,請先在自己的 app 中確認。
V8.1 不聽提示詞時,照這四階梯調整
當 V8.1 漏掉你指定的細節,不必整段提示詞重寫,請按這個順序逐步加強:先修正第一個名詞片語,再降低風格化,接著使用 raw,最後才把勝出的結果以 HD 重跑。每一步都對應其已知失敗模式。相較於 V8.0 alpha,V8.1 為美感重新平衡了模型表現,代價是少量遵循度。
- 改寫第一個名詞片語。 越前面的字影響力略高;如果鏡頭一直聚焦錯誤主體,就讓你要的主體成為文法上的主詞。
- 把
--s降到 100 以下。 社群測試發現,降低風格化可讓模型少花資源追求美感,轉而更專注執行提示詞。 - 加入
--raw。 V8.1 社群筆記將 raw 描述為以更精簡的版本替換預設風格;它是寫實攝影、建築與需精準執行的商業 brief 的標準解法。 - 先用 SD 探索,再 Run as HD。 SD 品質已可比擬 V7 全品質,因此先快速篩選低成本網格,僅將鎖定 seed 的入選圖以 2048px 重跑。
V7 至 V8 變化分析還發現,直接用自然英文寫否定描述,有時比串接 --no 更有效。例如描述室內空間「with no visible windows」,對 V8.1 而言往往比堆疊多個排除旗標更清楚。另一方面,若提示詞持續被內容審核標記,提出這個問題的討論串得到相反的結論:別再加入告訴模型不要做什麼的指令,應該直接簡化提示詞。
一項把五組提示詞交給 V8.1、Nano Banana 2 與 Grok Imagine 實測比較的心得,很精準地概括了這種取捨:
「MidJourney V8.1 Alpha 更擅長做出 MidJourney 風格。」- u/lukmanfebrianto, r/midjourney
16:9 YouTube 縮圖:從提示詞到可上片成品
1280×720 的 YouTube 縮圖,對 V8.1 提示詞有三項核心要求:--ar 16:9、一個縮小到郵票尺寸仍清楚的單一主焦點,以及 2 到 4 個字、以引號標示的覆蓋文字。接下來才是生成成本的問題:先低成本探索,只升級一次。
- 從單一焦點主體開始寫提示詞,例如一張臉、一項產品或一件物品,末尾加上
--ar 16:9 --s 100 --v 8.1。 - 以雙引號加上情境方式描述覆蓋文字,例如一張海報寫著 "SEASON 2"。
- 用 SD 探索:每個網格成本為 0.8 GPU-minutes,約 4 秒完成。快速篩選、淘汰,保留 seed。
- 對勝出的圖使用 Run as HD。鎖定 seed 的提示詞會以原生 2048px 重渲染,足以覆蓋該 16:9 尺寸且仍保有充足裁切空間,成本為 1.3 GPU-minutes。
- 如果引號內文字偏移或過度風格化,將
--s降到 100 以下,或加入--raw,再用同一個 seed 重跑。
以一次縮圖循環計算,10 個 SD 探索網格加上 1 個 HD 成品,共計 9.3 GPU-minutes;若 11 項工作全部使用 HD,則為 14.3 GPU-minutes。若想比較哪個模型最適合這項工作,我們另做了縮圖模型實測。
六組可直接複製的 V8.1 提示詞範本
每組都是完整提示詞。替換主體名詞即可,結構與末尾參數請保留。
電影感劇照(21:9)
一名戴著焊接面罩的工程師,俯身檢查一台巨型機器人打開的胸腔。
外露的活塞與處理器,在藍橘色體積光下發亮。
空曠的工業機庫,火花在空中飄散。IMAX 科幻電影劇照。
--ar 21:9 --s 250 --v 8.1
時尚美妝肖像(4:5)
一名女性的極近距離肖像,帶有雀斑與清晰可見的毛孔。
黃金時刻窗光,淺景深,絲質高訂服裝的鎖骨細節。
未修圖的奢華雜誌編輯攝影。--ar 4:5 --s 200 --v 8.1
產品主視覺(1:1)
一瓶霧面玻璃精華液立在洞石台面上,玻璃表面帶有水珠。
左上方單一柔光箱,無縫暖灰色攝影棚背景。
商業保養品攝影。--ar 1:1 --s 75 --raw --v 8.1
美食主視覺(3:2)
一塊三分熟和牛肋眼牛排放在白色精緻餐盤上,搭配紅酒醬汁與微型香草。
燭光、升騰蒸氣,後方一只波爾多酒杯微微失焦。
米其林星級美食攝影。--ar 3:2 --s 150 --v 8.1
搭配圖片提示詞的風景(16:9)
[image URL] 日出時分的崎嶇澳洲海岸線,霧氣籠罩桉樹山谷,
長長的影子橫越懸崖步道。--ar 16:9 --iw 2 --s 150 --v 8.1
請先將參考圖片裁成 16:9。官方指引建議讓參考圖的長寬比與目標一致,而 --iw 2(範圍 0–3)會讓生成結果更偏向你的構圖。
YouTube 縮圖(16:9)
一名穿連帽上衣、睜大雙眼的實況主,對身後開啟的發光傳送門做出反應,
輪廓光勾勒的臉佔滿左側三分之一,右側一張海報寫著 "IT WORKS"。
--ar 16:9 --s 75 --v 8.1
先以 SD 生成,保留中意結果後再 Run as HD;覆蓋文字維持 2 或 3 個字最佳。
不在 Midjourney app 內也能跑 V8.1 提示詞
同一套縮圖工作流程也能透過 API 執行。當任務不是單張主視覺,而是一批圖片,例如一次更新頻道的 12 張縮圖,或替同一版型製作 A/B 變體時,這點尤其重要。AIReiter 的 Midjourney V8.1 工具頁採按圖使用,而非月費方案:可批次執行每次 0.8 GPU-minutes 的探索階段,再將勝出結果以 HD 重跑。
不同任務該選哪些 V8.1 設定
| 任務 | 版本 | 模式 | Stylize / raw |
|---|---|---|---|
| 主視覺、品牌級效果 | V8.2(預設) | HD | --s 300+,不使用 raw |
| 較收斂的 V8 視覺、既有調校流程 | --v 8.1 | HD | --s 100–300 |
| 需精準執行的商業 brief | --v 8.1 | SD -> HD | --s <100 + --raw |
| 帶覆蓋文字的縮圖 | --v 8.1 | SD -> Run as HD | --s 75,使用引號文字 |
| Anime / manga | --niji 7 | - | Niji 不在 V8 中 |
| 鎖定角色身份 | V7 + --oref | - | V8 工作仍會改由 V7 處理 |
若進行以美感為優先的 V8 工作,變化分析指出 Midjourney 建議搭配訓練完成的 Personalization profile,並使用 --stylize 1000;profile 約在 40 次評分後開始啟用,接近 200 次時趨於穩定,讓提示詞能專心描述主體、動作與場景。
FAQ
V8.2 已是預設模型,要怎麼強制 Midjourney 使用 V8.1?
在提示詞末尾加上 --v 8.1,或在網頁版 Imagine 輸入列設定、Discord 的 /settings 中,將 V8.1 設成持續使用的預設版本。
V8.1 的 --sd 和 --hd 有什麼差別?
SD 每項工作成本為 0.8 GPU-minutes,約 4 秒完成;HD 成本為 1.3 GPU-minutes,約需 12 秒,並直接輸出原生 2048px,不需要升級解析度步驟。依版本文件所述,對 HD 圖片使用 Pan、Zoom Out 或 Vary Region 編輯後,會降回 SD。
V8.1 提示詞中的字詞順序重要嗎?
有一點影響。越前面的字影響力略高,而句子的文法主詞通常會成為視覺焦點,因此請把最在意的元素放在第一個名詞片語。
什麼時候該在 V8.1 使用 --raw?
當預設風格對任務來說太過修飾時,就使用 --raw:例如寫實攝影、建築視覺化、編輯插畫,以及所有「精準遵循」比風格更重要的 brief。若是想探索並利用 V8.1 本身的美學,就不要開啟它。
--style raw 在 V8.1 還能用嗎?
不能。V7 的 --style raw 語法在 V8 系列中改為獨立旗標 --raw;兩者作用相同,都是減少 Midjourney 的自動風格化。
哪些參數無法在 V8.1 使用?
--q(Quality)、--cref/--cw、--niji 與 Turbo 都是 V6/V7 功能。--oref 和 --ow 雖然會被接受,但工作會透過 V7 而非 V8.1 渲染。