AIREITER

Midjourney V8.1 提示詞:參數、範本與 16:9 縮圖工作流程

最近更新: 2026-08-15 19:27:44

Midjourney V8.1 只當了六週預設模型,就在 2026 年 7 月 24 日被 V8.2 取代。現在想用 V8.1,提示詞結尾必須明確加上 --v 8.1。這個模型最適合採用「主體優先、參數收尾」的寫法;唯一已知的取捨,是它為了美感稍微犧牲了提示詞遵循度,而這點可透過下方四步驟修正。

V8.1 現在為何一定要指定 --v 8.1

如今要手動選擇 Midjourney V8.1:每次提示詞末尾加上 --v 8.1,或依官方版本文件,在網頁版 Imagine 輸入列設定或 Discord 的 /settings 預先固定版本。若兩者都沒做,沒有指定版本的提示詞會直接以 V8.2 生成;Midjourney 對 V8.2 的描述是風格更大膽、也更有稜角。

Midjourney 官方版本文件確認的時間線如下:

日期事件
2026 年 4 月 14 日V8.1 發布(alpha)
2026 年 6 月 10 日V8.1 成為預設模型
2026 年 6 月 16 日Draft Mode 支援 V8.1(社群回報)
2026 年 7 月 24 日V8.2 成為預設模型;V8.0 alpha 退役

根據官方預設模型公告,V8.1「更聰明、更連貫、更能遵循詳細提示詞,文字渲染能力也勝過以往」。HD 模式的圖像尺寸是 V7 的兩倍、解析度是四倍;SD 工作約 4 秒完成,HD 約 12 秒,標準工作速度約比早期版本快 4–5 倍。即使如此,仍有使用者刻意固定使用 V8.1;獨立的 8.1/8.2 指南也基於相同理由推薦它:Draft Mode、速度、含大量文字的圖片,以及已針對 V8.1 調校完成的工作流程。

V8.1 提示詞怎麼寫才穩

V8.1 的提示詞要穩定,關鍵是先放主體及其最重要的可見特徵,參數統一置於末尾,中間內容保持簡短、直接,而且只描述畫面看得見的事物。社群提示詞指南建議依這個順序安排:

主要主體,以及最重要的可見特徵。
與主體緊密相關的細節。
前景或動作。
背景或環境。
風格或媒材。
--ar 3:2 --v 8.1

同一份社群指南指出,提示詞越前面的字權重會稍高一些。因此,第一個名詞片語就該放你最希望 Midjourney 畫對的元素。語法也會實際影響構圖:A duck standing in a field 會把鴨子設定成主角;A field with a duck standing in it 則會把田野帶到主位。同樣的元素,結果卻會是不同的圖。

V8.1 有兩條同時成立的長度原則,而且都有資料佐證。blakecrosley.com 的V7 至 V8 變化分析發現,V8 系列比 V7 更能理解較長、較詳細的指令:原本 15 個字的 V7 提示詞,若新增的內容確實補足場景指示,擴充至 40 個字通常會更好。

但句子仍應保持短而具體。超過 1,024 個字元時,Prompt Shortener一定會啟動,以你無法控制的方式壓縮提示詞;現在它會顯示修改內容,因此別盲信結果,務必檢查。該網站的參數指南則將實務甜蜜點放在 50–150 tokens;再往上,效益會遞減,形容詞也可能開始彼此抵銷。

讓 V8.1 圖片正確出現文字

要生成文字,最好用雙引號搭配情境描述,例如霓虹招牌寫著 "OPEN 24/7"。V8 提示詞分析指出,單引號不會觸發相同的文字渲染行為。根據同一來源,2 到 4 個字的效果最穩,完整句子則容易劣化。一項 Reddit 的Mars 海報實測也發現,大型標題表現不錯,但較小的字體會開始失真:文字行可能偏移或損毀。需要可靠的內文時,建議後製加入。

V8.1 參數完整速查

V8.1 支援 --ar、--s、--raw、--sd/--hd、--chaos、--weird、--no、--iw、--seed、--sref 與 --exp;另一方面,也有幾個 V7 時代的習慣會被悄悄忽略或改道處理。以下整理各旗標與可用範圍:

參數範圍/預設值V8.1 行為
--v 8.1-固定使用版本;V8.2 接手後為必要設定
--arSD 最高 14:1,HD 最高 4:116:9 與 21:9 均在兩種上限範圍內
--s(stylize)0–1000,預設 100低於 100 時資源更偏向遵循提示詞;150–300 有明顯風格;500 以上高度風格化
--raw旗標取代 V7 的 --style raw;解讀更直白,自動風格化較少
--sd / --hd每項工作 0.8 / 1.3 GPU-minHD 原生輸出 2048px,無須升級解析度步驟
--chaos0–100,預設 0數值越高,四張輸出圖之間的差異越大
--weird0–3000,預設 0帶來愈來愈非典型的美學效果
--no清單社群指南建議聚焦排除 3–5 項
--iw0–3,預設 1依官方 Image Prompts 文件;純圖片提示詞不能使用 --s 或 --weird
--seed任意整數相同提示詞 + seed 約有 99% 相同,但不會完全一致(版本文件)
--sref / moodboards--sw 0–1000社群筆記稱其在 V8.1 中「super stable」
--exp0–100,預設 0建議使用 10–25;更高會壓過風格化效果

上述範圍、成本、解析度與相容性數據來自 Midjourney 版本文件;--no 的建議數量與 --exp 的建議區間,出自獨立參數指南;sref 穩定性的說法則來自V8.1 社群發布筆記。

有四個 V6/V7 時期的旗標在 V8.1 不能使用:--q(Quality 僅限 V7)、--cref/--cw(僅限 V6)、--niji(V8 沒有 Niji),以及 Turbo(V6/V7)。V8 介面雖接受 --oref 與 --ow,但工作會透過 V7 渲染,這也解釋了為何生成結果有時看起來不像 V8。官方相容性表將 Draft Mode 列為僅限 V7;不過獨立更新日誌中的 7 月 27 日報告提到,V8.1/V8.2 可在 Draft 中一次生成 24 張 512×512 圖片,成本為 0.4 GPU-minutes。在依賴這項功能前,請先在自己的 app 中確認。

V8.1 不聽提示詞時,照這四階梯調整

當 V8.1 漏掉你指定的細節,不必整段提示詞重寫,請按這個順序逐步加強:先修正第一個名詞片語,再降低風格化,接著使用 raw,最後才把勝出的結果以 HD 重跑。每一步都對應其已知失敗模式。相較於 V8.0 alpha,V8.1 為美感重新平衡了模型表現,代價是少量遵循度。

  1. 改寫第一個名詞片語。 越前面的字影響力略高;如果鏡頭一直聚焦錯誤主體,就讓你要的主體成為文法上的主詞。
  2. 把 --s 降到 100 以下。 社群測試發現,降低風格化可讓模型少花資源追求美感,轉而更專注執行提示詞。
  3. 加入 --raw。 V8.1 社群筆記將 raw 描述為以更精簡的版本替換預設風格;它是寫實攝影、建築與需精準執行的商業 brief 的標準解法。
  4. 先用 SD 探索,再 Run as HD。 SD 品質已可比擬 V7 全品質,因此先快速篩選低成本網格,僅將鎖定 seed 的入選圖以 2048px 重跑。

V7 至 V8 變化分析還發現,直接用自然英文寫否定描述,有時比串接 --no 更有效。例如描述室內空間「with no visible windows」,對 V8.1 而言往往比堆疊多個排除旗標更清楚。另一方面,若提示詞持續被內容審核標記,提出這個問題的討論串得到相反的結論:別再加入告訴模型不要做什麼的指令,應該直接簡化提示詞。

一項把五組提示詞交給 V8.1、Nano Banana 2 與 Grok Imagine 實測比較的心得,很精準地概括了這種取捨:

「MidJourney V8.1 Alpha 更擅長做出 MidJourney 風格。」- u/lukmanfebrianto, r/midjourney

16:9 YouTube 縮圖:從提示詞到可上片成品

1280×720 的 YouTube 縮圖,對 V8.1 提示詞有三項核心要求:--ar 16:9、一個縮小到郵票尺寸仍清楚的單一主焦點,以及 2 到 4 個字、以引號標示的覆蓋文字。接下來才是生成成本的問題:先低成本探索,只升級一次。

  1. 從單一焦點主體開始寫提示詞,例如一張臉、一項產品或一件物品,末尾加上 --ar 16:9 --s 100 --v 8.1。
  2. 以雙引號加上情境方式描述覆蓋文字,例如一張海報寫著 "SEASON 2"。
  3. 用 SD 探索:每個網格成本為 0.8 GPU-minutes,約 4 秒完成。快速篩選、淘汰,保留 seed。
  4. 對勝出的圖使用 Run as HD。鎖定 seed 的提示詞會以原生 2048px 重渲染,足以覆蓋該 16:9 尺寸且仍保有充足裁切空間,成本為 1.3 GPU-minutes。
  5. 如果引號內文字偏移或過度風格化,將 --s 降到 100 以下,或加入 --raw,再用同一個 seed 重跑。
Midjourney V8.1 SD 與 HD 工作成本及速度

以一次縮圖循環計算,10 個 SD 探索網格加上 1 個 HD 成品,共計 9.3 GPU-minutes;若 11 項工作全部使用 HD,則為 14.3 GPU-minutes。若想比較哪個模型最適合這項工作,我們另做了縮圖模型實測。

六組可直接複製的 V8.1 提示詞範本

每組都是完整提示詞。替換主體名詞即可,結構與末尾參數請保留。

電影感劇照(21:9)

一名戴著焊接面罩的工程師,俯身檢查一台巨型機器人打開的胸腔。
外露的活塞與處理器,在藍橘色體積光下發亮。
空曠的工業機庫,火花在空中飄散。IMAX 科幻電影劇照。
--ar 21:9 --s 250 --v 8.1

時尚美妝肖像(4:5)

一名女性的極近距離肖像,帶有雀斑與清晰可見的毛孔。
黃金時刻窗光,淺景深,絲質高訂服裝的鎖骨細節。
未修圖的奢華雜誌編輯攝影。--ar 4:5 --s 200 --v 8.1

產品主視覺(1:1)

一瓶霧面玻璃精華液立在洞石台面上,玻璃表面帶有水珠。
左上方單一柔光箱,無縫暖灰色攝影棚背景。
商業保養品攝影。--ar 1:1 --s 75 --raw --v 8.1

美食主視覺(3:2)

一塊三分熟和牛肋眼牛排放在白色精緻餐盤上,搭配紅酒醬汁與微型香草。
燭光、升騰蒸氣,後方一只波爾多酒杯微微失焦。
米其林星級美食攝影。--ar 3:2 --s 150 --v 8.1

搭配圖片提示詞的風景(16:9)

[image URL] 日出時分的崎嶇澳洲海岸線,霧氣籠罩桉樹山谷,
長長的影子橫越懸崖步道。--ar 16:9 --iw 2 --s 150 --v 8.1

請先將參考圖片裁成 16:9。官方指引建議讓參考圖的長寬比與目標一致,而 --iw 2(範圍 0–3)會讓生成結果更偏向你的構圖。

YouTube 縮圖(16:9)

一名穿連帽上衣、睜大雙眼的實況主,對身後開啟的發光傳送門做出反應,
輪廓光勾勒的臉佔滿左側三分之一,右側一張海報寫著 "IT WORKS"。
--ar 16:9 --s 75 --v 8.1

先以 SD 生成,保留中意結果後再 Run as HD;覆蓋文字維持 2 或 3 個字最佳。

不在 Midjourney app 內也能跑 V8.1 提示詞

同一套縮圖工作流程也能透過 API 執行。當任務不是單張主視覺,而是一批圖片,例如一次更新頻道的 12 張縮圖,或替同一版型製作 A/B 變體時,這點尤其重要。AIReiter 的 Midjourney V8.1 工具頁採按圖使用,而非月費方案:可批次執行每次 0.8 GPU-minutes 的探索階段,再將勝出結果以 HD 重跑。

Midjourney V8.1 工具頁面

不同任務該選哪些 V8.1 設定

任務版本模式Stylize / raw
主視覺、品牌級效果V8.2(預設)HD--s 300+,不使用 raw
較收斂的 V8 視覺、既有調校流程--v 8.1HD--s 100–300
需精準執行的商業 brief--v 8.1SD -> HD--s <100 + --raw
帶覆蓋文字的縮圖--v 8.1SD -> Run as HD--s 75,使用引號文字
Anime / manga--niji 7-Niji 不在 V8 中
鎖定角色身份V7 + --oref-V8 工作仍會改由 V7 處理

若進行以美感為優先的 V8 工作,變化分析指出 Midjourney 建議搭配訓練完成的 Personalization profile,並使用 --stylize 1000;profile 約在 40 次評分後開始啟用,接近 200 次時趨於穩定,讓提示詞能專心描述主體、動作與場景。

FAQ

V8.2 已是預設模型,要怎麼強制 Midjourney 使用 V8.1?

在提示詞末尾加上 --v 8.1,或在網頁版 Imagine 輸入列設定、Discord 的 /settings 中,將 V8.1 設成持續使用的預設版本。

V8.1 的 --sd 和 --hd 有什麼差別?

SD 每項工作成本為 0.8 GPU-minutes,約 4 秒完成;HD 成本為 1.3 GPU-minutes,約需 12 秒,並直接輸出原生 2048px,不需要升級解析度步驟。依版本文件所述,對 HD 圖片使用 Pan、Zoom Out 或 Vary Region 編輯後,會降回 SD。

V8.1 提示詞中的字詞順序重要嗎?

有一點影響。越前面的字影響力略高,而句子的文法主詞通常會成為視覺焦點,因此請把最在意的元素放在第一個名詞片語。

什麼時候該在 V8.1 使用 --raw?

當預設風格對任務來說太過修飾時,就使用 --raw:例如寫實攝影、建築視覺化、編輯插畫,以及所有「精準遵循」比風格更重要的 brief。若是想探索並利用 V8.1 本身的美學,就不要開啟它。

--style raw 在 V8.1 還能用嗎?

不能。V7 的 --style raw 語法在 V8 系列中改為獨立旗標 --raw;兩者作用相同,都是減少 Midjourney 的自動風格化。

哪些參數無法在 V8.1 使用?

--q(Quality)、--cref/--cw、--niji 與 Turbo 都是 V6/V7 功能。--oref 和 --ow 雖然會被接受,但工作會透過 V7 而非 V8.1 渲染。

延伸閱讀:最適合 YouTube 縮圖的 AI 模型(實測) · Nano Banana Pro 提示詞指南