AIREITER

Midjourney V8.1 提示词:参数、配方与 16:9 缩略图

最后更新: 2026-08-15 19:25:30

Midjourney V8.1 只做了六周默认模型,就在 2026 年 7 月 24 日被 V8.2 取代。如今想继续用 V8.1,每条提示词末尾都要明确加上 --v 8.1。这个模型尤其适合把主体放在开头、参数集中放在末尾的写法;它已知的短板是会为了画面美感牺牲部分提示词遵循度,下面会给出一套四步修复方法。

V8.1 为什么必须手动指定版本

现在使用 Midjourney V8.1,需要在每条提示词后附加 --v 8.1;也可以按照官方版本文档,在网页端 Imagine 栏设置或 Discord 的 /settings 中一次性指定版本。否则,未带版本参数的普通提示词会在后台直接以 V8.2 渲染;Midjourney 官方将其描述为更大胆、更锐利的版本。

根据 Midjourney 官方版本文档确认的时间线:

日期事件
2026 年 4 月 14 日V8.1 发布(alpha)
2026 年 6 月 10 日V8.1 成为默认模型
2026 年 6 月 16 日Draft Mode 支持 V8.1(社区报告)
2026 年 7 月 24 日V8.2 成为默认版本;V8.0 alpha 退役

根据官方默认模型公告,V8.1“更智能、更连贯、更能遵循详细提示词,文字渲染也达到了前所未有的水平”。HD 模式的图像尺寸是 V7 的两倍、分辨率是四倍;SD 任务约 4 秒出图,HD 约 12 秒,标准任务的速度约为早期版本的 4–5 倍。即便如此,许多用户仍会主动锁定 V8.1;独立的 8.1/8.2 指南给出的理由也很明确:Draft Mode、速度、文字较多的图像,以及已经针对它调优的既有工作流。

V8.1 提示词的实用结构

V8.1 的提示词要稳,关键是把主体及其最重要的可见特征放在最前面,参数统一收在末尾,中间描述保持简短、直接,并且只写画面中能看到的内容。社区提示词指南建议按以下顺序组织:

Main subject with its most important visible traits.
Closely attached subject details.
Foreground or action.
Background or environment.
Style or medium.
--ar 3:2 --v 8.1

同一份社区指南指出,提示词越靠前的内容权重会略高。因此,第一个名词短语应该是你最希望 Midjourney 画对的元素。语法在这里确实会影响构图:A duck standing in a field 会将鸭子设为主体;A field with a duck standing in it 则会让田野成为主体。元素一样,结果却可能完全不同。

V8.1 对提示词长度有两条看似并存、实则不冲突的规则。blakecrosley.com 的V7 到 V8 变化分析发现,V8 系列比 V7 更能理解具体且较长的指令:一条 15 词的 V7 提示词,如果额外增加的内容确实在交代场景,扩展到 40 词往往会更好。

不过,句子本身仍应简短而具体。提示词超过 1,024 个字符时,Prompt Shortener 会不可避免地启动,按自己的方式压缩提示词;现在它会显示修改内容,因此不要盲信结果,务必检查。该站的参数指南认为,50–150 token 是较实用的甜点区间;再往上收益会递减,不同描述词也开始彼此抵消。

让 V8.1 在图中正确生成文字

文字最好放在双引号内,并通过具体语境来描述,例如“a neon sign saying "OPEN 24/7"”。V8 提示词分析指出,单引号不会触发同样的文字渲染行为。同一来源认为,2 到 4 个词通常能稳定生成,完整句子的效果则会下降。一项 Reddit 的火星海报实测也得出了类似结论:大标题表现不错,但较小的排版容易失真,文字可能偏移或损坏。需要可靠正文文案时,还是建议后期补字。

V8.1 参数速查表

V8.1 支持 --ar、--s、--raw、--sd/--hd、--chaos、--weird、--no、--iw、--seed、--sref 和 --exp;部分沿用自 V7 的习惯用法则会被静默忽略或转送到其他版本。下表列出各参数的范围与行为:

参数范围 / 默认值V8.1 中的行为
--v 8.1-锁定版本;V8.2 接管默认版本后必须使用
--arSD 最高 14:1,HD 最高 4:116:9 和 21:9 均未超出任一上限
--s(stylize)0–1000,默认 100低于 100 会把更多资源转向遵循提示词;150–300 有明显风格化;500+ 则高度风格化
--raw开关参数取代 V7 的 --style raw;更直译提示词,减少自动风格化
--sd / --hd每任务 0.8 / 1.3 GPU 分钟HD 直接输出原生 2048px,无需额外放大步骤
--chaos0–100,默认 0数值越高,四张输出图之间的差异越大
--weird0–3000,默认 0数值越高,美学效果越非传统
--no列表社区指南建议聚焦于 3–5 项排除内容
--iw0–3,默认 1依据官方 Image Prompts 文档;纯图片提示词不能使用 --s 或 --weird
--seed任意整数相同提示词 + seed 的结果约有 99% 相似,但并非完全一致(版本文档)
--sref / moodboards--sw 0–1000社区说明称其在 V8.1 中“super stable”
--exp0–100,默认 0建议使用 10–25;更高数值会压过风格化效果

上表中的范围、成本、分辨率和兼容性数据均来自 Midjourney 的 Version 文档;--no 的数量及 --exp 的建议区间来自独立参数指南,而 sref 稳定性的说明则来自 V8.1 社区发布说明。

有四个 V6/V7 时代的参数在 V8.1 中不可用:--q(Quality,仅限 V7)、--cref/--cw(仅限 V6)、--niji(V8 没有 Niji)以及 Turbo(V6/V7)。--oref 与 --ow 可以被 V8 界面接受,但任务会通过 V7 渲染,因此生成结果有时看起来不像 V8。官方兼容性表将 Draft Mode 标为仅支持 V7,但独立更新日志中一份 7 月 27 日的报告记录了 V8.1/V8.2 的 Draft 运行:24 张 512×512 图像消耗 0.4 GPU 分钟。在依赖该功能前,请先在自己的应用中确认。

V8.1 不听提示词时:按这四步排查

V8.1 漏掉你写明的细节时,不必马上推倒重写。按以下顺序逐步加码:先调整第一个名词短语,再降低风格化,接着启用 raw,最后将胜出的结果以 HD 重跑。每一步都对应一种已知问题。与 V8.0 alpha 相比,V8.1 为美感重新做了平衡,代价是提示词遵循度略有下降。

  1. 先改第一个名词短语。 开头的词有略高影响力;若镜头聚焦错了对象,就让你想要的主体成为句子的语法主语。
  2. 把 --s 降到 100 以下。 社区测试发现,降低风格化可以让模型少花资源追求“好看”,多花资源执行提示词。
  3. 加上 --raw。 V8.1 社区说明将 raw 描述为以更精简的版本替换默认风格。它是处理写实摄影、建筑可视化和需要严格执行的商业需求时的常规解法。
  4. 先用 SD 探索,再 Run as HD。 SD 的质量已可与 V7 全质量相比,因此先快速浏览低成本网格,只对锁定 seed 的入选图以 2048px 重跑。

V7 到 V8 变化分析还发现,自然语言式的否定有时比一串 --no 更有效:例如描述室内空间“with no visible windows”,比叠加多个排除参数更容易被 V8.1 正确理解。如果提示词不断触发审核,讨论这一问题的帖子最终也得出了相反的建议:简化提示词,而不是增加更多“不要做什么”的指令。

一项将五条提示词分别交给 V8.1、Nano Banana 2 和 Grok Imagine 的实测,准确概括了这种取舍:

“MidJourney V8.1 Alpha 更擅长做好 MidJourney。”——u/lukmanfebrianto,r/midjourney

16:9 缩略图工作流:从提示词到 YouTube 成品

一张 1280×720 的 YouTube 缩略图,需要 V8.1 提示词满足三点:使用 --ar 16:9、只有一个在缩小后仍清晰可辨的主视觉主体,以及 2 到 4 个加双引号的叠加文字。之后就是生成成本的取舍:低成本探索,最后只放大一次。

  1. 围绕单一视觉焦点,以主体优先的方式写提示词。这个焦点可以是一张脸、一个产品或一个物体,结尾加上 --ar 16:9 --s 100 --v 8.1。
  2. 将叠加文案置于双引号中,并写入语境,例如:a poster reading "SEASON 2"。
  3. 使用 SD 探索:每个网格消耗 0.8 GPU 分钟,约 4 秒出图。浏览、筛选,并保留可用结果的 seed。
  4. 对胜出图执行 Run as HD。锁定 seed 的提示词会以原生 2048px 重新渲染,足以覆盖 16:9 所需尺寸且有余量,消耗 1.3 GPU 分钟。
  5. 如果引号内文字发生偏移或过度风格化,把 --s 降至 100 以下,或加上 --raw,再以同一 seed 重跑。
Midjourney V8.1 SD 与 HD 任务成本和速度

一轮缩略图流程若包含 10 个 SD 探索网格和 1 个 HD 成品,合计消耗 9.3 GPU 分钟;若全部 11 个任务都使用 HD,则需要 14.3 GPU 分钟。想进一步比较哪种模型最适合这类任务,可查看我们单独进行的缩略图模型测试。

六套可直接复制的 V8.1 提示词配方

以下每一套都是完整提示词。替换其中的主体名词即可,保留整体结构与末尾参数。

电影感剧照(21:9)

An engineer in a welding mask leans into the open chest of a colossal robot.
Exposed pistons and processors glow under blue-orange volumetric light.
Empty industrial hangar, drifting sparks. IMAX science-fiction film still.
--ar 21:9 --s 250 --v 8.1

时尚美妆肖像(4:5)

Extreme close-up portrait of a woman with freckles and visible pores.
Golden-hour window light, shallow depth of field, silk couture collarbone detail.
Unretouched luxury-magazine editorial photograph. --ar 4:5 --s 200 --v 8.1

产品主视觉(1:1)

A frosted-glass serum bottle stands on a travertine ledge, water droplets on glass.
Single softbox from upper left, seamless warm-gray studio background.
Commercial skincare photography. --ar 1:1 --s 75 --raw --v 8.1

美食主视觉(3:2)

A medium-rare wagyu ribeye on a white fine-dining plate, red-wine jus and microgreens.
Candlelight, rising steam, Bordeaux glass slightly out of focus behind.
Michelin-star food photography. --ar 3:2 --s 150 --v 8.1

搭配图片提示词的风景图(16:9)

[image URL] Rugged Australian coastline at sunrise, mist over eucalyptus valleys,
long shadows across the cliff trail. --ar 16:9 --iw 2 --s 150 --v 8.1

先将参考图裁为 16:9。官方指南建议让参考图比例与目标比例一致;--iw 2(范围为 0–3)会让生成结果更倾向于沿用你的构图。

YouTube 缩略图(16:9)

A wide-eyed streamer in a hoodie reacts to a glowing portal opening behind her,
rim-lit face filling the left third, a poster reading "IT WORKS" on the right.
--ar 16:9 --s 75 --v 8.1

先以 SD 生成,再对入选图执行 Run as HD;叠加文案尽量控制在两到三个词。

在 Midjourney 应用之外运行 V8.1 提示词

同样的缩略图流程也可以通过 API 路径运行。当任务不是单张主视觉,而是批量需求——例如一次更新频道的 12 张缩略图,或为同一布局生成 A/B 变体——这就很有意义。AIReiter 的 Midjourney V8.1 工具页按图像使用 V8.1,而不是按月订阅:可批量执行每次消耗 0.8 GPU 分钟的探索任务,再将胜出图以 HD 重跑。

Midjourney V8.1 工具页面

不同任务该怎么设置 V8.1

任务版本模式Stylize / raw
主视觉图、品牌冲击力画面V8.2(默认)HD--s 300+,不用 raw
更克制的 V8 风格、已调优的工作流--v 8.1HD--s 100–300
严格执行的商业需求--v 8.1SD -> HD--s <100 + --raw
带叠加文字的缩略图--v 8.1SD -> Run as HD--s 75,加引号文字
动漫 / 漫画--niji 7-Niji 不在 V8 中
锁定角色身份V7 + --oref-V8 任务本来也会路由至 V7

如果你做的是美感优先的 V8 创作,变化分析称 Midjourney 建议搭配训练完成的 Personalization profile,并设为 --stylize 1000;profile 大约在获得 40 次评分后开始激活,接近 200 次评分时趋于稳定,这样提示词就能专注表达主体、动作与场景。

常见问题

V8.2 已成为默认版本,如何强制 Midjourney 使用 V8.1?

在提示词末尾添加 --v 8.1,或在网页端 Imagine 栏设置或 Discord 的 /settings 中,将 V8.1 设为持续生效的默认版本。

V8.1 中 --sd 和 --hd 有什么区别?

SD 每个任务消耗 0.8 GPU 分钟,约 4 秒出图;HD 消耗 1.3 GPU 分钟,约需 12 秒,并直接输出原生 2048px 图像,不经过放大步骤。根据版本文档,对 HD 图像使用 Pan、Zoom Out 或 Vary Region 编辑后,图像会回落至 SD。

V8.1 提示词中的词序重要吗?

有一定影响。越靠前的词权重略高,句子的语法主语也往往会成为视觉焦点。因此,把最重要的元素放进第一个名词短语。

什么时候该在 V8.1 中使用 --raw?

当默认画风对于任务来说过于“精致”时,就使用 --raw:例如写实摄影、建筑可视化、编辑插画,以及任何严格执行需求比风格更重要的项目。若仍处于探索阶段、希望保留 V8.1 的美学表现,则不要开启它。

--style raw 在 V8.1 中还有效吗?

无效。V7 的 --style raw 语法在 V8 系列中改为独立参数 --raw;两者作用相同,都是减少 Midjourney 的自动风格化。

哪些参数不能在 V8.1 中使用?

--q(Quality)、--cref/--cw、--niji 和 Turbo 都是 V6/V7 功能。--oref 和 --ow 虽可被接受,但任务会经由 V7 而非 V8.1 渲染。

延伸阅读:YouTube 缩略图最佳 AI 模型(实测) · Nano Banana Pro 提示词指南