Black Forest Labs 于 2026 年 7 月 23 日发布 FLUX 3,并启动了仅限受邀团队参与的视频模型早期访问。与此前的所有 FLUX 模型不同,这次的核心不再是图像,而是自带声音的视频生成。
FLUX 3 被定位为一套统一的多模态模型,可同时生成视频、图像和原生音频。目前它既不能下载,也不能自由使用,只有提交申请并获准的团队才能访问。
FLUX 3 Video 具体能做什么
按 Black Forest Labs 的说法,FLUX 3 Video 不只是“输入文字生成一段视频”的工具。同一模型还支持参考素材、视频续写和编辑工作流:
| 能力 | 具体含义 |
|---|---|
| 文生视频 | 根据文字提示生成视频片段 |
| 图生视频 | 把图像作为风格参考,或直接用作视频首帧 |
| 视频参考 | 输入已有视频片段,指导新视频的视觉风格 |
| 视频与音频续写 | 提供画面和音频后,模型可继续生成两者的后续内容 |
| 关键帧控制 | 固定指定画面帧,由模型补全其中的运动过程 |
| 智能编辑 | 将单个镜头拼接成长视频或多镜头序列 |
| 文字与动画 | 生成清晰可读的画面文字和动态图形动画 |
| 图像输出 | 除视频外,仍可生成静态图像 |
最重要的变化在于原生音频。对白、音效和环境声会在同一次生成中直接产出,而不是后期再叠加;同时还支持多种语言。
Black Forest Labs 还特别提到,FLUX 3 可覆盖远不止常见电影感风格的多种视觉表达。
发布当天,有早期测试者分享了初步体验数据:单条提示词可生成约 20 秒视频、最多支持 10 个参考媒体素材(图片和视频片段),画幅比例最高可达 21:9。Black Forest Labs 尚未公布正式规格,因此这些应视为用户反馈,而非官方保证。
现在哪些功能能用,后续何时开放
FLUX 3 并不是现在就能直接点击使用的一项完整服务。它将分阶段推出,目前上线的只是其中一部分。
| 阶段 | 状态(截至 2026 年 7 月 24 日) |
|---|---|
| FLUX 3 Video(可选原生音频) | 现已开启早期访问——仅限邀请 |
| FLUX 3 Image | 将在未来几周内推出 |
| 开放权重(FLUX 3 Dev) | 计划于 2026 年晚些时候发布 |
团队可通过 Black Forest Labs 提交申请,以争取访问资格。
Black Forest Labs 表示,FLUX 3 Video“在与前沿视频模型的早期评估中已经领先”。不过这仍是研发中的模型,且属于实验室自身的说法,目前尚未公布独立基准测试结果。
FLUX 3 与 FLUX.2 有何不同
FLUX.2 是图像模型,也是目前已经可以使用的版本。FLUX.2 Pro 现已通过标准 API 提供服务。
FLUX 3 则是新一代多模态模型,视频是它最核心的能力。其 API 预计将在未来几周内推出。
这周就要生成视频怎么办
FLUX 3 暂时还帮不上忙,但已有多款视频模型可以立即使用。
Sora 2 和 Google Veo 3.1 都支持带同步音频的文生视频;Kling 3.0 则尤其适合运动表现和图生视频。三者目前都可通过标准 API 使用。
想横向了解当前主流模型,可阅读我们的2026 AI 视频模型对比,其中从质量和成本两个维度比较了 Seedance、Kling、Sora 与 Veo。
常见问题
FLUX 3 什么时候发布?
它于 2026 年 7 月 23 日公布。FLUX 3 Video 目前已进入早期访问阶段,FLUX 3 Image 预计将在数周内推出,开放权重则计划在 2026 年晚些时候发布。
FLUX 3 免费吗?
截至 2026 年 7 月 24 日尚不能免费使用。目前仅提供邀请制早期访问,官方还未公布价格或免费套餐。
可以下载 FLUX 3 吗?
不可以。可下载的开放权重版本,即 FLUX 3 Dev,计划于 2026 年晚些时候推出。
FLUX 3 是开源的吗?
目前还不是。Black Forest Labs 表示,开放权重版本将在 2026 年晚些时候推出;现阶段只有托管式的早期访问服务。
FLUX 3 和 FLUX 2 有什么区别?
FLUX.2 是图像模型;FLUX 3 是多模态模型,其标志性能力是生成带原生音频的视频。
