FLUX 3 Video 解析:能做什么,什么时候能用

最后更新: 2026-07-23 16:56:45

Black Forest Labs 于 2026 年 7 月 23 日发布 FLUX 3,并启动了仅限受邀团队参与的视频模型早期访问。与此前的所有 FLUX 模型不同,这次的核心不再是图像,而是自带声音的视频生成

FLUX 3 被定位为一套统一的多模态模型,可同时生成视频、图像和原生音频。目前它既不能下载,也不能自由使用,只有提交申请并获准的团队才能访问。

Black Forest Labs FLUX 3 发布页面,展示用于图像、视频、音频和动作的统一多模态模型

FLUX 3 Video 具体能做什么

按 Black Forest Labs 的说法,FLUX 3 Video 不只是“输入文字生成一段视频”的工具。同一模型还支持参考素材、视频续写和编辑工作流:

能力具体含义
文生视频根据文字提示生成视频片段
图生视频把图像作为风格参考,或直接用作视频首帧
视频参考输入已有视频片段,指导新视频的视觉风格
视频与音频续写提供画面和音频后,模型可继续生成两者的后续内容
关键帧控制固定指定画面帧,由模型补全其中的运动过程
智能编辑将单个镜头拼接成长视频或多镜头序列
文字与动画生成清晰可读的画面文字和动态图形动画
图像输出除视频外,仍可生成静态图像

最重要的变化在于原生音频。对白、音效和环境声会在同一次生成中直接产出,而不是后期再叠加;同时还支持多种语言。

Black Forest Labs 还特别提到,FLUX 3 可覆盖远不止常见电影感风格的多种视觉表达。

发布当天,有早期测试者分享了初步体验数据:单条提示词可生成约 20 秒视频、最多支持 10 个参考媒体素材(图片和视频片段),画幅比例最高可达 21:9。Black Forest Labs 尚未公布正式规格,因此这些应视为用户反馈,而非官方保证。

现在哪些功能能用,后续何时开放

FLUX 3 并不是现在就能直接点击使用的一项完整服务。它将分阶段推出,目前上线的只是其中一部分。

阶段状态(截至 2026 年 7 月 24 日)
FLUX 3 Video(可选原生音频)现已开启早期访问——仅限邀请
FLUX 3 Image将在未来几周内推出
开放权重(FLUX 3 Dev)计划于 2026 年晚些时候发布

团队可通过 Black Forest Labs 提交申请,以争取访问资格。

Black Forest Labs 表示,FLUX 3 Video“在与前沿视频模型的早期评估中已经领先”。不过这仍是研发中的模型,且属于实验室自身的说法,目前尚未公布独立基准测试结果。

Black Forest Labs 页面介绍 FLUX 模型的 API 访问和可下载开放权重

FLUX 3 与 FLUX.2 有何不同

FLUX.2 是图像模型,也是目前已经可以使用的版本。FLUX.2 Pro 现已通过标准 API 提供服务。

FLUX 3 则是新一代多模态模型,视频是它最核心的能力。其 API 预计将在未来几周内推出。

这周就要生成视频怎么办

FLUX 3 暂时还帮不上忙,但已有多款视频模型可以立即使用。

Sora 2Google Veo 3.1 都支持带同步音频的文生视频;Kling 3.0 则尤其适合运动表现和图生视频。三者目前都可通过标准 API 使用。

想横向了解当前主流模型,可阅读我们的2026 AI 视频模型对比,其中从质量和成本两个维度比较了 Seedance、Kling、Sora 与 Veo。

常见问题

FLUX 3 什么时候发布?

它于 2026 年 7 月 23 日公布。FLUX 3 Video 目前已进入早期访问阶段,FLUX 3 Image 预计将在数周内推出,开放权重则计划在 2026 年晚些时候发布。

FLUX 3 免费吗?

截至 2026 年 7 月 24 日尚不能免费使用。目前仅提供邀请制早期访问,官方还未公布价格或免费套餐。

可以下载 FLUX 3 吗?

不可以。可下载的开放权重版本,即 FLUX 3 Dev,计划于 2026 年晚些时候推出。

FLUX 3 是开源的吗?

目前还不是。Black Forest Labs 表示,开放权重版本将在 2026 年晚些时候推出;现阶段只有托管式的早期访问服务。

FLUX 3 和 FLUX 2 有什么区别?

FLUX.2 是图像模型;FLUX 3 是多模态模型,其标志性能力是生成带原生音频的视频。

相关阅读