AIREITER

Veo 4:哪些已获确认,哪些只是传闻(2026 年 8 月)

最后更新: 2026-08-13 01:34:19

Google I/O 2026 已经落幕,但 Veo 4 并未登场。官方的 Google DeepMind Veo 页面仍将 2025 年 10 月发布的 Veo 3.1 列为最新模型。与此同时,一些第三方网站已经在推销所谓“Veo 4”的功能,包括 4K 输出、30 秒视频片段和零样本头像,却没有提供任何来自 Google 的信源。Google 从未承认 Veo 4 是一款产品,它甚至未必会以这个名字推出。

Google DeepMind 官方 Veo 页面显示 Veo 3.1 为最新模型

Veo 3.1 现在到底能做什么

Google 当前正式提供的视频模型是 Veo 3.1,可通过 Vertex AI、Gemini app 和 Google Flow 使用。DeepMind 页面将其定位为一款“旨在赋能电影创作者和叙事者”的模型,以下能力均已得到确认:

规格Veo 3.1(已确认)
分辨率720p、1080p(Standard 档提供 4K 级别)
视频时长8 秒,可串联
原生音频支持,包括对白、音效和环境声
图像输入首帧与末帧参考图
可用渠道Vertex AI、Gemini app、Google Flow
价格(Standard 1080p + 音频)$0.40/秒(8 秒视频为 $3.20)

Google Cloud Vertex AI 定价页面还提供了更细的价格划分。Lite 档起价为 $0.03/秒,可生成仅视频、720p 内容,因此完整的 8 秒片段价格不到 $0.25。加入原生音频后,各档位的每秒价格大致都会翻倍。作为对比,1080p 带音频的 Veo 3.1 Fast 售价为 $0.12/秒,8 秒为 $0.96,大约是 Standard 档的四分之一。

因此,任何宣称 Veo 4 会“降低每秒成本”的传闻,都该先和现有 $0.03/秒的低成本基线对照来看。

曾经看似规律的发布节奏,为何失效了

过去两年,Google 的 Veo 发布节奏一度显得很有规律:

  • 2024 年 5 月(Google I/O):公布 Veo 1
  • 2025 年 5 月(Google I/O):公布 Veo 3
  • 2025 年 10 月:在非 I/O 周期发布 Veo 3.1

这两个年度数据点让许多观察者认定,Veo 4 会在 2026 年 5 月的 Google I/O 上亮相。但它没有出现。2025 年 10 月脱离惯例发布的 Veo 3.1,已经打破了 I/O 发布模式;而 Google I/O 2026 又用完全不同的东西取代了人们预期中的新型号公布:Gemini Omni。

Google Veo 模型从 2024 年至 2026 年的发布时间线,展示年度规律如何被打破

仅凭两次年度发布,不能认定这是一种可靠的节奏。Veo 3.1 在 10 月的非周期发布,已表明 Google 并不受 I/O 时间表约束;而转向 Omni 也意味着,整个模型产品线可能正在重组。

用户真正希望 Veo 4 补上的短板

Reddit 上围绕 Veo 3.1 的讨论,反复提到几项需求,而这些恰好对应了模型现有的实际局限:

用户诉求(Reddit)Veo 3.1 当前表现差距
更长视频(15-30 秒)单次生成最长 8 秒需要手动串联片段
更好的运动物理效果表现不错,但复杂运动仍有困难快速运动时会出现瑕疵
跨镜头角色一致性中等,需要借助参考图多镜头序列中身份特征会漂移
更好的人脸、手部与皮肤表现总体较强,偶尔会出错特写和快速运动时问题较明显
更强的提示词遵循能力较 Veo 3 有进步,但并不完美复杂提示词会被部分忽略
多机位叙事原生不支持每个镜头都要单独生成

r/VEO3 中一篇题为“Veo 4 Soon I think!”的帖子,道出了这种不满:

“Veo 3.1 的发展速度跟不上制作工作的需求。我们需要实质性的质量跃升——更好的运动效果、更好的人物渲染、更强的图生视频表现。竞争对手可不会等着我们。”

这种竞争压力确实存在。Kling 3.0已加入原生音频支持,1080p 的价格为 12 积分/秒;根据第三方分析,Seedance 2.5 据称支持 30 秒片段和 4K 输出。Google 的 Veo 产品线则已沉寂超过九个月。

传闻功能逐项核验:哪些有迹可循,哪些只是噪声

多个第三方网站(pollo.ai、veo40.net、tryveo4.io、aiveo4.ai)列出了高度重叠的 Veo 4 功能清单。下面逐项列出这些传闻、其状态,以及需要注意的现实情况:

传闻功能状态现实核验
4K 分辨率输出未确认Veo 3.1 已在 Google Cloud 中设有 4K 定价级别;这可能早已可用,并非 Veo 4 功能
30 秒视频片段未确认没有 Google 信源。根据第三方报道,Seedance 2.5 已提供 30 秒片段
原生分镜功能未确认被引用的 Google 文档并未描述可通过一次 API 调用生成多场景内容
零样本个性化头像未确认没有 Google 公告;很可能是将其与 Omni 的多模态输入能力混为一谈
更好的口型同步与多语言音频未确认Veo 3.1 已能生成原生对白;改进并非不可能,但没有文档佐证
更低的每秒成本未确认Veo 3.1 Lite 已低至 $0.03/秒;若要进一步降价,需要新的效率突破
高级多角度镜头控制未确认Veo 3.1 可通过提示词进行镜头指引;没有证据表明其具备专门的控制系统

这些功能说法没有链接到 Google 来源,发布日期的猜测同样没有引文支撑。Pollo AI 的文章甚至自相矛盾:同一页面中既称 Veo 3 视频“大约 8 秒”,又称其为“8-15 秒”。

Gemini Omni 出现后,Veo 4 可能不会按预想的方式到来

Google I/O 2026 最重要的发展并不是 Veo 4,而是 Gemini Omni。DeepMind 网站将其描述为一个能够“从任何输入创造任何内容”的系统。Omni 把 Gemini 的推理层与 Google 的生成式媒体技术栈结合起来,其中包括 Veo、Nano Banana 和 Genie。

这改变了观察 Google 策略的角度。Google 可能会继续把 Veo 作为独立模型线迭代,也可能将视频生成纳入一个统一的多模态系统。Omni 的定位——对话式视频编辑、物理理解和多输入融合——更倾向于后者,但 Google 尚未确认。

如果 Omni 成为 Google 的主要视频入口,未来 Veo 的改进可能会以不同产品名发布,而不是作为独立的“Veo 4”。Google 尚未说明 Veo 的命名体系是否会延续。对于目前基于 Veo 开发的人来说,实际建议是采用与供应商无关的方案:让工作流调用视频生成 API,而不要把模型名称写死。这样无论是 Veo 3.1、Kling,还是未来 Omni 开放的能力,都能切换而无需返工。

与其等 Veo 4,现在可以用什么

目前有三款值得横向比较的模型:

模型最长视频时长分辨率原生音频价格
Veo 3.18 秒1080p(4K 级别)支持按档位为 $0.03-$0.40/秒
Kling 3.010 秒720p、1080p、4K支持(1080p 为 12 积分/秒)6-30 积分/秒;美元成本取决于套餐
Seedance 2.5约 30 秒(据报道)1080p、4K支持约 $0.66-$1.80/片段(估算)

如果你看重原生音频,Veo 3.1 是文档最完善的选择,Vertex AI 也提供透明的按秒定价。若优先考虑单次生成更长的视频,Seedance 2.5 的 30 秒生成能力远超 Veo 3.1 的 8 秒限制。你可以通过我们的 Veo 3.1 video generator体验 Veo 3.1,无需配置 Vertex AI 项目。

出现这三个信号,才能确认 Veo 4 真的存在

在以下任一信号出现前,Veo 4 仍只是一个搜索关键词,而不是产品:

  1. Vertex AI 更新日志条目,明确将“Veo 4”列为新模型或模型版本
  2. Google DeepMind 研究论文,在标题或模型章节中使用 Veo 4 名称
  3. Google Cloud 产品页面,提供 Veo 4 的定价、API 规格或模型卡

预期的 I/O 公布窗口过去八个月后,这三项仍全部缺席,本身就很能说明问题。Google 尚未确认 Veo 4 是否作为产品名称存在,也没有说明其视频能力是否会改由 Omni 提供。

常见问题

Veo 4 已经正式发布了吗?

没有。截至 2026 年 8 月,Google 尚未公布、发布或承认名为 Veo 4 的产品。DeepMind 官方 Veo 页面将 Veo 3.1 列为最新模型。上文列出的三项确认信号,才会改变这一状态。

Veo 4 什么时候推出?

目前没有官方发布日期。原本的年度 Google I/O 发布规律——2024 年推出 Veo 1、2025 年推出 Veo 3——已被 2025 年 10 月非周期发布的 Veo 3.1 打破,随后又因 I/O 2026 公布 Gemini Omni 而进一步失去参考价值。Google 可能随时发布下一代 Veo 模型,也可能将其能力整合到 Omni 中。

Google 最新的 Veo 模型是什么?

是 2025 年 10 月发布的 Veo 3.1。它支持 1080p 输出、可串联的 8 秒视频片段,以及原生音频生成,包括对白、音效和环境声。该模型可通过 Vertex AI、Gemini app 和 Google Flow 使用。

我该等待 Veo 4,还是现在就用 Veo 3.1?

如果原生音频和 Google 生态整合对你的工作流最重要,现在就用 Veo 3.1。其发布时间线并不明确,而且受 Gemini Omni 转向影响,连产品名称本身都存在疑问;但 Veo 3.1 是一款能力成熟、文档完整且定价明确、可用于生产的模型。如果你优先需要更长的视频,Seedance 2.5 和 Kling 3.0 现在已分别提供 10-30 秒生成能力。

Veo 4 会通过 Gemini 或 Google Flow 提供吗?

Google 尚未确认 Veo 4 的存在或其分发渠道。Veo 3.1 可通过 Gemini app 和 Google Flow 使用;整合 Veo 技术的 Gemini Omni,则在 I/O 2026 上作为 Gemini 层产品公布。任何下一代 Veo 能力,最有可能首先出现在这些入口中。