Google I/O 2026 已经落幕,但 Veo 4 并未登场。官方的 Google DeepMind Veo 页面仍将 2025 年 10 月发布的 Veo 3.1 列为最新模型。与此同时,一些第三方网站已经在推销所谓“Veo 4”的功能,包括 4K 输出、30 秒视频片段和零样本头像,却没有提供任何来自 Google 的信源。Google 从未承认 Veo 4 是一款产品,它甚至未必会以这个名字推出。
Veo 3.1 现在到底能做什么
Google 当前正式提供的视频模型是 Veo 3.1,可通过 Vertex AI、Gemini app 和 Google Flow 使用。DeepMind 页面将其定位为一款“旨在赋能电影创作者和叙事者”的模型,以下能力均已得到确认:
| 规格 | Veo 3.1(已确认) |
|---|---|
| 分辨率 | 720p、1080p(Standard 档提供 4K 级别) |
| 视频时长 | 8 秒,可串联 |
| 原生音频 | 支持,包括对白、音效和环境声 |
| 图像输入 | 首帧与末帧参考图 |
| 可用渠道 | Vertex AI、Gemini app、Google Flow |
| 价格(Standard 1080p + 音频) | $0.40/秒(8 秒视频为 $3.20) |
Google Cloud Vertex AI 定价页面还提供了更细的价格划分。Lite 档起价为 $0.03/秒,可生成仅视频、720p 内容,因此完整的 8 秒片段价格不到 $0.25。加入原生音频后,各档位的每秒价格大致都会翻倍。作为对比,1080p 带音频的 Veo 3.1 Fast 售价为 $0.12/秒,8 秒为 $0.96,大约是 Standard 档的四分之一。
因此,任何宣称 Veo 4 会“降低每秒成本”的传闻,都该先和现有 $0.03/秒的低成本基线对照来看。
曾经看似规律的发布节奏,为何失效了
过去两年,Google 的 Veo 发布节奏一度显得很有规律:
- 2024 年 5 月(Google I/O):公布 Veo 1
- 2025 年 5 月(Google I/O):公布 Veo 3
- 2025 年 10 月:在非 I/O 周期发布 Veo 3.1
这两个年度数据点让许多观察者认定,Veo 4 会在 2026 年 5 月的 Google I/O 上亮相。但它没有出现。2025 年 10 月脱离惯例发布的 Veo 3.1,已经打破了 I/O 发布模式;而 Google I/O 2026 又用完全不同的东西取代了人们预期中的新型号公布:Gemini Omni。
仅凭两次年度发布,不能认定这是一种可靠的节奏。Veo 3.1 在 10 月的非周期发布,已表明 Google 并不受 I/O 时间表约束;而转向 Omni 也意味着,整个模型产品线可能正在重组。
用户真正希望 Veo 4 补上的短板
Reddit 上围绕 Veo 3.1 的讨论,反复提到几项需求,而这些恰好对应了模型现有的实际局限:
| 用户诉求(Reddit) | Veo 3.1 当前表现 | 差距 |
|---|---|---|
| 更长视频(15-30 秒) | 单次生成最长 8 秒 | 需要手动串联片段 |
| 更好的运动物理效果 | 表现不错,但复杂运动仍有困难 | 快速运动时会出现瑕疵 |
| 跨镜头角色一致性 | 中等,需要借助参考图 | 多镜头序列中身份特征会漂移 |
| 更好的人脸、手部与皮肤表现 | 总体较强,偶尔会出错 | 特写和快速运动时问题较明显 |
| 更强的提示词遵循能力 | 较 Veo 3 有进步,但并不完美 | 复杂提示词会被部分忽略 |
| 多机位叙事 | 原生不支持 | 每个镜头都要单独生成 |
r/VEO3 中一篇题为“Veo 4 Soon I think!”的帖子,道出了这种不满:
“Veo 3.1 的发展速度跟不上制作工作的需求。我们需要实质性的质量跃升——更好的运动效果、更好的人物渲染、更强的图生视频表现。竞争对手可不会等着我们。”
这种竞争压力确实存在。Kling 3.0已加入原生音频支持,1080p 的价格为 12 积分/秒;根据第三方分析,Seedance 2.5 据称支持 30 秒片段和 4K 输出。Google 的 Veo 产品线则已沉寂超过九个月。
传闻功能逐项核验:哪些有迹可循,哪些只是噪声
多个第三方网站(pollo.ai、veo40.net、tryveo4.io、aiveo4.ai)列出了高度重叠的 Veo 4 功能清单。下面逐项列出这些传闻、其状态,以及需要注意的现实情况:
| 传闻功能 | 状态 | 现实核验 |
|---|---|---|
| 4K 分辨率输出 | 未确认 | Veo 3.1 已在 Google Cloud 中设有 4K 定价级别;这可能早已可用,并非 Veo 4 功能 |
| 30 秒视频片段 | 未确认 | 没有 Google 信源。根据第三方报道,Seedance 2.5 已提供 30 秒片段 |
| 原生分镜功能 | 未确认 | 被引用的 Google 文档并未描述可通过一次 API 调用生成多场景内容 |
| 零样本个性化头像 | 未确认 | 没有 Google 公告;很可能是将其与 Omni 的多模态输入能力混为一谈 |
| 更好的口型同步与多语言音频 | 未确认 | Veo 3.1 已能生成原生对白;改进并非不可能,但没有文档佐证 |
| 更低的每秒成本 | 未确认 | Veo 3.1 Lite 已低至 $0.03/秒;若要进一步降价,需要新的效率突破 |
| 高级多角度镜头控制 | 未确认 | Veo 3.1 可通过提示词进行镜头指引;没有证据表明其具备专门的控制系统 |
这些功能说法没有链接到 Google 来源,发布日期的猜测同样没有引文支撑。Pollo AI 的文章甚至自相矛盾:同一页面中既称 Veo 3 视频“大约 8 秒”,又称其为“8-15 秒”。
Gemini Omni 出现后,Veo 4 可能不会按预想的方式到来
Google I/O 2026 最重要的发展并不是 Veo 4,而是 Gemini Omni。DeepMind 网站将其描述为一个能够“从任何输入创造任何内容”的系统。Omni 把 Gemini 的推理层与 Google 的生成式媒体技术栈结合起来,其中包括 Veo、Nano Banana 和 Genie。
这改变了观察 Google 策略的角度。Google 可能会继续把 Veo 作为独立模型线迭代,也可能将视频生成纳入一个统一的多模态系统。Omni 的定位——对话式视频编辑、物理理解和多输入融合——更倾向于后者,但 Google 尚未确认。
如果 Omni 成为 Google 的主要视频入口,未来 Veo 的改进可能会以不同产品名发布,而不是作为独立的“Veo 4”。Google 尚未说明 Veo 的命名体系是否会延续。对于目前基于 Veo 开发的人来说,实际建议是采用与供应商无关的方案:让工作流调用视频生成 API,而不要把模型名称写死。这样无论是 Veo 3.1、Kling,还是未来 Omni 开放的能力,都能切换而无需返工。
与其等 Veo 4,现在可以用什么
目前有三款值得横向比较的模型:
| 模型 | 最长视频时长 | 分辨率 | 原生音频 | 价格 |
|---|---|---|---|---|
| Veo 3.1 | 8 秒 | 1080p(4K 级别) | 支持 | 按档位为 $0.03-$0.40/秒 |
| Kling 3.0 | 10 秒 | 720p、1080p、4K | 支持(1080p 为 12 积分/秒) | 6-30 积分/秒;美元成本取决于套餐 |
| Seedance 2.5 | 约 30 秒(据报道) | 1080p、4K | 支持 | 约 $0.66-$1.80/片段(估算) |
如果你看重原生音频,Veo 3.1 是文档最完善的选择,Vertex AI 也提供透明的按秒定价。若优先考虑单次生成更长的视频,Seedance 2.5 的 30 秒生成能力远超 Veo 3.1 的 8 秒限制。你可以通过我们的 Veo 3.1 video generator体验 Veo 3.1,无需配置 Vertex AI 项目。
出现这三个信号,才能确认 Veo 4 真的存在
在以下任一信号出现前,Veo 4 仍只是一个搜索关键词,而不是产品:
- Vertex AI 更新日志条目,明确将“Veo 4”列为新模型或模型版本
- Google DeepMind 研究论文,在标题或模型章节中使用 Veo 4 名称
- Google Cloud 产品页面,提供 Veo 4 的定价、API 规格或模型卡
预期的 I/O 公布窗口过去八个月后,这三项仍全部缺席,本身就很能说明问题。Google 尚未确认 Veo 4 是否作为产品名称存在,也没有说明其视频能力是否会改由 Omni 提供。
常见问题
Veo 4 已经正式发布了吗?
没有。截至 2026 年 8 月,Google 尚未公布、发布或承认名为 Veo 4 的产品。DeepMind 官方 Veo 页面将 Veo 3.1 列为最新模型。上文列出的三项确认信号,才会改变这一状态。
Veo 4 什么时候推出?
目前没有官方发布日期。原本的年度 Google I/O 发布规律——2024 年推出 Veo 1、2025 年推出 Veo 3——已被 2025 年 10 月非周期发布的 Veo 3.1 打破,随后又因 I/O 2026 公布 Gemini Omni 而进一步失去参考价值。Google 可能随时发布下一代 Veo 模型,也可能将其能力整合到 Omni 中。
Google 最新的 Veo 模型是什么?
是 2025 年 10 月发布的 Veo 3.1。它支持 1080p 输出、可串联的 8 秒视频片段,以及原生音频生成,包括对白、音效和环境声。该模型可通过 Vertex AI、Gemini app 和 Google Flow 使用。
我该等待 Veo 4,还是现在就用 Veo 3.1?
如果原生音频和 Google 生态整合对你的工作流最重要,现在就用 Veo 3.1。其发布时间线并不明确,而且受 Gemini Omni 转向影响,连产品名称本身都存在疑问;但 Veo 3.1 是一款能力成熟、文档完整且定价明确、可用于生产的模型。如果你优先需要更长的视频,Seedance 2.5 和 Kling 3.0 现在已分别提供 10-30 秒生成能力。
Veo 4 会通过 Gemini 或 Google Flow 提供吗?
Google 尚未确认 Veo 4 的存在或其分发渠道。Veo 3.1 可通过 Gemini app 和 Google Flow 使用;整合 Veo 技术的 Gemini Omni,则在 I/O 2026 上作为 Gemini 层产品公布。任何下一代 Veo 能力,最有可能首先出现在这些入口中。