Google I/O 2026 已經落幕,Veo 4 並未現身。查看官方 Google DeepMind Veo 頁面,最新列出的仍是於 2025 年 10 月發布的 Veo 3.1;但已有多個第三方網站搶先宣稱「Veo 4」具備 4K 輸出、30 秒影片、零樣本虛擬人物等功能,卻完全拿不出 Google 的資料來源。現階段,Google 不僅未承認 Veo 4 是一項產品,它甚至未必會以這個名稱推出。
Veo 3.1 現在究竟能做到什麼
Google 目前正式提供的影片生成模型是 Veo 3.1,可透過 Vertex AI、Gemini app 與 Google Flow 使用。DeepMind 將它定位為一款「為電影製作者與故事創作者賦能」的模型,以下能力皆已獲官方確認:
| 規格 | Veo 3.1(已確認) |
|---|---|
| 解析度 | 720p、1080p(Standard 方案提供 4K 級距) |
| 片段長度 | 8 秒,可串接 |
| 原生音訊 | 支援:對白、音效、環境音 |
| 圖片輸入 | 首幀與末幀參考圖 |
| 提供平台 | Vertex AI、Gemini app、Google Flow |
| 價格(Standard 1080p + 音訊) | $0.40/秒(8 秒片段為 $3.20) |
Google Cloud Vertex AI 定價頁面還列出更細的費率。Lite 級距從 $0.03/秒起跳,提供純影片 720p 輸出,完整 8 秒片段的成本不到 $0.25。加入原生音訊後,各級距的每秒費率大約會翻倍。作為對照,Veo 3.1 Fast 的 1080p 含音訊方案為 $0.12/秒,8 秒只要 $0.96,約為 Standard 級距的四分之一。
因此,任何宣稱 Veo 4 能「降低每秒成本」的傳聞,都該先和這個每秒 $0.03 起的預算型基準相比。
原本看似固定的發布節奏,為何失準了
過去兩年,Google 推出 Veo 的節奏看起來相當規律:
- 2024 年 5 月(Google I/O):公布 Veo 1
- 2025 年 5 月(Google I/O):公布 Veo 3
- 2025 年 10 月:非例行發布 Veo 3.1
這兩個年度發布點,讓許多觀察者認定 Veo 4 會在 2026 年 5 月的 Google I/O 登場,但結果並非如此。2025 年 10 月不按 I/O 檔期推出的 Veo 3.1,已經打破既有模式;而 Google I/O 2026 並未帶來預期中的新型號公告,反而端出了完全不同的 Gemini Omni。
僅憑兩次年度發表,並不足以稱為可靠的發布規律。Veo 3.1 在 10 月的非例行推出,已表明 Google 並未受限於 I/O 時程;而轉向 Omni 的動作,也暗示整條模型產品線可能正在重組。
使用者希望 Veo 4 解決哪些痛點
Reddit 上圍繞 Veo 3.1 的討論,反覆出現幾項訴求,剛好對應到這款模型目前的實際限制:
| 使用者期待(Reddit) | Veo 3.1 現況 | 差距 |
|---|---|---|
| 更長片段(15 至 30 秒) | 每次生成最長 8 秒 | 片段必須手動串接 |
| 更好的動作物理表現 | 整體不錯,但複雜動作仍吃力 | 快速動作會出現瑕疵 |
| 跨鏡頭的角色一致性 | 中等,需要圖片參考 | 多鏡頭序列容易發生角色身分漂移 |
| 更自然的臉部、手部與膚質 | 通常表現強,但偶有瑕疵 | 特寫與快速動態中特別明顯 |
| 更準確遵循提示詞 | 比 Veo 3 進步,仍不完美 | 複雜提示詞可能只被部分採納 |
| 多機位敘事 | 原生不支援 | 每個鏡頭都得分開生成 |
r/VEO3 上一篇題為「Veo 4 Soon I think!」的討論串,精準反映了這種挫折感:
「Veo 3.1 的進展跟不上製作需求。我們需要明顯的品質躍升:更好的動作、更好的人物呈現、更好的圖生影片表現。競爭對手可不會停下來等。」
競爭壓力確實存在。Kling 3.0 已加入原生音訊支援,1080p 的費率為 12 credits/秒;根據第三方分析,Seedance 2.5 據稱支援 30 秒片段與 4K 輸出。Google 的 Veo 產品線則已超過九個月沒有新動靜。
傳聞功能逐項檢視:哪些有根據、哪些只是雜訊
pollo.ai、veo40.net、tryveo4.io 與 aiveo4.ai 等多個第三方網站,都列出一批高度重疊的 Veo 4 功能。以下逐項整理傳聞內容、狀態與現實檢驗:
| 傳聞功能 | 狀態 | 現實檢驗 |
|---|---|---|
| 4K 解析度輸出 | 未證實 | Veo 3.1 在 Google Cloud 已有 4K 定價級距;這可能已經可用,而非 Veo 4 功能 |
| 30 秒片段 | 未證實 | 沒有 Google 來源。依第三方報導,Seedance 2.5 已可提供 30 秒片段 |
| 原生分鏡功能 | 未證實 | 引用的 Google 文件並未提到可透過單次 API 呼叫生成多場景內容 |
| 零樣本個人化虛擬人物 | 未證實 | Google 沒有公告;很可能是與 Omni 的多模態輸入能力混為一談 |
| 更好的嘴型同步與多語音訊 | 未證實 | Veo 3.1 已能生成原生對白;進步並非不合理,但沒有文件佐證 |
| 更低的每秒成本 | 未證實 | Veo 3.1 Lite 已從 $0.03/秒起;若要再降,得有新的效率突破 |
| 進階多角度鏡頭控制 | 未證實 | Veo 3.1 可透過提示詞指定鏡頭方向,沒有證據顯示存在專屬控制系統 |
這些功能宣稱都沒有連結到 Google 來源,連發布日期也是無引述的猜測。Pollo AI 的文章甚至自相矛盾,同一頁中將 Veo 3 片段長度分別寫成「約 8 秒」與「8 至 15 秒」。
Gemini Omni 出現後,Veo 4 可能不會照預期方式登場
Google I/O 2026 最重要的發展不是 Veo 4,而是 Gemini Omni。DeepMind 網站將它描述為能「從任何內容創造任何內容」的系統。Omni 結合 Gemini 的推理層與 Google 的生成式媒體技術堆疊,其中包括 Veo、Nano Banana 與 Genie。
這讓產品策略出現新的可能。Google 可能持續將 Veo 作為獨立模型線迭代,也可能把影片生成整合進統一的多模態系統。Omni 的定位涵蓋對話式影片編輯、物理理解與多輸入融合,顯示後者或許才是方向,但 Google 尚未確認。
若 Omni 成為 Google 主要的影片介面,未來 Veo 的進步可能會以不同產品名稱推出,而不是作為獨立的「Veo 4」。Google 目前也沒有說明 Veo 的命名方式是否會延續。對於正在以 Veo 開發的人來說,實務上的建議是採用供應商中立的架構:讓流程呼叫影片生成 API,而非把模型名稱寫死。如此一來,無論要切換到 Veo 3.1、Kling,或 Omni 未來提供的模型,都不必重做整個流程。
與其等 Veo 4,現在有哪些選擇
目前有三款值得並列比較的模型:
| 模型 | 最長片段 | 解析度 | 原生音訊 | 價格 |
|---|---|---|---|---|
| Veo 3.1 | 8 秒 | 1080p(4K 級距) | 支援 | 依級距為 $0.03-$0.40/秒 |
| Kling 3.0 | 10 秒 | 720p、1080p、4K | 支援(1080p 為 12 credits/秒) | 6-30 credits/秒;美元成本視方案而定 |
| Seedance 2.5 | 約 30 秒(據報導) | 1080p、4K | 支援 | 每段約 $0.66-$1.80(估計) |
若原生音訊是關鍵需求,Veo 3.1 是資料最完整的選擇,Vertex AI 也提供透明的每秒定價。如果你優先追求單次生成更長的片段,Seedance 2.5 據稱可生成 30 秒內容,遠超過 Veo 3.1 的 8 秒上限。你可以透過我們的 Veo 3.1 video generator 體驗 Veo 3.1,無須先建立 Vertex AI 專案。
出現這三項訊號,才能確認 Veo 4 真的存在
在以下任一資訊出現前,Veo 4 只是一個搜尋關鍵字,還不是產品:
- Vertex AI 更新日誌條目,明確將「Veo 4」列為新模型或模型版本
- Google DeepMind 研究論文,在標題或模型章節中使用 Veo 4 名稱
- Google Cloud 產品頁面,提供 Veo 4 的定價、API 規格或模型卡
預期的 I/O 發布窗口過去八個月後,這三項資訊仍全數缺席,本身就很能說明問題。Google 尚未確認 Veo 4 是否是正式產品名稱,也未說明其影片能力是否會改由 Omni 提供。
常見問題
Veo 4 已經正式發布了嗎?
沒有。截至 2026 年 8 月,Google 尚未宣布、發布或承認名為 Veo 4 的產品。DeepMind 官方 Veo 頁面列出的最新模型仍是 Veo 3.1。上方列出的三項確認訊號,便是足以改變此判斷的依據。
Veo 4 何時推出?
目前沒有官方發布日期。原先看似每年 Google I/O 發布的模式——2024 年的 Veo 1、2025 年的 Veo 3——已被 2025 年 10 月非例行推出的 Veo 3.1 打破,I/O 2026 的 Gemini Omni 公告更進一步擾亂了這條脈絡。Google 可能隨時發布下一款 Veo 模型,也可能改將其能力整合至 Omni。
Google 最新的 Veo 模型是什麼?
是於 2025 年 10 月發布的 Veo 3.1。它支援 1080p 輸出、可串接的 8 秒片段,以及原生音訊生成,包括對白、音效與環境音。可透過 Vertex AI、Gemini app 與 Google Flow 使用。
我該等 Veo 4,還是現在就用 Veo 3.1?
如果你的工作流程最重視原生音訊與 Google 生態系整合,現在就用 Veo 3.1。發布時程尚不明朗,而 Gemini Omni 的轉向也讓產品名稱本身存在變數;Veo 3.1 已是一款能力完整、文件齊全且定價明確的正式模型。若你更在意片段長度,Seedance 2.5 與 Kling 3.0 現在已可分別提供 10 至 30 秒的生成內容。
Veo 4 會透過 Gemini 或 Google Flow 提供嗎?
Google 尚未確認 Veo 4 是否存在,也未確認其發布管道。Veo 3.1 可透過 Gemini app 與 Google Flow 使用;整合 Veo 技術的 Gemini Omni,則在 I/O 2026 作為 Gemini 層產品公布。任何下一代 Veo 能力,最有可能優先出現在這些介面中。