Google I/O 2026では、Veo 4は発表されませんでした。公式のGoogle DeepMind Veoページに掲載されている最新モデルも、2025年10月リリースのVeo 3.1のままです。一方で、複数のサードパーティサイトはGoogleの出典を示さないまま、「4K出力」「30秒クリップ」「ゼロショットのアバター」といったVeo 4の機能をすでに掲げています。現時点でGoogleがVeo 4という製品を認めた事実はなく、そもそもその名前で登場しない可能性もあります。
いま使えるVeo 3.1の仕様と料金
Googleが現在提供している動画生成モデルはVeo 3.1です。Vertex AI、Geminiアプリ、Google Flowから利用できます。DeepMindのページでは、映画制作者やストーリーテラーを支援するために設計されたモデルと説明されており、確認済みの機能は次のとおりです。
| 項目 | Veo 3.1(確認済み) |
|---|---|
| 解像度 | 720p、1080p(Standardでは4Kティアも利用可能) |
| クリップ長 | 8秒、連結可能 |
| ネイティブ音声 | 対応:台詞、効果音、環境音 |
| 画像入力 | 開始フレームおよび終了フレームのリファレンス |
| 提供先 | Vertex AI、Geminiアプリ、Google Flow |
| 料金(Standard、1080p+音声) | $0.40/秒(8秒クリップで$3.20) |
Google Cloud Vertex AIの料金ページでは、さらに細かな価格体系を確認できます。Liteは動画のみ・720pで$0.03/秒からで、8秒のフルクリップでも$0.25未満です。ネイティブ音声を追加すると、全ティアで秒単価はおおむね2倍になります。比較すると、Veo 3.1 Fastの1080p+音声は$0.12/秒、8秒で$0.96。Standardティアのおよそ4分の1です。
Veo 4が「秒単価を下げる」とする噂は、低コスト用途ならすでに$0.03/秒から使えるという基準と比べて判断すべきです。
Veo 4を予測させたリリース周期が崩れた理由
2年間にわたり、GoogleのVeoは予測しやすいリリースペースに見えました。
- 2024年5月(Google I/O):Veo 1を発表
- 2025年5月(Google I/O):Veo 3を発表
- 2025年10月:Veo 3.1をI/Oとは別のタイミングでリリース
この年次リリースらしき2つの事例から、多くの人は2026年5月のGoogle I/OでVeo 4が登場すると見ていました。しかし、実際には発表されませんでした。2025年10月のVeo 3.1がすでにI/O中心の流れを崩しており、Google I/O 2026ではモデル番号の発表に代わって、まったく別のGemini Omniが前面に出されました。
年次発表が2回続いたからといって、信頼できる周期だったとは言えません。I/O以外で行われた2025年10月のVeo 3.1リリースは、GoogleがI/O日程に縛られていないことを示していました。さらにOmniへの転換は、モデルライン自体が再編される可能性も示唆します。
ユーザーがVeo 4に求めている改善点
Veo 3.1に関するRedditの議論では、現行モデルの限界に対応する要望が繰り返し挙がっています。
| ユーザーの要望(Reddit) | Veo 3.1の現状 | 不足している点 |
|---|---|---|
| より長いクリップ(15〜30秒) | 1回の生成は最大8秒 | クリップを手作業で連結する必要がある |
| より自然なモーション物理 | 良好だが、複雑な動きは苦手 | 高速な動きでアーティファクトが出る |
| カットをまたぐキャラクターの一貫性 | 中程度。画像リファレンスが必要 | 複数ショットのシーケンスで人物像がずれる |
| 顔、手、肌の品質向上 | 全体としては高品質だが、時折アーティファクトが出る | クローズアップや高速動作で目立つ |
| プロンプト追従性の強化 | Veo 3から改善したが、まだ完全ではない | 複雑なプロンプトでは一部が無視される |
| マルチカメラのストーリーテリング | ネイティブには非対応 | ショットごとに別の生成が必要 |
r/VEO3の「Veo 4 Soon I think!」というスレッドでは、制作現場での不満が端的に表れています。
「Veo 3.1はプロダクション用途の要求に追いついていません。モーション、人の描写、image-to-video性能を大きく引き上げる必要があります。競合は待ってくれません。」
競争圧力が高まっているのは事実です。Kling 3.0は1080pで12クレジット/秒のネイティブ音声に対応し、Seedance 2.5はサードパーティの分析によると30秒クリップと4K出力をサポートするとされています。GoogleのVeoラインは9か月を超えて大きな動きがありません。
Veo 4の噂を検証:根拠のある話か、ただのノイズか
pollo.ai、veo40.net、tryveo4.io、aiveo4.aiなどのサードパーティサイトでは、Veo 4の機能として似通った内容が挙げられています。以下に、噂される機能、それぞれの状況、そして事実に照らした見方をまとめます。
| 噂される機能 | 状況 | 事実確認 |
|---|---|---|
| 4K解像度での出力 | 未確認 | Veo 3.1にはGoogle Cloud上ですでに4Kの料金ティアがある。Veo 4の新機能ではなく、すでに使える可能性がある |
| 30秒クリップ | 未確認 | Googleの情報源はない。Seedance 2.5はサードパーティ報告によればすでに30秒クリップを提供している |
| ネイティブのストーリーボード作成 | 未確認 | 引用されているGoogleドキュメントには、1回のAPI呼び出しで複数シーンを生成する説明はない |
| ゼロショットのパーソナライズドアバター | 未確認 | Googleによる発表はない。Omniのマルチモーダル入力機能との混同である可能性が高い |
| リップシンクと多言語音声の改善 | 未確認 | Veo 3.1はすでにネイティブの台詞を生成する。改善自体はあり得るが、文書化されていない |
| 秒単価の引き下げ | 未確認 | Veo 3.1 Liteはすでに$0.03/秒から。さらなる値下げには新たな効率化のブレークスルーが必要になる |
| 高度なマルチアングルのカメラ制御 | 未確認 | Veo 3.1ではプロンプトでカメラを指示できるが、専用制御システムの証拠はない |
これらの機能にはGoogleの情報源へのリンクがなく、リリース日も引用なしの推測にすぎません。Pollo AIの記事では、同じページ内でVeo 3のクリップ長を「およそ8秒」とする一方、「8〜15秒」とも記載しており、内容が矛盾しています。
Gemini Omniが示す、Veo 4が想定どおり登場しない可能性
Google I/O 2026で最も重要だったのはVeo 4の発表ではなく、Gemini Omniでした。DeepMindサイトでは「あらゆるものから、あらゆるものを作れる」システムと説明されています。OmniはGeminiの推論レイヤーと、Veo、Nano Banana、Genieを含むGoogleの生成メディアスタックを統合します。
これにより戦略の見え方が変わります。Googleが独立したモデルラインとしてVeoを更新し続ける可能性はありますが、動画生成を統合型マルチモーダルシステムへ取り込む可能性もあります。会話形式での動画編集、物理の理解、複数入力の統合というOmniの位置付けは後者を示唆しますが、Googleはこれを確認していません。
OmniがGoogleの主要な動画インターフェースになれば、今後のVeoの改善は独立した「Veo 4」ではなく、別の製品名で提供されるかもしれません。GoogleはVeoの命名体系を続けるかどうかを明らかにしていません。現在Veoを基盤に開発しているなら、実務上はモデル名をハードコードせず、動画生成APIを呼び出すプロバイダー非依存の設計にしておくべきです。そうすればVeo 3.1、Kling、あるいはOmniが公開する機能へも、大きな作り直しなしに切り替えられます。
待たずに使うなら、現時点ではどれを選ぶべきか
現在利用できるモデルのうち、比較対象として有力なのは次の3つです。
| モデル | 最大クリップ長 | 解像度 | ネイティブ音声 | 料金 |
|---|---|---|---|---|
| Veo 3.1 | 8秒 | 1080p(4Kティア) | 対応 | ティアにより$0.03〜$0.40/秒 |
| Kling 3.0 | 10秒 | 720p、1080p、4K | 対応(1080pで12クレジット/秒) | 6〜30クレジット/秒、ドル換算はプラン次第 |
| Seedance 2.5 | 約30秒(報告ベース) | 1080p、4K | 対応 | 1クリップあたり約$0.66〜$1.80(推定) |
ネイティブ音声を重視するなら、Vertex AIで秒単位の料金が明確に公開されているVeo 3.1が、最も文書化の進んだ選択肢です。1回の生成でより長いクリップを作ることが優先なら、Seedance 2.5の30秒生成はVeo 3.1の8秒上限を大きく上回ります。Vertex AIプロジェクトを用意しなくても、当サイトのVeo 3.1 video generatorでVeo 3.1を試せます。
Veo 4の実在を確認できる3つのサイン
以下のいずれかが現れるまでは、Veo 4は製品ではなく検索キーワードにとどまります。
- Vertex AIの変更履歴:新モデルまたはモデルバージョンとして「Veo 4」を明示した記載
- Google DeepMindの研究論文:タイトルまたはモデルの説明でVeo 4という名称を使用したもの
- Google Cloudの製品ページ:Veo 4の料金、API仕様、またはモデルカードを掲載したページ
想定されていたI/Oの発表時期から8か月経っても、この3つがいずれも存在しないこと自体が重要な情報です。GoogleはVeo 4が製品名として存在するのか、あるいは動画機能をOmni経由で提供するのかを確認していません。
よくある質問
Veo 4は正式リリースされていますか?
いいえ。2026年8月時点で、GoogleはVeo 4という製品を発表、リリース、または認知していません。公式のDeepMind Veoページでは、最新モデルとしてVeo 3.1が掲載されています。状況が変わる条件については、上記の3つの確認サインを参照してください。
Veo 4はいつリリースされますか?
正式なリリース日はありません。Google I/Oでの年次リリースというパターンは、2025年10月にI/Oとは別のタイミングでVeo 3.1がリリースされたことで崩れ、I/O 2026でのGemini Omni発表によりさらに不透明になりました。Googleが次のVeoモデルをいつでもリリースする可能性はありますが、その機能をOmniに統合する可能性もあります。
最新のGoogle Veoモデルは何ですか?
2025年10月リリースのVeo 3.1です。1080p出力、連結可能な8秒クリップ、ネイティブ音声生成(台詞、効果音、環境音)に対応しています。Vertex AI、Geminiアプリ、Google Flowから利用可能です。
Veo 4を待つべきですか? それとも今Veo 3.1を使うべきですか?
ネイティブ音声とGoogleエコシステムとの統合がワークフローで最も重要なら、いまVeo 3.1を使うべきです。リリース時期は不明で、Gemini Omniへの転換により製品名そのものも不確実です。一方、Veo 3.1は機能、仕様、料金が明確な実用的なプロダクションモデルです。長いクリップが最優先なら、Seedance 2.5とKling 3.0はすでに10〜30秒の生成を提供しています。
Veo 4はGeminiまたはGoogle Flowで利用できるようになりますか?
GoogleはVeo 4の存在も、提供チャネルも確認していません。Veo 3.1はGeminiアプリとGoogle Flowで利用でき、Veo技術を統合するGemini Omniは、I/O 2026でGeminiレイヤーの製品として発表されました。次世代のVeo機能が登場する場合、これらの提供先に最初に現れる可能性が最も高いでしょう。