ComfyUIでは、2× NVIDIA GB200を使って10秒・720pの動画を6.8秒で生成できるLTX-2.5。LTX-2.3から速度は大きく伸びました。一方で、APIの動画1秒あたりの料金は、すべての解像度で旧モデルを上回ります。速さは確かな進化ですが、コスト面では逆行しているのがポイントです。
LTX-2.5で変わったこと
Lightricksが2026年8月11日に公開したLTX-2.5には、ホスト型API向けにFastとProの2モデルが用意されています。最大の特徴は、シーンの複雑さに応じてレンダリング工程を配分するDiffusion Fidelity Renderingです。全フレームを固定ステップ数で処理するのではなく、必要な箇所に計算量を振り向ける仕組みで、LTXは画質を一律に落とさず生成を高速化できると説明しています。ComfyUIの初期テスターからも、顕著な速度向上が報告されています。
2.5系では、1本の出力内でカットをまたいだ連続性を保つネイティブのマルチショット生成にも対応しました。プロンプト追従性、テクスチャ、顔、文字表現の精細さも強化されたとしています。これらは公式モデルドキュメントに基づくベンダー側の説明であり、独立したベンチマーク結果はまだ公開されていません。
| 仕様 | LTX-2.5 Fast | LTX-2.5 Pro |
|---|---|---|
| 最大解像度 | 4K(3840×2160) | 1080p(1920×1080) |
| フレームレート | 24 fps、48 fps | 24 fps |
| テキストから動画 | 対応 | 対応 |
| 画像から動画 | 対応 | 対応 |
| 音声から動画 | 対応 | 非対応 |
| Retake / Extend / Reframe | 非対応 | 非対応 |
| 1回あたりの最大生成時間 | 約20秒(24/25 fps) | 約10秒 |
名称とは裏腹に、Proのほうが機能面では制限が多いモデルです。上限は1080pで、音声から動画には対応せず、retake、extend、reframeといった編集機能も使えません。これらのエンドポイントは引き続きltx-2-3-pro専用です。
解像度別・tier別のLTX API料金
LTXの動画生成は、計算時間ではなく出力動画の秒数単位で課金されます。公式料金ページには、2.5系と2.3系を合わせて4つのモデルIDが掲載されています。LTX-2.5は、共通するすべての解像度で前世代より1秒あたりの単価が高くなっています。
LTX-2.5 Fastの料金
| 解像度 | 1秒あたり | 10秒クリップあたり |
|---|---|---|
| 720p(1280×720) | $0.09 | $0.90 |
| 1080p(1920×1080) | $0.13 | $1.30 |
| 1440p(2560×1440) | $0.19 | $1.90 |
| 4K(3840×2160) | $0.30 | $3.00 |
LTX-2.5 Proの料金
| 解像度 | 1秒あたり | 10秒クリップあたり |
|---|---|---|
| 720p(1280×720) | $0.12 | $1.20 |
| 1080p(1920×1080) | $0.17 | $1.70 |
全モデルを利用できる720pと1080pについて、4モデルの料金を比べると次のようになります。
LTX-2.5とLTX-2.3を比較:旧モデルを選ぶべき場面
意外な点は、LTX-2.3がすべての解像度・tierでLTX-2.5より安いことです。720pではLTX-2.3 Fastが$0.03/秒で、$0.09/秒のLTX-2.5 Fastの3分の1に収まります。4Kでは差が$0.24対$0.30まで縮まるものの、逆転はしません。
| 解像度 | LTX-2.3 Fast | LTX-2.5 Fast | LTX-2.3 Pro | LTX-2.5 Pro |
|---|---|---|---|---|
| 720p | $0.03 | $0.09 | $0.04 | $0.12 |
| 1080p | $0.06 | $0.13 | $0.08 | $0.17 |
| 1440p | $0.12 | $0.19 | $0.16 | - |
| 4K | $0.24 | $0.30 | $0.32 | - |
料金以上に重要なのが、利用できるエンドポイントの差です。既存動画の一部を再生成するretake、冒頭または末尾にフレームを追加するextend(課金対象は最大505フレーム)、生成による補完を伴うアスペクト比変更のreframeに対応するのは、LTX-2.3 Proだけです。単純な生成ではなく編集を組み込むワークフローでは、LTX-2.5に移行先はありません。必要なのは2.3 Proです。
| エンドポイント | ltx-2-5-fast | ltx-2-5-pro | ltx-2-3-fast | ltx-2-3-pro |
|---|---|---|---|---|
| テキストから動画 | ✅ | ✅ | ✅ | ✅ |
| 画像から動画 | ✅ | ✅ | ✅ | ✅ |
| 音声から動画 | ✅ | ❌ | ❌ | ✅ |
| Retake | ❌ | ❌ | ❌ | ✅ |
| Extend | ❌ | ❌ | ❌ | ✅ |
| Reframe | ❌ | ❌ | ❌ | ✅ |
LTX-2.5が向くケース:マルチショットのクリップを含め、プロンプト追従性やテクスチャの細かさを重視する純粋な動画生成。LTX-2.3が向くケース:retake・extend・reframeを使う編集ワークフロー、予算を抑えた大量生成、4KのPro出力です。2.5 Proは1080pまでですが、2.3 Proは4Kに対応します。
LTX-2.5の使い方:API・ComfyUI・オープンウェイト
利用方法は3つあります。
- ホスト型API - 同期エンドポイント(
v1/)または非同期エンドポイント(v2/)のmodelフィールドにltx-2-5-fastまたはltx-2-5-proを指定します。リクエスト形式は公式APIリファレンスを参照してください。テキストから動画、画像から動画は、同期・非同期の両方に対応します。2.5 Fastの音声から動画は、v2/audio-to-video経由の非同期処理のみです。LTXのローンチ資料によると、管理型APIでは1080p出力の10秒の画像から動画クリップを23.7秒で生成しました。
- ComfyUI - LTX-2.5は、テキストから動画、画像から動画、Diffusion Fidelity Rendering専用ノードを含むComfyUIネイティブ統合に対応しています。2× NVIDIA GB200では、10秒・720pのクリップを6.8秒で生成しました(IT之家経由のLTXローンチベンチマーク)。ホスト型APIは比較対象に近い処理を1080p出力で23.7秒としているものの、解像度が異なるため直接比較はできません。
- オープンウェイト - モデルウェイトはHuggingFace(Lightricks/LTX-2)で公開されており、セルフホストが可能です。ライセンスは比較的寛容で、年間経常収益が$10 million未満の組織は、商用利用を含めて無料でモデルを利用できます。それ以上の組織は商用ライセンスについて交渉が必要です。
初期ユーザーの評価:速度は好評、品質は慎重論も
初期のRedditスレッドを見ると、生成速度を歓迎する声と、画質向上に慎重な見方の両方があります。
あるComfyUIテスターは、大幅な高速化を報告しています。
"It was 400% faster." - LTX-2.3とLTX-2.5のテキストから動画生成を比較(u/xdcfret1, r/comfyui)
同じユーザーは、以前のバージョンより出力がシャープになり、音声と映像の同期も改善したと評価しました。ただし物理表現の問題は残っており、デモ動画では最初の6秒以降、ライダーが後ろ向きに動いているように見えたと指摘しています。評価は「solid update」ながら、「still much more to do」というものでした。
一方、r/StableDiffusionには、並べて比較したうえでより批判的な投稿もあります。
"I can barely see the difference between 2.3 and 2.5." - u/PuppetHere、r/StableDiffusion
ただし、そのスレッドのコメント欄では反論もありました。2.5のクリップではリップシンク、音声の明瞭さ、顔の動きの自然さが改善しているという意見です。あるユーザーはLTX-2.3の音を「an extremely low-bitrate MP3」のようだと表現しました。共有されたデモ動画からは、話者を正面から映す場面やクローズアップでは改善が目立つ一方、複雑な物理的インタラクションは依然として安定しないという見方も出ています。
実務上の注意点として、LoRAとワークフローの互換性はまだ不透明です。LTX-2.3向けのLoRAやIC-LoRAの一部は2.5でも動作しますが、結果にはばらつきがあります(r/StableDiffusionの議論)。同じスレッドでは、15回生成しても使える結果が1つも出なかったという報告もありました。ComfyUIでは、完全にアップデートしないとGemmaAPITextEncodeやLTXFloatToIntなどのノード不足エラーが起こるケースがあります。
競合動画APIと比べたLTX-2.5のコスト
LTXのローンチ資料には、720p時の秒単価で動画モデルを並べた比較表があります。LTX-2.5 Fastは全体で2番目に安く、この価格帯で唯一のオープンウェイトモデルです。
| モデル | 1秒あたり(720p) | 10秒クリップあたり | 主な特徴 |
|---|---|---|---|
| Veo 3.1 Lite(Google) | $0.05 | $0.50 | 最安価格。4Kとクリップ延長には非対応 |
| LTX-2.5 Fast(Lightricks) | $0.09 | $0.90 | 唯一のオープンウェイト選択肢。4Kは$0.30/秒まで対応 |
| Veo 3.1 Fast(Google) | $0.10 | $1.00 | 4K対応のクローズドソースモデルでは最安($0.30/秒) |
| Gemini Omni Flash(Google) | $0.10 | $1.00 | Artificial Analysisで最高評価の画質。720pのみ、最大10秒 |
| LTX-2.5 Pro(Lightricks) | $0.12 | $1.20 | 高品質なテクスチャ・文字表現。最大1080p |
| FLUX 3 Video(Black Forest Labs) | $0.17 | $1.70 | 音声付きで20秒クリップに対応。draft tierは$0.06/秒 |
| Veo 3.1(Google) | $0.40 | $4.00 | プレミアムtier。Liteの8倍の価格 |
オープンウェイト、または4Kが必要ならLTX-2.5 Fast、ホスト型APIで720pの最安コストを優先するならVeo 3.1 Liteが適しています。
より広い比較については、LTX-2.3とMiniMax H3の比較分析、および2026年版・無料AI動画生成ツールのまとめも参照してください。
よくある質問
LTX-2.5はホスト型APIで利用できますか?
はい。ltx-2-5-fastとltx-2-5-proはどちらも、同期エンドポイント(v1/)と非同期エンドポイント(v2/)で利用可能です。エンドポイントの詳細は上記の利用方法を確認してください。
LTX-2.3のLoRAやワークフローをLTX-2.5で再利用できますか?
一部は可能です。2.3向けのLoRAやIC-LoRAの一部は2.5でも結果を出せますが、品質には差があり、ワークフローによってはComfyUIノードの更新が必要です。上記のユーザーフィードバックも参照してください。
LTX-2.5は商用利用も無料ですか?
年間経常収益が$10 million未満の組織は、オープンウェイトモデルを商用利用も含めて無料で使用できます。それ以上の組織は、Lightricksと商用ライセンスを交渉する必要があります。
LTX-2.5をセルフホストするにはどのGPUが必要ですか?
LTXのベンチマークでは、720p生成を6.8秒で行うために2× NVIDIA GB200を使用しています。4K出力やより長いクリップでは、大幅に多いVRAMが必要です。LTX-2ファミリーには必要要件を抑えられるFP8・FP4量子化バリアントがHuggingFaceで用意されていますが、2.5に特化した公式の最小VRAM仕様は公開されていません。