在 2× NVIDIA GB200 上通过 ComfyUI 生成一段 10 秒 720p 视频,LTX-2.5 只用了 6.8 秒,速度相比 LTX-2.3 有明显提升。不过,若通过 API 调用,新版在所有分辨率下的每秒价格都高于旧版。它的速度进步确实可观,但成本也随之上升。
LTX-2.5 到底升级了什么
Lightricks 于 2026 年 8 月 11 日发布 LTX-2.5,并通过托管 API 提供两个模型版本:Fast 和 Pro。这次最核心的技术是 Diffusion Fidelity Rendering:它会根据场景复杂度动态分配渲染步骤,而非为每一帧固定运行相同数量的步骤。LTX 表示,该机制能在不普遍牺牲画质的前提下加快生成;ComfyUI 的早期测试者也证实,速度提升相当明显。
2.5 系列还带来了原生多镜头生成,即单个输出内的镜头切换仍可保持连贯性;同时也强化了提示词遵循能力,以及纹理、人脸和文字排版的细节表现。以上均为厂商在官方模型文档中的说法,目前尚未公布独立基准测试成绩。
| 规格 | LTX-2.5 Fast | LTX-2.5 Pro |
|---|---|---|
| 最高分辨率 | 4K (3840×2160) | 1080p (1920×1080) |
| 帧率 | 24 fps、48 fps | 24 fps |
| 文生视频 | 支持 | 支持 |
| 图生视频 | 支持 | 支持 |
| 音频生视频 | 支持 | 不支持 |
| Retake / Extend / Reframe | 不支持 | 不支持 |
| 单次最长生成时长 | 约 20 秒(24/25 fps) | 约 10 秒 |
名字虽然叫 Pro,它实际反而是限制更多的版本:分辨率最高只有 1080p,不支持音频生视频,也没有编辑类操作,包括 retake、extend 和 reframe。这些端点目前仍只有 ltx-2-3-pro 可用。
按分辨率和套餐划分的 API 价格
LTX 视频生成统一按成片视频时长计费,而不是按计算分钟计费。官方定价页列出了 2.5 和 2.3 系列共四个模型 ID。对于两代都支持的每一种分辨率,LTX-2.5 的每秒单价都高于前代。
LTX-2.5 Fast 定价
| 分辨率 | 每秒价格 | 10 秒视频价格 |
|---|---|---|
| 720p (1280×720) | $0.09 | $0.90 |
| 1080p (1920×1080) | $0.13 | $1.30 |
| 1440p (2560×1440) | $0.19 | $1.90 |
| 4K (3840×2160) | $0.30 | $3.00 |
LTX-2.5 Pro 定价
| 分辨率 | 每秒价格 | 10 秒视频价格 |
|---|---|---|
| 720p (1280×720) | $0.12 | $1.20 |
| 1080p (1920×1080) | $0.17 | $1.70 |
下面将四个仍在售模型放在两种全型号均支持的分辨率下进行横向比较:
LTX-2.5 对比 LTX-2.3:旧模型何时更值得选
这里有一个颇反直觉的结论:无论分辨率还是套餐,LTX-2.3 都比 LTX-2.5 更便宜。以 720p 为例,LTX-2.3 Fast 的价格是 $0.03/秒,仅为 LTX-2.5 Fast 的 $0.09/秒的三分之一。两者在 4K 时的差距缩小至 $0.24 对 $0.30,但并未消失。
| 分辨率 | LTX-2.3 Fast | LTX-2.5 Fast | LTX-2.3 Pro | LTX-2.5 Pro |
|---|---|---|---|---|
| 720p | $0.03 | $0.09 | $0.04 | $0.12 |
| 1080p | $0.06 | $0.13 | $0.08 | $0.17 |
| 1440p | $0.12 | $0.19 | $0.16 | - |
| 4K | $0.24 | $0.30 | $0.32 | - |
相比价格,端点兼容性的差异更值得关注。只有 LTX-2.3 Pro 支持 retake(重新生成现有视频的局部)、extend(向开头或结尾补帧,计费帧数上限为 505 帧)和 reframe(改变宽高比并自动生成补充画面)。如果你的流程涉及编辑而不仅是纯生成,LTX-2.5 并不能提供替代路径,仍需使用 2.3 Pro。
| 端点 | ltx-2-5-fast | ltx-2-5-pro | ltx-2-3-fast | ltx-2-3-pro |
|---|---|---|---|---|
| 文生视频 | ✅ | ✅ | ✅ | ✅ |
| 图生视频 | ✅ | ✅ | ✅ | ✅ |
| 音频生视频 | ✅ | ❌ | ❌ | ✅ |
| Retake | ❌ | ❌ | ❌ | ✅ |
| Extend | ❌ | ❌ | ❌ | ✅ |
| Reframe | ❌ | ❌ | ❌ | ✅ |
适合选择 LTX-2.5 的场景:只需要生成视频,重视提示词遵循、纹理细节,尤其是多镜头片段。LTX-2.3 更占优的场景:需要 retake、extend、reframe 的编辑工作流,对成本敏感的大批量生成,以及 4K Pro 输出需求——2.5 Pro 最高只到 1080p,而 2.3 Pro 可达 4K。
如何使用 LTX-2.5:API、ComfyUI 与开放权重
目前有三种接入方式:
- 托管 API:在同步(
v1/)或异步(v2/)端点的 model 字段中调用ltx-2-5-fast或ltx-2-5-pro。请求格式请参阅官方 API 参考文档。文生视频和图生视频均支持同步及异步调用。2.5 Fast 的音频生视频仅支持异步调用,对应v2/audio-to-video。根据LTX 的发布材料,托管 API 输出一段 1080p、10 秒的图生视频需23.7 秒。
- ComfyUI:LTX-2.5 已原生集成到 ComfyUI,提供文生视频、图生视频和 Diffusion Fidelity Rendering 的专用节点。在 2× NVIDIA GB200 上,10 秒 720p 视频的生成时间为6.8 秒(IT之家转述的 LTX 发布基准数据)。托管 API 对一项可比任务在 1080p 输出下耗时 23.7 秒,但两者分辨率不同,不能直接比较。
- 开放权重:模型权重可从 HuggingFace (Lightricks/LTX-2) 获取并自行部署。授权条件相当宽松:年经常性收入低于 $10 million 的组织可免费使用模型,包括商业用途。规模更大的组织则需要协商商业授权。
早期用户怎么评价
两个 Reddit 早期讨论串呈现出明显分歧:一边对速度提升感到兴奋,另一边则对画质改善持保留态度。
一位 ComfyUI 测试者报告了显著的速度提升:
“它快了 400%。”——比较 LTX-2.5 与 LTX-2.3 的文生视频速度(u/xdcfret1,r/comfyui)
该用户认为,新版输出更清晰,音频与画面的对齐也优于此前版本;但物理表现问题仍然存在——其演示视频中,骑手在前六秒后似乎开始倒退移动。其评价是“扎实的更新”,但“还有很多工作要做”。
r/StableDiffusion 中一篇更为批评的帖子则采用了并排对比:
“我几乎看不出 2.3 和 2.5 的区别。”——u/PuppetHere,r/StableDiffusion
不过,该讨论串中的其他评论者并不认同这一看法。他们指出,2.5 片段的口型同步更好、音频更干净——其中一人称 LTX-2.3 听起来像“极低比特率的 MP3”——而且面部运动更自然。一些评论者认为,改进在口播和特写场景中最容易看出;从已分享的演示视频来看,复杂物理交互仍不够稳定。
还有一个实际问题:LoRA 与工作流兼容性尚不确定。部分 LTX-2.3 LoRA 和 IC-LoRA 可在 2.5 上部分运行,但结果并不稳定(r/StableDiffusion 讨论)。在同一讨论串中,有一位用户表示连续生成 15 次也没有得到可用结果。ComfyUI 用户还遇到缺失节点报错,如 GemmaAPITextEncode 和 LTXFloatToInt,需要将 ComfyUI 完整更新后才能解决。
LTX-2.5 与竞品视频 API:成本对比
LTX 的发布材料提供了一张竞品价格表,按 720p 每秒成本对视频模型进行排序。LTX-2.5 Fast 是全榜第二便宜的选项,也是其价格区间中唯一采用开放权重的模型。
| 模型 | 每秒价格(720p) | 10 秒视频价格 | 主要特点 |
|---|---|---|---|
| Veo 3.1 Lite (Google) | $0.05 | $0.50 | 价格最低;不支持 4K,也不支持片段延长 |
| LTX-2.5 Fast (Lightricks) | $0.09 | $0.90 | 唯一的开放权重选项;可扩展至 4K,价格为 $0.30/秒 |
| Veo 3.1 Fast (Google) | $0.10 | $1.00 | 成本最低的 4K 闭源方案($0.30/秒) |
| Gemini Omni Flash (Google) | $0.10 | $1.00 | Artificial Analysis 质量排名第一;仅支持 720p,最长 10 秒 |
| LTX-2.5 Pro (Lightricks) | $0.12 | $1.20 | 纹理与文字排版表现更强;最高 1080p |
| FLUX 3 Video (Black Forest Labs) | $0.17 | $1.70 | 支持带音频的 20 秒视频;草稿档价格为 $0.06/秒 |
| Veo 3.1 (Google) | $0.40 | $4.00 | 高端档位;价格是 Lite 的 8 倍 |
如果你看重开放权重或 4K,选 LTX-2.5 Fast;如果你的首要目标是最低的 720p 托管生成成本,则选 Veo 3.1 Lite。
想了解更广泛的横向对比,可参阅我们的 LTX-2.3 与 MiniMax H3 对比分析,以及 2026 年免费 AI 视频生成器汇总。
常见问题
LTX-2.5 能通过托管 API 使用吗?
可以。ltx-2-5-fast 和 ltx-2-5-pro 均已上线,支持同步(v1/)和异步(v2/)端点。端点细节请参阅上文的接入方式。
LTX-2.3 的 LoRA 和工作流可以复用到 LTX-2.5 吗?
可以部分复用。某些 2.3 LoRA 和 IC-LoRA 能在 2.5 上生成结果,但质量存在差异,部分工作流还需要更新 ComfyUI 节点。具体情况请参阅上文的用户反馈部分。
LTX-2.5 可以免费用于商业用途吗?
年经常性收入低于 $10 million 的组织,可以免费将开放权重模型用于商业用途。规模更大的组织则须与 Lightricks 协商商业授权。
自行部署 LTX-2.5 需要什么 GPU?
LTX 的基准测试使用 2× NVIDIA GB200,在 6.8 秒内生成 720p 视频。若要输出 4K 或生成更长片段,则需要显著更多的显存。HuggingFace 上的 LTX-2 系列提供 FP8 和 FP4 量化版本,可降低硬件要求;但 LTX 尚未针对 2.5 单独公布官方最低显存规格。