ComfyUI에서 NVIDIA GB200 2개를 사용하면 LTX-2.5는 10초짜리 720p 영상을 6.8초 만에 생성한다. LTX-2.3보다 확실히 빨라진 수치다. 다만 API 비용은 모든 해상도에서 이전 모델보다 초당 단가가 높다. 속도 향상은 분명하지만, 가격은 오히려 올라갔다는 점이 핵심이다.
LTX-2.5에서 달라진 점
Lightricks가 2026년 8월 11일 공개한 LTX-2.5는 호스팅 API에서 Fast와 Pro 두 가지 모델로 제공된다. 핵심 기능은 Diffusion Fidelity Rendering이다. 모든 프레임에 고정된 렌더링 단계를 적용하는 대신 장면의 복잡도에 따라 연산량을 배분하는 적응형 파이프라인이다. LTX는 이 방식으로 전반적인 품질 저하 없이 생성 속도를 높였다고 설명하며, 초기 ComfyUI 테스트에서도 큰 폭의 속도 개선이 확인되고 있다.
2.5 계열에는 단일 결과물 안에서 컷 전환 전후의 연속성을 유지하는 네이티브 멀티샷 생성도 추가됐다. 프롬프트 준수도, 질감·얼굴·타이포그래피 표현력도 강화됐다는 것이 LTX의 주장이다. 이는 공식 모델 문서 기준이며, 아직 독립적인 벤치마크 점수는 공개되지 않았다.
| 사양 | LTX-2.5 Fast | LTX-2.5 Pro |
|---|---|---|
| 최대 해상도 | 4K (3840×2160) | 1080p (1920×1080) |
| 프레임 레이트 | 24 fps, 48 fps | 24 fps |
| 텍스트-투-비디오 | 지원 | 지원 |
| 이미지-투-비디오 | 지원 | 지원 |
| 오디오-투-비디오 | 지원 | 미지원 |
| Retake / Extend / Reframe | 미지원 | 미지원 |
| 1회 최대 생성 길이 | 약 20초 (24/25 fps) | 약 10초 |
이름과 달리 Pro가 더 제한적인 모델이다. 해상도는 1080p로 제한되고, 오디오-투-비디오를 지원하지 않으며, retake·extend·reframe 같은 편집 기능도 없다. 이 엔드포인트는 계속 ltx-2-3-pro에서만 제공된다.
해상도·티어별 LTX-2.5 API 요금
LTX 비디오 생성 요금은 연산 시간 기준이 아니라 생성된 영상 길이(초) 기준으로 청구된다. 공식 가격 페이지에는 2.5와 2.3 계열을 합쳐 네 개의 모델 ID가 올라와 있다. LTX-2.5는 이전 모델과 공통으로 지원하는 모든 해상도에서 초당 가격이 더 높다.
LTX-2.5 Fast 요금
| 해상도 | 초당 요금 | 10초 클립 기준 |
|---|---|---|
| 720p (1280×720) | $0.09 | $0.90 |
| 1080p (1920×1080) | $0.13 | $1.30 |
| 1440p (2560×1440) | $0.19 | $1.90 |
| 4K (3840×2160) | $0.30 | $3.00 |
LTX-2.5 Pro 요금
| 해상도 | 초당 요금 | 10초 클립 기준 |
|---|---|---|
| 720p (1280×720) | $0.12 | $1.20 |
| 1080p (1920×1080) | $0.17 | $1.70 |
네 가지 활성 모델을 모두 이용할 수 있는 720p와 1080p 기준으로 비교하면 다음과 같다.
LTX-2.5 vs LTX-2.3: 구형 모델이 더 나은 경우
직관과 다른 결론부터 말하면, LTX-2.3는 모든 해상도와 티어에서 LTX-2.5보다 저렴하다. 720p에서 LTX-2.3 Fast는 초당 $0.03로, 초당 $0.09인 LTX-2.5 Fast의 3분의 1 가격이다. 4K에서는 $0.24와 $0.30으로 차이가 줄지만, 가격이 역전되지는 않는다.
| 해상도 | LTX-2.3 Fast | LTX-2.5 Fast | LTX-2.3 Pro | LTX-2.5 Pro |
|---|---|---|---|---|
| 720p | $0.03 | $0.09 | $0.04 | $0.12 |
| 1080p | $0.06 | $0.13 | $0.08 | $0.17 |
| 1440p | $0.12 | $0.19 | $0.16 | - |
| 4K | $0.24 | $0.30 | $0.32 | - |
가격보다 더 중요한 차이는 엔드포인트 호환성이다. 기존 영상 일부를 다시 생성하는 retake, 앞이나 뒤에 프레임을 덧붙이는 extend(청구 기준 최대 505프레임), 생성형 채우기를 활용해 화면비를 바꾸는 reframe을 모두 지원하는 모델은 LTX-2.3 Pro뿐이다. 단순 생성이 아니라 편집 워크플로를 쓰고 있다면 LTX-2.5로는 업그레이드할 수 없다. 2.3 Pro가 필요하다.
| 엔드포인트 | ltx-2-5-fast | ltx-2-5-pro | ltx-2-3-fast | ltx-2-3-pro |
|---|---|---|---|---|
| 텍스트-투-비디오 | ✅ | ✅ | ✅ | ✅ |
| 이미지-투-비디오 | ✅ | ✅ | ✅ | ✅ |
| 오디오-투-비디오 | ✅ | ❌ | ❌ | ✅ |
| Retake | ❌ | ❌ | ❌ | ✅ |
| Extend | ❌ | ❌ | ❌ | ✅ |
| Reframe | ❌ | ❌ | ❌ | ✅ |
LTX-2.5가 맞는 경우: 프롬프트 준수와 질감 디테일이 중요한 순수 생성 작업, 특히 멀티샷 클립이다. LTX-2.3가 유리한 경우: retake·extend·reframe을 쓰는 편집 작업, 비용 민감한 대량 생성, 4K Pro 출력이다. LTX-2.5 Pro는 1080p에서 멈추지만 2.3 Pro는 4K까지 지원한다.
LTX-2.5 사용 방법: API, ComfyUI, 오픈 웨이트
접근 경로는 세 가지다.
- 호스팅 API - 동기식(
v1/) 또는 비동기식(v2/) 엔드포인트의 model 필드에ltx-2-5-fast혹은ltx-2-5-pro를 지정하면 된다. 요청 형식은 공식 API 레퍼런스에서 확인할 수 있다. 텍스트-투-비디오와 이미지-투-비디오는 동기·비동기 방식을 모두 지원한다. 2.5 Fast의 오디오-투-비디오는v2/audio-to-video를 통한 비동기 방식만 가능하다. LTX 출시 자료에 따르면 관리형 API는 1080p 출력의 10초 이미지-투-비디오 클립을 23.7초에 생성했다.
- ComfyUI - LTX-2.5는 텍스트-투-비디오, 이미지-투-비디오, Diffusion Fidelity Rendering 전용 노드를 갖춘 네이티브 ComfyUI 통합을 제공한다. NVIDIA GB200 칩 2개에서는 10초 720p 클립 생성에 6.8초가 걸렸다(IT之家가 전한 LTX 출시 벤치마크). 호스팅 API는 유사한 작업을 1080p 출력에서 23.7초에 처리했지만, 해상도가 다르므로 두 수치를 직접 비교할 수는 없다.
- 오픈 웨이트 - 모델 웨이트는 HuggingFace (Lightricks/LTX-2)에서 받아 자체 호스팅할 수 있다. 라이선스 조건도 관대한 편이다. 연간 반복 매출이 $10 million 미만인 조직은 상업적 용도를 포함해 모델을 무료로 사용할 수 있다. 그보다 큰 조직은 상업 라이선스를 별도로 협의해야 한다.
초기 사용자들이 말하는 LTX-2.5
초기 Reddit 반응은 속도에 대한 기대와 품질에 대한 신중론으로 갈린다.
한 ComfyUI 테스터는 체감할 만한 속도 향상을 보고했다.
"400% 더 빨랐다." - LTX-2.3와 LTX-2.5의 텍스트-투-비디오 생성 속도 비교 (u/xdcfret1, r/comfyui)
같은 사용자는 이전 버전보다 결과물이 더 선명하고 오디오 싱크도 좋아졌다고 평가했다. 다만 물리 표현 문제는 여전히 남아 있다고 지적했다. 데모 영상에서는 6초가 지난 뒤 라이더가 뒤로 움직이는 것처럼 보였다. 평가는 “탄탄한 업데이트”이지만 “아직 할 일이 훨씬 많다”는 쪽이었다.
r/StableDiffusion의 더 비판적인 게시물은 두 버전을 나란히 비교했다.
"2.3과 2.5의 차이가 거의 보이지 않는다." - u/PuppetHere, r/StableDiffusion
하지만 해당 스레드의 다른 댓글들은 이에 반박했다. 2.5 클립에서 립싱크, 오디오 선명도, 표정 움직임이 나아졌다는 의견이다. 한 사용자는 LTX-2.3의 오디오가 “극도로 낮은 비트레이트의 MP3”처럼 들린다고 표현했다. 공유된 데모를 기준으로 개선점은 토킹 헤드와 클로즈업 장면에서 가장 잘 드러나며, 복잡한 물리적 상호작용은 여전히 신뢰하기 어렵다는 평가도 나왔다.
실무에서는 LoRA와 워크플로 호환성의 불확실성도 고려해야 한다. 일부 LTX-2.3 LoRA와 IC-LoRA는 2.5에서도 부분적으로 작동하지만, 결과는 제각각이다(r/StableDiffusion 토론). 같은 스레드에서는 한 사용자가 15회 생성에서 쓸 수 있는 결과를 하나도 얻지 못했다고 밝혔다. ComfyUI에서는 GemmaAPITextEncode, LTXFloatToInt 노드 누락 오류가 발생할 수 있으며, 이 경우 ComfyUI를 완전히 업데이트해야 한다.
경쟁 비디오 API와 비용 비교
LTX의 출시 자료에는 720p 기준 초당 비용으로 비디오 모델을 비교한 표가 포함돼 있다. LTX-2.5 Fast는 전체에서 두 번째로 저렴하며, 이 가격대에서 유일한 오픈 웨이트 모델이다.
| 모델 | 초당 요금 (720p) | 10초 클립 기준 | 핵심 차별점 |
|---|---|---|---|
| Veo 3.1 Lite (Google) | $0.05 | $0.50 | 최저가, 4K 및 클립 연장 미지원 |
| LTX-2.5 Fast (Lightricks) | $0.09 | $0.90 | 유일한 오픈 웨이트 선택지, 초당 $0.30로 4K까지 확장 |
| Veo 3.1 Fast (Google) | $0.10 | $1.00 | 가장 저렴한 4K 클로즈드 소스 경로 ($0.30/s) |
| Gemini Omni Flash (Google) | $0.10 | $1.00 | Artificial Analysis 품질 순위 최상위, 720p 전용·최대 10초 |
| LTX-2.5 Pro (Lightricks) | $0.12 | $1.20 | 고급 질감·타이포그래피, 최대 1080p |
| FLUX 3 Video (Black Forest Labs) | $0.17 | $1.70 | 오디오 포함 20초 클립, Draft 티어는 $0.06/s |
| Veo 3.1 (Google) | $0.40 | $4.00 | 프리미엄 티어, Lite 가격의 8배 |
오픈 웨이트나 4K가 중요하다면 LTX-2.5 Fast를, 720p 호스팅 생성 비용을 가장 낮추는 것이 목표라면 Veo 3.1 Lite를 선택하면 된다.
더 폭넓은 비교는 LTX-2.3 vs MiniMax H3 분석과 2026년 무료 AI 비디오 생성기 종합 비교에서 확인할 수 있다.
FAQ
LTX-2.5는 호스팅 API로 사용할 수 있나요?
가능하다. ltx-2-5-fast와 ltx-2-5-pro 모두 동기식(v1/) 및 비동기식(v2/) 엔드포인트에서 제공된다. 엔드포인트별 상세 내용은 위의 접근 방법을 참고하면 된다.
LTX-2.3 LoRA와 워크플로를 LTX-2.5에서도 재사용할 수 있나요?
부분적으로 가능하다. 일부 2.3 LoRA와 IC-LoRA는 2.5에서도 결과를 내지만 품질은 일정하지 않으며, 일부 워크플로는 ComfyUI 노드 업데이트가 필요하다. 자세한 내용은 위 사용자 반응 섹션을 참고하면 된다.
LTX-2.5는 상업적으로 무료인가요?
연간 반복 매출이 $10 million 미만인 조직은 오픈 웨이트 모델을 상업적으로도 무료 사용할 수 있다. 규모가 더 큰 조직은 Lightricks와 상업 라이선스를 협의해야 한다.
LTX-2.5를 자체 호스팅하려면 어떤 GPU가 필요한가요?
LTX의 벤치마크는 NVIDIA GB200 2개로 720p 생성에 6.8초가 걸린 조건에서 측정됐다. 4K 출력이나 더 긴 클립에는 훨씬 많은 VRAM이 필요하다. LTX-2 계열은 요구 사양을 낮추는 FP8 및 FP4 양자화 버전을 HuggingFace에서 제공하지만, LTX-2.5에 특화된 공식 최소 VRAM 사양은 아직 공개되지 않았다.