본문으로 건너뛰기

LTX-2.5: 6.8초 오픈 AI 영상

Darius Z. 작성자: Darius Z. 8 분 읽기
LTX-2.5 오픈 가중치 AI 영상 모델 출시를 상징하는 GPU 하드웨어와 비디오 타임라인이 표시된 모니터

제휴 링크 포함

Lightricks의 오픈 가중치 영상·월드 모델 LTX-2.5가 8월 11일 공개되었습니다. NVIDIA 하드웨어에서 720p 10초 클립을 6.8초 만에 생성한다는 속도는 폐쇄형 경쟁 모델의 기록에 도전하는 수준입니다. 연매출 $1,000만 미만 조직은 무료로 사용할 수 있으며, 출시 당일부터 ComfyUI(컴피UI)와 네이티브 연동됩니다. LTX 모델 패밀리는 이미 누적 3,300만 회 이상 다운로드되었습니다.

핵심 요약

  • NVIDIA GB200 칩에서 10초 영상을 6.8초 만에 생성 — 실시간 재생보다 빠른 속도
  • Hugging Face에 오픈 가중치 공개, 연매출 $10M 미만 조직은 무료 사용
  • ComfyUI 네이티브 연동: 텍스트·이미지·멀티샷 워크플로우 출시 당일 지원
  • 네이티브 멀티샷 생성으로 컷 전환마다 캐릭터·장면·음성 일관성 유지
  • 관리형 API 기준 10초 클립당 $0.90 — 대부분의 폐쇄형 경쟁사보다 저렴

AI 영상 생성기 비교하기

Kling AI(클링 AI)와 오픈소스 대안을 속도·품질·가격 기준으로 비교해 보세요.

Kling AI 리뷰 읽기 →

LTX-2.5가 제공하는 것

LTX는 기존 LTX-2.3 코어에 기능을 덧붙이는 방식이 아니라, 생성 파이프라인 거의 전 단계를 재설계했습니다. 이번 릴리스를 정의하는 구조적 변화는 다섯 가지입니다.

Diffusion Video Decoder는 고속 모션 구간의 아티팩트를 줄이고, 텍스트·얼굴 디테일 같은 미세 요소를 모델 압축률을 희생하지 않고 복원합니다. 이전 LTX 버전이 빠른 카메라 이동에서 취약했던 반면, 이번 디코더는 장면 복잡도에 따라 렌더링 연산을 배분합니다.

네이티브 멀티샷 생성은 전체 시퀀스를 단일 출력으로 만듭니다. 캐릭터, 환경, 조명, 음성이 컷 전환 후에도 일관되게 유지되므로, 후반 스티칭이 필요 없습니다. 숏폼 콘텐츠나 스토리보드를 만드는 크리에이터에게는 샷별 생성에서 흔히 발생하는 연속성 문제를 해결해 줍니다.

커스텀 Gemma 4 언어 백본과 전용 프롬프트 인핸서가 복잡한 다중 캐릭터 프롬프트를 더 정확하게 처리합니다. LTX에 따르면, 프롬프트 인핸서는 전작 대비 긴 상세 설명 준수율이 크게 개선되었습니다.

모델에는 물리 AI·로보틱스용 사전 학습 체크포인트도 포함되어, 팀이 도메인 데이터로 파인튜닝할 기반을 제공합니다. 증류 버전은 비용과 추론 시간을 줄이면서 거의 동급 품질을 내며, NVIDIA RTX GPU에 맞춰 VRAM 요구량을 낮췄습니다.

6.8s 생성 속도 (10초 클립, 셀프호스팅)
$0.90 API 비용 (10초 클립, Fast 티어)
33M+ 누적 다운로드 (최다 사용 모델)
16 GB 최소 VRAM (소비자용 RTX GPU)

실제 속도는 어느 정도인가

6.8초라는 수치에는 맥락이 필요합니다. LTX는 NVIDIA GB200 슈퍼칩 2개에서 안정 상태(steady state)로 측정한 값으로, 독립 크리에이터 대부분이 접근하기 어려운 하드웨어입니다. LTX 관리형 API로 같은 10초 클립을 1080p로 생성하면 23.7초가 걸렸습니다.

그래도 두 수치 모두 경쟁사 대비 큰 격차를 보여 줍니다. LTX가 동일한 이미지-투-영상 작업에서 측정한 경쟁 API 엔드투엔드 시간은 Google Gemini Omni Flash 52초, Veo 3.1 70초, MiniMax H3 180초, ByteDance Seedance 2.5(시댄스) 317초, Kuaishou Kling AI(클링 AI) 3.0 Pro 398초였습니다.

AI 영상 생성 비용 비교: 10초 720p 클립 + 오디오 (2026년 8월)

모델 클립당 비용 핵심 장점
Veo 3.1 Lite (Google) $0.50 폐쇄형 API 중 최저가
LTX-2.5 Fast (Lightricks) $0.90 유일한 오픈 가중치 모델; $10M 미만 셀프호스팅 무료
Veo 3.1 Fast (Google) $1.00 폐쇄형 API로 4K에 가장 저렴한 경로
Gemini Omni Flash (Google) $1.00 독립 아레나 기준 품질 선두
FLUX 3 Video (Black Forest Labs) $1.70 20초 오디오 클립 최초 출시
HappyHorse 1.0 (Alibaba) $1.82 아레나 품질 점수 우수
Veo 3.1 Premium (Google) $4.00 단일 생성 이후 클립 연장 지원 유일

품질 측면에서 LTX는 벤더 주도 맹평가에서 67% 선호율을 공개했으며, Seedance 2.5 65%, Gemini Omni Flash 55%보다 앞섰다고 밝혔습니다. 다만 이 결과는 독립 검증을 거치지 않았습니다. 중립적 벤치마크에 가장 가까운 Artificial Analysis 텍스트-투-비디오 아레나는 현재 Gemini Omni Flash를 1위로 두고 있으며, LTX-2.5는 아직 점수가 없습니다.

ComfyUI 파트너십

LTX가 ComfyUI를 출시 플랫폼으로 선택한 데는 이유가 있습니다. 2023년 오픈소스 Stable Diffusion 프론트엔드로 시작한 노드 기반 워크플로 도구는, 새로운 생성형 미디어 모델을 테스트·배포하는 사실상의 표준 환경이 되었습니다. Comfy Org는 $1,700만을 유치했고, 오픈 AI 크리에이티브 도구 생태계의 프로토타이핑 레이어 역할을 합니다.

출시일 연동으로 Text-to-Video, Image-to-Video, First/Last-Frame-to-Video 세 가지 워크플로 템플릿이 즉시 제공됩니다. 가중치를 내려받아 로컬에서 실행하거나, LTX API 노드로 클라우드 생성을 GPU 없이도 사용할 수 있습니다.

LTX CEO Zeev Farbman은 전략을 이렇게 설명했습니다. ‘많은 고객이 Comfy에서 여정을 시작하기 때문에, 출시일 지원은 사실상 고객 확보 채널입니다.’

정보:

LTX-2.5 가중치는 Hugging Face 게이트 저장소에 호스팅됩니다. 다운로드 전 라이선스에 동의하고 접근 승인을 기다려야 합니다. 로컬 추론에는 최소 16GB VRAM이 필요합니다.

오픈 가중치 전략

LTX 라이선스 모델은 완전 오픈소스와 폐쇄형 API 사이에 위치합니다. LTX-2.x Community License는 연매출 $1,000만 미만 조직이 모델을 무료로 사용·수정·셀프호스팅·서브라이선스할 수 있게 합니다. 더 큰 기업은 유료 라이선스를 협의합니다. 임계값을 넘더라도 비프로덕션 환경에서의 평가는 무료입니다.

Farbman은 업계의 폐쇄 API 추세에 맞서 이렇게 말했습니다. ‘Sora가 나올 무렵, 대형 업체들이 모델을 닫는다는 걸 깨달았습니다. API만으로는 많은 비즈니스에 맞지 않습니다.’ 영상 모델은 언어 모델보다 사용 사례 폭이 넓어, 커스터마이징을 위해 가중치 접근이 더 중요하다는 논리입니다.

개방성에는 한계도 있습니다. 라이선스는 파인튜닝 체크포인트·LoRA 어댑터뿐 아니라 증류 모델, LTX-2.5 합성 출력으로 학습한 모델까지 파생물로 간주합니다. LTX-2.5로 학습 데이터를 생성해 별도 모델을 만든 회사도 라이선스 정의상 동일 계약에 묶입니다.

Kling AI 영상 생성 체험하기

네이티브 4K 출력, 모션 컨트롤, 멀티샷 시퀀스로 AI 영상을 생성하세요. 무료 플랜으로 시작할 수 있습니다.

Kling AI 무료 체험 →

시장에 미치는 영향

LTX-2.5는 1월 NVIDIA RTX·LTX-2 보도 이후 급변한 시장에 등장했습니다. 오픈 가중치 AI 영상 분야에는 속도에서 경쟁하고 품질은 폐쇄형에 근접하면서, 대부분의 독립 크리에이터에게 무료인 모델이 생겼습니다.

이번 출시는 NVIDIA 8월 ‘로컬 AI’ 스포트라이트의 일부로, Nemotron 3.5 Lightning 에이전트 모델과 함께 공개되었습니다. 공통 메시지는 로컬에서 돌아가는 오픈 모델이 타협안이 아니라 기본 프로덕션 인프라가 되고 있다는 점입니다.

폐쇄형 플랫폼에서 클립당 요금을 내는 크리에이터라면, 하드웨어가 있다면 LTX-2.5가 명확한 대안이 됩니다. 로컬 GPU가 없다면 클립당 $0.90의 관리형 API가 Google Veo 3.1 Lite 다음으로 저렴한 선택지입니다. 국내에서는 유튜브 쇼츠·틱톡·네이버 클립 등 숏폼 채널을 운영하는 1인 크리에이터와 스튜디오가 RTX 워크스테이션으로 셀프호스팅하면 API 비용 없이 반복 테스트·A/B 제작이 가능해집니다.

경쟁사의 대응도 주목할 만합니다. 최근 네이티브 4K 생성과 멀티샷 기능을 낸 Kling AI는 LTX 벤치마크에서 동일 작업에 398초가 걸렸습니다. LTX는 프리미엄 하드웨어에서 7초 미만이었죠. 이 속도 격차가 실제 채택으로 이어질지는 품질 일관성에 달려 있으며, 독립 벤치마크는 아직 확인되지 않았습니다.

자주 묻는 질문

LTX-2.5는 무료로 사용할 수 있나요?

연간 반복 매출(ARR) $1,000만 미만 조직은 무료입니다. Hugging Face에서 오픈 가중치를 내려받아 자체 하드웨어에 호스팅하고, 라이선스 비용 없이 상업적으로 사용할 수 있습니다. 임계값을 넘는 조직은 Lightricks와 유료 라이선스를 협의해야 합니다.

LTX-2.5 생성 속도, 클링 AI·시댄스와 비교하면?

LTX는 NVIDIA GB200 하드웨어에서 10초 클립을 6.8초 만에 생성한다고 주장합니다. 동일 이미지-투-영상 작업에서 Seedance 2.5(시댄스)는 317초, Kling AI(클링 AI) 3.0 Pro는 398초였습니다. 관리형 API로는 1080p 동일 클립 생성에 23.7초가 걸렸습니다.

ComfyUI에서 LTX-2.5를 어떻게 실행하나요?

ComfyUI를 최신 버전으로 업데이트하고, Hugging Face의 게이트 저장소 Lightricks/LTX-2.5 접근을 신청한 뒤 라이선스에 동의하고 모델 파일을 ComfyUI models 디렉터리에 넣으면 됩니다. Text-to-Video, Image-to-Video, First/Last-Frame-to-Video 템플릿 세 가지를 즉시 사용할 수 있으며, 최소 16GB VRAM이 필요합니다.

오픈 가중치 AI 영상 모델이란 무엇인가요?

학습된 파라미터를 공개해 누구나 내려받아 로컬 실행·파인튜닝할 수 있는 모델입니다. 사용 제한이 없는 오픈소스와 달리, LTX-2.5처럼 커스텀 라이선스가 매출 임계값 이상의 상업 이용을 제한하거나 파생물 의무를 정의할 수 있습니다.

LTX-2.5는 오디오가 포함된 영상을 생성할 수 있나요?

가능합니다. LTX-2.5는 동기화된 영상과 오디오를 한 번에 생성합니다. 멀티샷 기능은 컷 전환 후에도 음성 일관성을 유지해, 내러티브 시퀀스와 숏폼 제작에 적합합니다.

한국 크리에이터에게 LTX-2.5 셀프호스팅이 실용적인가요?

RTX 4090·5090급 GPU(16GB VRAM 이상)가 있는 1인 크리에이터나 소형 스튜디오라면 실용적입니다. 유튜브 쇼츠·틱톡·네이버 클립용 반복 테스트를 API 비용 없이 로컬에서 돌릴 수 있어, 클립당 과금형 폐쇄 플랫폼보다 월간 제작량이 많을수록 유리합니다. GPU가 없다면 관리형 API($0.90/10초)가 대안입니다.

출처

  1. LTX-2.5 can generate a 10-second AI video in just 6.8 seconds on Nvidia superchips - VentureBeat, 2026년 8월 11일
  2. The Video Production Stack Now Fits on One Desk: LTX-2.5 Launches - MarkTechPost, 2026년 8월 11일
  3. LTX-2.5 Targets Real-Time Video Generation - Open Source For You, 2026년 8월 12일
  4. LTX-2.5 ComfyUI Documentation - ComfyUI Docs
  5. Lightricks/LTX-2.5 Model Repository - Hugging Face

이 글이 도움이 되셨나요?

0:00