LTX-2.5: video IA open source in 6,8 secondi
LTX-2.5, il modello video e world model a pesi aperti di Lightricks, è arrivato l’11 agosto con una promessa di velocità che mette alla prova ogni rivale proprietario: un clip da 10 secondi a 720p generato in 6,8 secondi su hardware NVIDIA. Il modello è gratuito per le organizzazioni con fatturato annuo inferiore a $10 milioni, include l’integrazione ComfyUI fin dal lancio e ha già superato i 33 milioni di download nell’intera famiglia LTX.
Punti Chiave
- Genera un video da 10 secondi in 6,8 secondi su chip NVIDIA GB200, più veloce della riproduzione in tempo reale
- Pesi aperti su Hugging Face, gratis per organizzazioni con fatturato annuo inferiore a $10M
- Integrazione ComfyUI nativa fin dal lancio con workflow text-to-video, image-to-video e multishot
- La generazione multishot nativa mantiene personaggi, scene e voce coerenti tra un taglio e l'altro
- Costa $0.90 per clip da 10 secondi tramite API gestita, sotto la maggior parte dei rivali proprietari
Confronta i generatori video IA
Scopri come Kling AI si posiziona rispetto alle alternative open source per velocità, qualità e prezzo nella generazione video.
Leggi la recensione Kling AI →Cosa offre LTX-2.5
Lightricks ha ricostruito quasi ogni fase della pipeline di generazione invece di aggiungere funzionalità al core LTX-2.3. Cinque cambiamenti strutturali definiscono questo rilascio.
Un Diffusion Video Decoder riduce gli artefatti nelle scene ad alto movimento e ricostruisce dettagli fini come testo e tratti del viso senza sacrificare il rapporto di compressione del modello. Le versioni precedenti di LTX faticavano con movimenti rapidi della camera; questo decoder alloca il calcolo di rendering in base alla complessità della scena.
La generazione multishot nativa produce un’intera sequenza come output unico. Personaggi, ambienti, illuminazione e voce restano coerenti tra i tagli senza montaggio in post-produzione. Per chi produce contenuti brevi o storyboard, questo elimina il problema di continuità che affligge la generazione sequenza per sequenza.
Un backbone linguistico Gemma 4 personalizzato e un potenziatore di prompt dedicato gestiscono prompt multi-personaggio complessi con maggiore precisione. Lightricks afferma che il potenziatore di prompt migliora sensibilmente l’aderenza a descrizioni lunghe e dettagliate rispetto al predecessore.
Il modello include anche un checkpoint pre-addestrato per IA fisica e robotica, che offre alle squadre una base per il fine-tuning su dati di dominio specifico. Una versione distillata mantiene quasi la qualità completa a costo inferiore e tempi di inferenza ridotti, ottimizzata per GPU NVIDIA RTX con requisiti VRAM più contenuti.
Quanto è veloce davvero
Il dato dei 6,8 secondi va contestualizzato. Lightricks ha misurato quella velocità su due superchip NVIDIA GB200 a regime stabile, hardware che la maggior parte dei creator indipendenti non avrà mai tra le mani. Tramite l’API gestita di LTX, lo stesso clip da 10 secondi ha richiesto 23,7 secondi a risoluzione 1080p.
Entrambe le cifre restano comunque nettamente superiori alla concorrenza. Le misurazioni end-to-end di LTX sulle API rivali, con lo stesso task image-to-video, hanno registrato Google Gemini Omni Flash a 52 secondi, Veo 3.1 a 70 secondi, MiniMax H3 a 180 secondi, Seedance 2.5 di ByteDance a 317 secondi e Kling AI 3.0 Pro di Kuaishou a 398 secondi.
Confronto costi generazione video IA: clip da 10 secondi a 720p con audio (agosto 2026)
| Modello | Costo per clip | Vantaggio chiave |
|---|---|---|
| Veo 3.1 Lite (Google) | $0.50 | Tariffa API proprietaria più economica |
| LTX-2.5 Fast (Lightricks) | $0.90 | Unico modello a pesi aperti; hosting locale gratuito sotto i $10M |
| Veo 3.1 Fast (Google) | $1.00 | Percorso più economico verso il 4K via API proprietaria |
| Gemini Omni Flash (Google) | $1.00 | Leader qualitativo nelle arena indipendenti |
| FLUX 3 Video (Black Forest Labs) | $1.70 | Primo a offrire clip da 20 secondi con audio |
| HappyHorse 1.0 (Alibaba) | $1.82 | Punteggi qualità elevati nelle arena |
| Veo 3.1 Premium (Google) | $4.00 | Unico modello con estensione clip oltre la singola generazione |
Sul fronte qualità, Lightricks ha condiviso test ciechi di preferenza riportati dal produttore con un tasso di vittoria del 67%, davanti a Seedance 2.5 al 65% e Gemini Omni Flash al 55%. Questi risultati non sono verificati in modo indipendente. L’arena text-to-video di Artificial Analysis, la misura più vicina a un terreno neutrale, classifica attualmente Gemini Omni Flash al primo posto e non ha ancora valutato LTX-2.5.
La partnership con ComfyUI
LTX ha scelto ComfyUI come piattaforma di lancio per una ragione precisa. Lo strumento workflow a nodi, nato come front-end open source per Stable Diffusion nel 2023, è diventato l’ambiente standard per testare e distribuire nuovi modelli generativi. Comfy Org ha raccolto $17 milioni e oggi funge da livello di prototipazione per gran parte dell’ecosistema creativo open source basato sull’IA.
L’integrazione fin dal lancio significa tre template workflow pronti all’uso: Text-to-Video, Image-to-Video e First/Last-Frame-to-Video. I creator possono eseguire il modello in locale con i pesi scaricati oppure usare i nodi API LTX per la generazione cloud senza GPU locale.
Zeev Farbman, CEO di LTX, è stato chiaro sulla strategia: «Una buona parte dei nostri clienti inizia il percorso dentro Comfy, quindi il supporto fin dal primo giorno è di fatto il nostro canale di acquisizione clienti».
I pesi LTX-2.5 sono ospitati in un repository con accesso controllato su Hugging Face. Devi accettare la licenza e attendere l’approvazione dell’accesso prima del download. Il modello richiede almeno 16 GB di VRAM per l’inferenza locale.
La scommessa dei pesi aperti
Il modello di licenza di LTX si colloca a metà strada tra open source puro e API proprietarie. La LTX-2.x Community License consente alle organizzazioni sotto i $10 milioni di fatturato annuo di usare, modificare, ospitare in autonomia e sublicenziare il modello gratuitamente. Le aziende più grandi negoziano licenze a pagamento. Anche oltre la soglia, la valutazione in ambienti non di produzione resta gratuita.
Farbman ha inquadrato la strategia rispetto al trend del settore verso API proprietarie: «Intorno all’uscita di Sora ci siamo resi conti che tutti i grandi player stavano chiudendo i loro modelli. Lavorare solo tramite API non funziona per molte aziende.» Il suo argomento è che i modelli video coprono una superficie di casi d’uso molto più ampia rispetto ai modelli linguistici, rendendo l’accesso ai pesi più critico per la personalizzazione.
L’apertura ha dei limiti. La licenza include non solo checkpoint fine-tuned e adapter LoRA, ma anche distillazioni e qualsiasi modello addestrato sugli output sintetici di LTX-2.5. Un’azienda che genera dati di addestramento con LTX-2.5 per addestrare un modello separato ha, per definizione della licenza, creato un derivato vincolato allo stesso accordo.
Per studi di post-produzione milanesi e romani, agenzie creative e filmmaker indipendenti italiani, la soglia gratuita sotto i $10M di fatturato rende LTX-2.5 particolarmente interessante: molte realtà del settore audiovisivo nazionale rientrano nel profilo senza dover negoziare una licenza commerciale.
Prova la generazione video con Kling AI
Genera video IA con output 4K nativo, controllo del movimento e sequenze multi-shot. Inizia con il piano gratuito.
Prova Kling AI Gratis →Cosa cambia per il mercato
LTX-2.5 arriva in un mercato che si è trasformato rapidamente dalla nostra copertura di gennaio su NVIDIA RTX e LTX-2. Lo spazio video IA a pesi aperti ha ora un modello competitivo in velocità e vicino ai rivali proprietari in qualità, restando gratuito per la maggior parte dei creator indipendenti.
Il rilascio fa parte dello spotlight NVIDIA di agosto sull’IA locale, insieme al modello agente Nemotron 3.5 Lightning. Il messaggio condiviso: i modelli open eseguiti in locale stanno diventando infrastruttura di produzione predefinita, non un compromesso.
Per i creator che oggi pagano tariffe per clip su piattaforme proprietarie, LTX-2.5 offre un’alternativa chiara se hanno l’hardware necessario. Per chi non ha GPU locali, l’API gestita a $0.90 per clip lo posiziona come seconda opzione più economica dopo Veo 3.1 Lite di Google.
La risposta della concorrenza merita attenzione. Kling AI, che ha recentemente lanciato la propria generazione 4K nativa e funzionalità multi-shot, ha impiegato 398 secondi nei benchmark LTX per lo stesso task che LTX ha completato in meno di 7 secondi su hardware premium. Se quel divario di velocità si tradurrà in adozione dipende dalla coerenza qualitativa, che i benchmark indipendenti devono ancora confermare.
Domande Frequenti
LTX-2.5 è gratuito?
Sì, per organizzazioni con fatturato annuo ricorrente inferiore a $10 milioni. Puoi scaricare i pesi aperti da Hugging Face, ospitarli in autonomia su hardware proprio e usarlo commercialmente senza pagare diritti di licenza. Le organizzazioni oltre la soglia negoziano una licenza a pagamento con Lightricks.
Quanto è veloce LTX-2.5 rispetto a Kling AI e Seedance?
LTX dichiara 6,8 secondi per un clip da 10 secondi su hardware NVIDIA GB200, contro i 317 secondi di Seedance 2.5 e i 398 secondi di Kling 3.0 Pro sullo stesso task image-to-video. Tramite l'API gestita, LTX-2.5 genera lo stesso clip in 23,7 secondi a 1080p.
Come eseguo LTX-2.5 in ComfyUI?
Aggiorna ComfyUI all'ultima versione, richiedi l'accesso al repository Lightricks/LTX-2.5 con accesso controllato su Hugging Face, accetta la licenza e scarica i file del modello nella directory models di ComfyUI. Tre template workflow (Text-to-Video, Image-to-Video, First/Last-Frame-to-Video) sono disponibili subito. Servono almeno 16 GB di VRAM.
Cos'è un modello video IA a pesi aperti?
Un modello a pesi aperti pubblica i parametri addestrati, permettendo a chiunque di scaricarli, eseguirli e fare fine-tuning in locale. A differenza dell'open source (che implica assenza di restrizioni d'uso), modelli come LTX-2.5 includono licenze personalizzate che possono limitare l'uso commerciale oltre certe soglie di fatturato o definire obblighi sui lavori derivati.
LTX-2.5 può generare video con audio?
Sì. LTX-2.5 genera video e audio sincronizzati in un'unica passata. La funzione multishot mantiene anche la coerenza della voce tra i tagli, rendendolo adatto a sequenze narrative e produzione di contenuti brevi.
LTX-2.5 conviene ai creator e agenzie creative italiane?
Per la maggior parte delle realtà italiane del settore audiovisivo — studi di post-produzione, agenzie e creator indipendenti con fatturato sotto i $10M — la licenza Community è gratuita e copre l'uso commerciale. Con una GPU RTX da 16 GB o più, è possibile generare clip in locale senza costi per API, un vantaggio rilevante per chi produce contenuti social, spot e storyboard in house.
Fonti
- LTX-2.5 can generate a 10-second AI video in just 6.8 seconds on Nvidia superchips - VentureBeat, 11 agosto 2026
- The Video Production Stack Now Fits on One Desk: LTX-2.5 Launches - MarkTechPost, 11 agosto 2026
- LTX-2.5 Targets Real-Time Video Generation - Open Source For You, 12 agosto 2026
- LTX-2.5 ComfyUI Documentation - ComfyUI Docs
- Lightricks/LTX-2.5 Model Repository - Hugging Face