LTX-2.5 : générateur vidéo IA en 6,8 secondes
Contient des liens d'affiliation
LTX-2.5, le modèle vidéo et modèle de monde à poids ouverts de Lightricks, a été lancé le 11 août avec une promesse de vitesse qui défie tous les concurrents fermés : un clip de 10 secondes en 720p généré en 6,8 secondes sur du matériel NVIDIA. Le modèle est gratuit pour les organisations de moins de 10 millions de dollars de chiffre d’affaires annuel, s’intègre nativement à ComfyUI dès le jour J, et la famille LTX dépasse déjà les 33 millions de téléchargements.
Points Clés
- Génère une vidéo de 10 secondes en 6,8 secondes sur des puces NVIDIA GB200, plus vite que la lecture en temps réel
- Poids ouverts sur Hugging Face, gratuit pour les organisations de moins de 10 M$ de chiffre d'affaires annuel
- Intégration ComfyUI native dès le lancement avec workflows texte vers vidéo, image vers vidéo et multishot
- La génération multishot native maintient personnages, scènes et voix cohérents d'un plan à l'autre
- Coûte 0,90 $ par clip de 10 secondes via l'API managée, moins cher que la plupart des rivaux fermés
Comparer les générateurs vidéo IA
Découvrez comment Kling AI se positionne face aux alternatives open source en vitesse, qualité et tarification.
Lire l'avis Kling AI →Ce qu’apporte LTX-2.5
Lightricks a reconstruit presque chaque étape de son pipeline de génération plutôt que d’empiler des fonctionnalités sur le socle LTX-2.3. Cinq changements structurels définissent cette version.
Un Diffusion Video Decoder réduit les artefacts sur les plans à fort mouvement et reconstruit les détails fins — texte, traits du visage — sans sacrifier le taux de compression du modèle. Les versions précédentes de LTX peinaient sur les mouvements de caméra rapides ; ce décodeur alloue la puissance de rendu en fonction de la complexité de la scène.
La génération multishot native produit une séquence complète en une seule sortie. Personnages, environnements, éclairage et voix restent cohérents d’un plan à l’autre, sans montage post-production. Pour les créateurs de contenus courts ou de storyboards, cela élimine le problème de continuité qui plombe la génération plan par plan.
Un backbone linguistique Gemma 4 sur mesure et un prompt enhancer dédié traitent les prompts multi-personnages complexes avec plus de précision. Lightricks affirme que le prompt enhancer respecte nettement mieux les descriptions longues et détaillées que son prédécesseur.
Le modèle inclut aussi un checkpoint préentraîné pour l’IA physique et la robotique, offrant une base pour le fine-tuning sur des données métier. Une version distillée conserve une qualité quasi complète à moindre coût et avec un temps d’inférence réduit, optimisée pour les GPU NVIDIA RTX avec des besoins VRAM allégés.
Quelle vitesse en conditions réelles ?
Le chiffre de 6,8 secondes appelle du contexte. Lightricks a mesuré cette vitesse sur deux superpuces NVIDIA GB200 en régime stable — du matériel que la plupart des créateurs indépendants n’auront jamais entre les mains. Via l’API managée de LTX, le même clip de 10 secondes a demandé 23,7 secondes en 1080p.
Les deux chiffres restent néanmoins nettement en avance sur la concurrence. Les mesures bout en bout de LTX sur des API rivales pour la même tâche image vers vidéo donnent Gemini Omni Flash de Google à 52 secondes, Veo 3.1 à 70 secondes, MiniMax H3 à 180 secondes, Seedance 2.5 de ByteDance à 317 secondes, et Kling AI 3.0 Pro de Kuaishou à 398 secondes.
Comparatif des coûts de génération vidéo IA : clip de 10 secondes en 720p avec audio (août 2026)
| Modèle | Coût par clip | Atout principal |
|---|---|---|
| Veo 3.1 Lite (Google) | $0.50 | Tarif API fermée le moins cher |
| LTX-2.5 Fast (Lightricks) | $0.90 | Seul modèle à poids ouverts ; auto-hébergement gratuit sous 10 M$ |
| Veo 3.1 Fast (Google) | $1.00 | Chemin le moins cher vers la 4K via API fermée |
| Gemini Omni Flash (Google) | $1.00 | Leader qualité dans les arènes indépendantes |
| FLUX 3 Video (Black Forest Labs) | $1.70 | Premier à proposer des clips de 20 secondes avec audio |
| HappyHorse 1.0 (Alibaba) | $1.82 | Scores qualité solides en arène |
| Veo 3.1 Premium (Google) | $4.00 | Seul modèle avec extension de clip au-delà d'une génération unique |
Côté qualité, Lightricks a partagé des tests de préférence en aveugle — chiffres éditeur — montrant un taux de victoire de 67 %, devant Seedance 2.5 à 65 % et Gemini Omni Flash à 55 %. Ces résultats ne sont pas vérifiés de façon indépendante. L’arène texte-vers-vidéo d’Artificial Analysis, le benchmark le plus neutre disponible, classe actuellement Gemini Omni Flash en tête et n’a pas encore noté LTX-2.5.
Le partenariat ComfyUI
Lightricks a choisi ComfyUI comme plateforme de lancement pour une raison précise. Cet outil de workflow par nœuds, né en 2023 comme interface open source pour Stable Diffusion, est devenu l’environnement de référence pour tester et déployer les nouveaux modèles de médias génératifs. Comfy Org a levé 17 millions de dollars et sert aujourd’hui de couche de prototypage pour une large part de l’écosystème open source de l’IA créative.
L’intégration dès le jour J signifie que trois modèles de workflow sont disponibles immédiatement : Text-to-Video, Image-to-Video et First/Last-Frame-to-Video. Les créateurs peuvent exécuter le modèle en local avec les poids téléchargés ou utiliser les nœuds API LTX pour une génération cloud sans GPU local.
Zeev Farbman, PDG de Lightricks, a été direct sur la stratégie : « Une grande partie de nos clients commence leur parcours dans Comfy, donc le support dès le jour zéro est en pratique notre canal d’acquisition. »
Les poids LTX-2.5 sont hébergés dans un dépôt Hugging Face protégé. Vous devez accepter la licence et attendre l’approbation d’accès avant de télécharger. Le modèle requiert au minimum 16 Go de VRAM pour l’inférence locale.
Le pari des poids ouverts
Le modèle de licence de LTX se situe entre l’open source complet et l’API fermée. La LTX-2.x Community License autorise gratuitement les organisations de moins de 10 millions de dollars de chiffre d’affaires annuel à utiliser, modifier, auto-héberger et sous-licencier le modèle. Les entreprises plus grandes négocient une licence payante. Même au-delà du seuil, l’évaluation en environnement non production reste gratuite.
Farbman a cadré la stratégie face à la tendance du secteur vers les API fermées : « Vers l’époque de Sora, nous avons compris que tous les grands acteurs ferment leurs modèles. Passer par des API ne convient tout simplement pas à beaucoup d’entreprises. » Son argument : les modèles vidéo couvrent un spectre d’usages bien plus large que les modèles de langage, ce qui rend l’accès aux poids crucial pour la personnalisation.
Pour les studios d’animation et les agences créatives françaises — de la publicité au motion design —, l’auto-hébergement local ouvre une voie pour produire des contenus sans dépendre d’API cloud soumises à des quotas et à une facturation à la minute.
L’ouverture a des limites. La licence englobe non seulement les checkpoints fine-tunés et les adaptateurs LoRA, mais aussi les distillations et tout modèle entraîné sur les sorties synthétiques de LTX-2.5. Une entreprise qui génère des données d’entraînement avec LTX-2.5 pour entraîner un modèle séparé a, selon la définition de la licence, créé une œuvre dérivée soumise au même accord.
Essayer la génération vidéo Kling AI
Générez des vidéos IA en 4K native, avec contrôle du mouvement et séquences multi-plans. Commencez avec l'offre gratuite.
Essayer Kling AI gratuitement →Où cela place le marché
LTX-2.5 arrive sur un marché qui a basculé rapidement depuis notre couverture de janvier sur NVIDIA RTX et LTX-2. L’espace de l’IA vidéo open source dispose désormais d’un modèle compétitif en vitesse et proche des rivaux fermés en qualité, tout en restant gratuit pour la plupart des créateurs indépendants.
La sortie s’inscrit dans le spotlight « local AI » de NVIDIA en août, aux côtés du modèle agent Nemotron 3.5 Lightning. Le message commun : les modèles ouverts exécutés en local deviennent une infrastructure de production par défaut, et non un compromis.
Pour les créateurs qui paient aujourd’hui au clip sur des plateformes fermées, LTX-2.5 offre une alternative claire s’ils disposent du matériel. Pour ceux sans GPU local, l’API managée à 0,90 $ par clip le positionne comme la deuxième option la moins chère, derrière Veo 3.1 Lite de Google.
La réponse concurrentielle mérite d’être suivie. Kling AI, qui a récemment lancé sa propre génération 4K native et des fonctionnalités multi-plans, a mis 398 secondes dans les benchmarks de LTX pour la même tâche que LTX a complétée en moins de 7 secondes sur du matériel premium. Que cet écart de vitesse se traduise en adoption par les créateurs dépendra de la cohérence qualitative, que les benchmarks indépendants n’ont pas encore confirmée.
Questions fréquentes
LTX-2.5 est-il gratuit ?
Oui, pour les organisations de moins de 10 millions de dollars de chiffre d'affaires annuel récurrent. Vous pouvez télécharger les poids ouverts sur Hugging Face, auto-héberger sur votre propre matériel et les utiliser commercialement sans frais de licence. Au-delà du seuil, les entreprises négocient une licence payante avec Lightricks.
Quelle est la vitesse de LTX-2.5 comparée à Kling AI et Seedance ?
LTX annonce 6,8 secondes pour un clip de 10 secondes sur du matériel NVIDIA GB200, contre 317 secondes pour Seedance 2.5 et 398 secondes pour Kling 3.0 Pro sur la même tâche image vers vidéo. Via son API managée, LTX-2.5 génère le même clip en 23,7 secondes en 1080p.
Comment exécuter LTX-2.5 dans ComfyUI ?
Mettez ComfyUI à jour, demandez l'accès au dépôt protégé Lightricks/LTX-2.5 sur Hugging Face, acceptez la licence et téléchargez les fichiers du modèle dans votre répertoire models de ComfyUI. Trois modèles de workflow (Text-to-Video, Image-to-Video, First/Last-Frame-to-Video) sont disponibles immédiatement. Il faut au minimum 16 Go de VRAM.
Qu'est-ce qu'un modèle vidéo IA à poids ouverts ?
Un modèle à poids ouverts publie ses paramètres entraînés publiquement, permettant à quiconque de le télécharger, l'exécuter et le fine-tuner en local. Contrairement à l'open source (sans restriction d'usage), les modèles à poids ouverts comme LTX-2.5 embarquent des licences sur mesure qui peuvent limiter l'usage commercial au-delà de certains seuils de revenus ou définir des obligations sur les œuvres dérivées.
LTX-2.5 peut-il générer des vidéos avec audio ?
Oui. LTX-2.5 produit vidéo et audio synchronisés en une seule passe. La fonction multishot maintient aussi la cohérence vocale d'un plan à l'autre, ce qui le rend adapté aux séquences narratives et à la production de contenus courts.
LTX-2.5 convient-il aux studios et agences françaises ?
Oui, pour les structures de moins de 10 M$ de chiffre d'affaires. Les agences parisiennes et les studios d'animation indépendants peuvent auto-héberger le modèle pour des campagnes publicitaires, du motion design ou des storyboards, sans facturation au clip ni dépendance à une API cloud étrangère — un avantage notable face aux tarifs des plateformes fermées.
Sources
- LTX-2.5 can generate a 10-second AI video in just 6.8 seconds on Nvidia superchips - VentureBeat, 11 août 2026
- The Video Production Stack Now Fits on One Desk: LTX-2.5 Launches - MarkTechPost, 11 août 2026
- LTX-2.5 Targets Real-Time Video Generation - Open Source For You, 12 août 2026
- LTX-2.5 ComfyUI Documentation - ComfyUI Docs
- Lightricks/LTX-2.5 Model Repository - Hugging Face