LTX-2.5: Vídeo IA Aberto em 6,8 Segundos
O LTX-2.5, modelo de vídeo e de mundo com pesos abertos da Lightricks, foi lançado em 11 de agosto com uma promessa de velocidade que desafia todos os rivais fechados: um clipe de 10 segundos em 720p gerado em 6,8 segundos em hardware NVIDIA. O modelo é gratuito para organizações com receita anual abaixo de US$ 10 milhões, chega com integração nativa ao ComfyUI no dia do lançamento e já ultrapassou 33 milhões de downloads em toda a família LTX.
Pontos Principais
- Gera um vídeo de 10 segundos em 6,8 segundos em chips NVIDIA GB200, mais rápido que a reprodução em tempo real
- Pesos abertos no Hugging Face, gratuito para organizações com receita anual abaixo de $10M
- Integração nativa ao ComfyUI no dia do lançamento, com fluxos texto-para-vídeo, imagem-para-vídeo e multishot
- Geração multishot nativa mantém personagens, cenas e voz consistentes entre cortes
- Custa $0,90 por clipe de 10 segundos via API gerenciada, abaixo da maioria dos rivais fechados
Compare Geradores de Vídeo IA
Veja como o Kling AI se compara a alternativas de código aberto em velocidade, qualidade e preço de geração.
Leia a Análise do Kling AI →O Que o LTX-2.5 Entrega
A Lightricks reconstruiu praticamente todas as etapas do pipeline de geração em vez de empilhar recursos sobre o núcleo antigo do LTX-2.3. Cinco mudanças estruturais definem este lançamento.
Um Diffusion Video Decoder reduz artefatos em cenas de alto movimento e reconstrói detalhes finos como texto e traços faciais sem sacrificar a taxa de compressão do modelo. Versões anteriores do LTX sofriam com câmera em movimento rápido; este decoder aloca poder de renderização conforme a complexidade da cena.
A geração multishot nativa produz uma sequência completa como saída única. Personagens, ambientes, iluminação e voz permanecem consistentes entre cortes, sem montagem posterior. Para quem produz conteúdo curto ou storyboards, isso elimina o problema de continuidade que afeta a geração tomada a tomada.
Um backbone de linguagem Gemma 4 personalizado e um aprimorador de prompts dedicado lidam com instruções complexas de múltiplos personagens com mais precisão. A Lightricks afirma que o aprimorador melhora significativamente a aderência a descrições longas e detalhadas em relação ao predecessor.
O modelo também inclui um checkpoint pré-treinado para IA física e robótica, oferecendo uma base para ajuste fino com dados de domínio específico. Uma versão destilada entrega qualidade quase plena com menor custo e tempo de inferência, otimizada para GPUs NVIDIA RTX com exigência reduzida de VRAM.
Quão Rápido É na Prática
O número de 6,8 segundos precisa de contexto. A Lightricks mediu essa velocidade em dois superchips NVIDIA GB200 em estado estável, hardware que a maioria dos criadores independentes nunca terá acesso. Pela API gerenciada da própria LTX, o mesmo clipe de 10 segundos levou 23,7 segundos em resolução 1080p.
Mesmo assim, ambas as cifras representam uma vantagem relevante sobre a concorrência. Medições de ponta a ponta da LTX em APIs rivais na mesma tarefa imagem-para-vídeo mostraram o Gemini Omni Flash do Google em 52 segundos, o Veo 3.1 em 70 segundos, o MiniMax H3 em 180 segundos, o Seedance 2.5 da ByteDance em 317 segundos e o Kling AI 3.0 Pro em 398 segundos.
Comparativo de custo de geração de vídeo IA: clipe de 10 segundos em 720p com áudio (agosto de 2026)
| Modelo | Custo por Clipe | Principal Vantagem |
|---|---|---|
| Veo 3.1 Lite (Google) | $0,50 | Taxa de API fechada mais barata |
| LTX-2.5 Fast (Lightricks) | $0,90 | Único modelo com pesos abertos; auto-hospedagem grátis abaixo de $10M |
| Veo 3.1 Fast (Google) | $1,00 | Caminho mais barato para 4K via API fechada |
| Gemini Omni Flash (Google) | $1,00 | Líder de qualidade em arenas independentes |
| FLUX 3 Video (Black Forest Labs) | $1,70 | Primeiro a entregar clipes de 20 segundos com áudio |
| HappyHorse 1.0 (Alibaba) | $1,82 | Pontuações fortes em arenas de qualidade |
| Veo 3.1 Premium (Google) | $4,00 | Único modelo com extensão de clipe além de uma geração |
Em qualidade, a LTX compartilhou testes cegos de preferência reportados pelo fornecedor com taxa de vitória de 67%, à frente do Seedance 2.5 com 65% e do Gemini Omni Flash com 55%. Esses resultados não foram verificados de forma independente. A arena texto-para-vídeo da Artificial Analysis, o terreno mais neutro disponível, ainda classifica o Gemini Omni Flash em primeiro e ainda não pontua o LTX-2.5.
A Parceria com o ComfyUI
A LTX escolheu o ComfyUI como plataforma de lançamento por um motivo claro. A ferramenta de fluxo de trabalho baseada em nós, que começou como front-end de código aberto para Stable Diffusion em 2023, virou o ambiente padrão para testar e implantar novos modelos generativos. A Comfy Org levantou US$ 17 milhões e hoje funciona como camada de prototipagem de boa parte do ecossistema aberto de ferramentas criativas com IA.
A integração no dia do lançamento traz três templates de fluxo prontos: texto-para-vídeo, imagem-para-vídeo e primeiro/último frame para vídeo. Criadores podem rodar o modelo localmente com pesos baixados ou usar nós da API LTX para geração na nuvem sem GPU local.
O CEO da LTX, Zeev Farbman, foi direto sobre a estratégia: ‘Grande parte dos nossos clientes começa a jornada dentro do Comfy, então suporte no dia zero é, na prática, nosso canal de aquisição.’
Os pesos do LTX-2.5 ficam em um repositório restrito no Hugging Face. É preciso aceitar a licença e aguardar aprovação de acesso antes de baixar. O modelo exige pelo menos 16 GB de VRAM para inferência local.
A Aposta nos Pesos Abertos
O modelo de licenciamento da LTX fica entre código aberto completo e API fechada. A LTX-2.x Community License permite que organizações com receita anual abaixo de US$ 10 milhões usem, modifiquem, auto-hospedem e sublicenciem o modelo gratuitamente. Empresas maiores negociam licenças pagas. Mesmo acima do limite, avaliação em ambientes não produtivos continua gratuita.
Farbman enquadrou a estratégia contra a tendência do setor de fechar APIs: ‘Por volta do lançamento do Sora, percebemos que todos os grandes players estavam fechando seus modelos. Trabalhar só via APIs simplesmente não funciona para muitas empresas.’ O argumento dele é que modelos de vídeo têm uma superfície de casos de uso muito mais ampla que modelos de linguagem, tornando o acesso aos pesos mais crítico para personalização.
A abertura tem limites. A licença abrange não só checkpoints fine-tuned e adaptadores LoRA, mas também destilações e qualquer modelo treinado com saídas sintéticas do LTX-2.5. Uma empresa que gera dados de treinamento com o LTX-2.5 para treinar outro modelo, pela definição da licença, criou um derivado sujeito ao mesmo acordo.
Experimente a Geração de Vídeo com Kling AI
Gere vídeos IA com saída 4K nativa, controle de movimento e sequências multishot. Comece com o plano gratuito.
Teste o Kling AI Grátis →O Que Isso Significa para o Mercado
O LTX-2.5 chega em um mercado que mudou rápido desde nossa cobertura de janeiro sobre NVIDIA RTX e LTX-2. O espaço de IA de vídeo com pesos abertos agora tem um modelo que compete em velocidade e se aproxima dos rivais fechados em qualidade, permanecendo gratuito para a maioria dos criadores independentes.
O lançamento faz parte do destaque de ‘IA local’ da NVIDIA em agosto, ao lado do modelo de agente Nemotron 3.5 Lightning. A mensagem compartilhada: modelos abertos rodando localmente estão virando infraestrutura de produção padrão, não um plano B.
Para criadores que hoje pagam por clipe em plataformas fechadas — incluindo canais do YouTube Brasil e produtoras de conteúdo curto —, o LTX-2.5 oferece alternativa clara se houver hardware disponível. Para quem não tem GPU local, a API gerenciada a $0,90 por clipe o posiciona como a segunda opção mais barata, atrás apenas do Veo 3.1 Lite do Google.
A resposta da concorrência vale a pena acompanhar. O Kling AI, que recentemente lançou geração nativa em 4K e recursos multishot, levou 398 segundos nos benchmarks da LTX na mesma tarefa que o LTX completou em menos de 7 segundos em hardware premium. Se essa diferença de velocidade se traduz em adoção depende da consistência de qualidade, ainda não confirmada por benchmarks independentes.
Perguntas Frequentes
O LTX-2.5 é gratuito para usar?
Sim, para organizações com receita anual recorrente abaixo de US$ 10 milhões. Você pode baixar os pesos abertos no Hugging Face, auto-hospedar no seu hardware e usar comercialmente sem pagar taxas de licenciamento. Organizações acima desse limite negociam licença paga com a Lightricks.
Quão rápido é o LTX-2.5 comparado ao Kling AI e ao Seedance?
A LTX afirma 6,8 segundos para um clipe de 10 segundos em hardware NVIDIA GB200, contra 317 segundos do Seedance 2.5 e 398 segundos do Kling 3.0 Pro na mesma tarefa imagem-para-vídeo. Pela API gerenciada, o LTX-2.5 gera o mesmo clipe em 23,7 segundos em 1080p.
Como rodar o LTX-2.5 no ComfyUI?
Atualize o ComfyUI para a versão mais recente, solicite acesso ao repositório restrito Lightricks/LTX-2.5 no Hugging Face, aceite a licença e baixe os arquivos do modelo para o diretório de modelos do ComfyUI. Três templates de fluxo (texto-para-vídeo, imagem-para-vídeo e primeiro/último frame para vídeo) estão disponíveis imediatamente. São necessários pelo menos 16 GB de VRAM.
O que é um modelo de vídeo IA com pesos abertos?
Um modelo com pesos abertos publica seus parâmetros treinados publicamente, permitindo que qualquer pessoa baixe, execute e faça ajuste fino localmente. Diferente de código aberto (que implica ausência de restrições de uso), modelos como o LTX-2.5 vêm com licenças personalizadas que podem restringir uso comercial acima de certos limites de receita ou definir obrigações sobre obras derivadas.
O LTX-2.5 gera vídeos com áudio?
Sim. O LTX-2.5 gera vídeo e áudio sincronizados em uma única passagem. O recurso multishot também mantém consistência de voz entre cortes, o que o torna adequado para sequências narrativas e produção de conteúdo curto.
Vale a pena para criadores brasileiros rodar o LTX-2.5 localmente?
Para criadores no Brasil, a auto-hospedagem pode compensar: APIs internacionais cobram em dólar e o câmbio encarece cada clipe. Com uma RTX 4090 ou superior (16 GB de VRAM), é possível gerar vídeos sem depender de serviços na nuvem. Comunidades brasileiras de ComfyUI no Discord e Telegram já compartilham fluxos otimizados para hardware disponível no mercado local.
Fontes
- LTX-2.5 can generate a 10-second AI video in just 6.8 seconds on Nvidia superchips - VentureBeat, 11 de agosto de 2026
- The Video Production Stack Now Fits on One Desk: LTX-2.5 Launches - MarkTechPost, 11 de agosto de 2026
- LTX-2.5 Targets Real-Time Video Generation - Open Source For You, 12 de agosto de 2026
- LTX-2.5 ComfyUI Documentation - ComfyUI Docs
- Lightricks/LTX-2.5 Model Repository - Hugging Face