Ir para o conteúdo

LTX-2.5: Vídeo IA Aberto em 6,8 Segundos

Darius Z. Por Darius Z. 8 min de leitura
Monitor de computador exibindo linha do tempo de vídeo com hardware GPU para o lançamento do modelo de vídeo IA LTX-2.5 com pesos abertos

Contém links de afiliados

O LTX-2.5, modelo de vídeo e de mundo com pesos abertos da Lightricks, foi lançado em 11 de agosto com uma promessa de velocidade que desafia todos os rivais fechados: um clipe de 10 segundos em 720p gerado em 6,8 segundos em hardware NVIDIA. O modelo é gratuito para organizações com receita anual abaixo de US$ 10 milhões, chega com integração nativa ao ComfyUI no dia do lançamento e já ultrapassou 33 milhões de downloads em toda a família LTX.

Pontos Principais

  • Gera um vídeo de 10 segundos em 6,8 segundos em chips NVIDIA GB200, mais rápido que a reprodução em tempo real
  • Pesos abertos no Hugging Face, gratuito para organizações com receita anual abaixo de $10M
  • Integração nativa ao ComfyUI no dia do lançamento, com fluxos texto-para-vídeo, imagem-para-vídeo e multishot
  • Geração multishot nativa mantém personagens, cenas e voz consistentes entre cortes
  • Custa $0,90 por clipe de 10 segundos via API gerenciada, abaixo da maioria dos rivais fechados

Compare Geradores de Vídeo IA

Veja como o Kling AI se compara a alternativas de código aberto em velocidade, qualidade e preço de geração.

Leia a Análise do Kling AI →

O Que o LTX-2.5 Entrega

A Lightricks reconstruiu praticamente todas as etapas do pipeline de geração em vez de empilhar recursos sobre o núcleo antigo do LTX-2.3. Cinco mudanças estruturais definem este lançamento.

Um Diffusion Video Decoder reduz artefatos em cenas de alto movimento e reconstrói detalhes finos como texto e traços faciais sem sacrificar a taxa de compressão do modelo. Versões anteriores do LTX sofriam com câmera em movimento rápido; este decoder aloca poder de renderização conforme a complexidade da cena.

A geração multishot nativa produz uma sequência completa como saída única. Personagens, ambientes, iluminação e voz permanecem consistentes entre cortes, sem montagem posterior. Para quem produz conteúdo curto ou storyboards, isso elimina o problema de continuidade que afeta a geração tomada a tomada.

Um backbone de linguagem Gemma 4 personalizado e um aprimorador de prompts dedicado lidam com instruções complexas de múltiplos personagens com mais precisão. A Lightricks afirma que o aprimorador melhora significativamente a aderência a descrições longas e detalhadas em relação ao predecessor.

O modelo também inclui um checkpoint pré-treinado para IA física e robótica, oferecendo uma base para ajuste fino com dados de domínio específico. Uma versão destilada entrega qualidade quase plena com menor custo e tempo de inferência, otimizada para GPUs NVIDIA RTX com exigência reduzida de VRAM.

6,8s Velocidade de Geração (clipe de 10s, auto-hospedado)
$0,90 Custo da API (clipe de 10s, tier Fast)
33M+ Downloads Totais (linha mais usada)
16 GB VRAM Mínima (GPUs RTX de consumo)

Quão Rápido É na Prática

O número de 6,8 segundos precisa de contexto. A Lightricks mediu essa velocidade em dois superchips NVIDIA GB200 em estado estável, hardware que a maioria dos criadores independentes nunca terá acesso. Pela API gerenciada da própria LTX, o mesmo clipe de 10 segundos levou 23,7 segundos em resolução 1080p.

Mesmo assim, ambas as cifras representam uma vantagem relevante sobre a concorrência. Medições de ponta a ponta da LTX em APIs rivais na mesma tarefa imagem-para-vídeo mostraram o Gemini Omni Flash do Google em 52 segundos, o Veo 3.1 em 70 segundos, o MiniMax H3 em 180 segundos, o Seedance 2.5 da ByteDance em 317 segundos e o Kling AI 3.0 Pro em 398 segundos.

Comparativo de custo de geração de vídeo IA: clipe de 10 segundos em 720p com áudio (agosto de 2026)

Modelo Custo por Clipe Principal Vantagem
Veo 3.1 Lite (Google) $0,50 Taxa de API fechada mais barata
LTX-2.5 Fast (Lightricks) $0,90 Único modelo com pesos abertos; auto-hospedagem grátis abaixo de $10M
Veo 3.1 Fast (Google) $1,00 Caminho mais barato para 4K via API fechada
Gemini Omni Flash (Google) $1,00 Líder de qualidade em arenas independentes
FLUX 3 Video (Black Forest Labs) $1,70 Primeiro a entregar clipes de 20 segundos com áudio
HappyHorse 1.0 (Alibaba) $1,82 Pontuações fortes em arenas de qualidade
Veo 3.1 Premium (Google) $4,00 Único modelo com extensão de clipe além de uma geração

Em qualidade, a LTX compartilhou testes cegos de preferência reportados pelo fornecedor com taxa de vitória de 67%, à frente do Seedance 2.5 com 65% e do Gemini Omni Flash com 55%. Esses resultados não foram verificados de forma independente. A arena texto-para-vídeo da Artificial Analysis, o terreno mais neutro disponível, ainda classifica o Gemini Omni Flash em primeiro e ainda não pontua o LTX-2.5.

A Parceria com o ComfyUI

A LTX escolheu o ComfyUI como plataforma de lançamento por um motivo claro. A ferramenta de fluxo de trabalho baseada em nós, que começou como front-end de código aberto para Stable Diffusion em 2023, virou o ambiente padrão para testar e implantar novos modelos generativos. A Comfy Org levantou US$ 17 milhões e hoje funciona como camada de prototipagem de boa parte do ecossistema aberto de ferramentas criativas com IA.

A integração no dia do lançamento traz três templates de fluxo prontos: texto-para-vídeo, imagem-para-vídeo e primeiro/último frame para vídeo. Criadores podem rodar o modelo localmente com pesos baixados ou usar nós da API LTX para geração na nuvem sem GPU local.

O CEO da LTX, Zeev Farbman, foi direto sobre a estratégia: ‘Grande parte dos nossos clientes começa a jornada dentro do Comfy, então suporte no dia zero é, na prática, nosso canal de aquisição.’

Informação:

Os pesos do LTX-2.5 ficam em um repositório restrito no Hugging Face. É preciso aceitar a licença e aguardar aprovação de acesso antes de baixar. O modelo exige pelo menos 16 GB de VRAM para inferência local.

A Aposta nos Pesos Abertos

O modelo de licenciamento da LTX fica entre código aberto completo e API fechada. A LTX-2.x Community License permite que organizações com receita anual abaixo de US$ 10 milhões usem, modifiquem, auto-hospedem e sublicenciem o modelo gratuitamente. Empresas maiores negociam licenças pagas. Mesmo acima do limite, avaliação em ambientes não produtivos continua gratuita.

Farbman enquadrou a estratégia contra a tendência do setor de fechar APIs: ‘Por volta do lançamento do Sora, percebemos que todos os grandes players estavam fechando seus modelos. Trabalhar só via APIs simplesmente não funciona para muitas empresas.’ O argumento dele é que modelos de vídeo têm uma superfície de casos de uso muito mais ampla que modelos de linguagem, tornando o acesso aos pesos mais crítico para personalização.

A abertura tem limites. A licença abrange não só checkpoints fine-tuned e adaptadores LoRA, mas também destilações e qualquer modelo treinado com saídas sintéticas do LTX-2.5. Uma empresa que gera dados de treinamento com o LTX-2.5 para treinar outro modelo, pela definição da licença, criou um derivado sujeito ao mesmo acordo.

Experimente a Geração de Vídeo com Kling AI

Gere vídeos IA com saída 4K nativa, controle de movimento e sequências multishot. Comece com o plano gratuito.

Teste o Kling AI Grátis →

O Que Isso Significa para o Mercado

O LTX-2.5 chega em um mercado que mudou rápido desde nossa cobertura de janeiro sobre NVIDIA RTX e LTX-2. O espaço de IA de vídeo com pesos abertos agora tem um modelo que compete em velocidade e se aproxima dos rivais fechados em qualidade, permanecendo gratuito para a maioria dos criadores independentes.

O lançamento faz parte do destaque de ‘IA local’ da NVIDIA em agosto, ao lado do modelo de agente Nemotron 3.5 Lightning. A mensagem compartilhada: modelos abertos rodando localmente estão virando infraestrutura de produção padrão, não um plano B.

Para criadores que hoje pagam por clipe em plataformas fechadas — incluindo canais do YouTube Brasil e produtoras de conteúdo curto —, o LTX-2.5 oferece alternativa clara se houver hardware disponível. Para quem não tem GPU local, a API gerenciada a $0,90 por clipe o posiciona como a segunda opção mais barata, atrás apenas do Veo 3.1 Lite do Google.

A resposta da concorrência vale a pena acompanhar. O Kling AI, que recentemente lançou geração nativa em 4K e recursos multishot, levou 398 segundos nos benchmarks da LTX na mesma tarefa que o LTX completou em menos de 7 segundos em hardware premium. Se essa diferença de velocidade se traduz em adoção depende da consistência de qualidade, ainda não confirmada por benchmarks independentes.

Perguntas Frequentes

O LTX-2.5 é gratuito para usar?

Sim, para organizações com receita anual recorrente abaixo de US$ 10 milhões. Você pode baixar os pesos abertos no Hugging Face, auto-hospedar no seu hardware e usar comercialmente sem pagar taxas de licenciamento. Organizações acima desse limite negociam licença paga com a Lightricks.

Quão rápido é o LTX-2.5 comparado ao Kling AI e ao Seedance?

A LTX afirma 6,8 segundos para um clipe de 10 segundos em hardware NVIDIA GB200, contra 317 segundos do Seedance 2.5 e 398 segundos do Kling 3.0 Pro na mesma tarefa imagem-para-vídeo. Pela API gerenciada, o LTX-2.5 gera o mesmo clipe em 23,7 segundos em 1080p.

Como rodar o LTX-2.5 no ComfyUI?

Atualize o ComfyUI para a versão mais recente, solicite acesso ao repositório restrito Lightricks/LTX-2.5 no Hugging Face, aceite a licença e baixe os arquivos do modelo para o diretório de modelos do ComfyUI. Três templates de fluxo (texto-para-vídeo, imagem-para-vídeo e primeiro/último frame para vídeo) estão disponíveis imediatamente. São necessários pelo menos 16 GB de VRAM.

O que é um modelo de vídeo IA com pesos abertos?

Um modelo com pesos abertos publica seus parâmetros treinados publicamente, permitindo que qualquer pessoa baixe, execute e faça ajuste fino localmente. Diferente de código aberto (que implica ausência de restrições de uso), modelos como o LTX-2.5 vêm com licenças personalizadas que podem restringir uso comercial acima de certos limites de receita ou definir obrigações sobre obras derivadas.

O LTX-2.5 gera vídeos com áudio?

Sim. O LTX-2.5 gera vídeo e áudio sincronizados em uma única passagem. O recurso multishot também mantém consistência de voz entre cortes, o que o torna adequado para sequências narrativas e produção de conteúdo curto.

Vale a pena para criadores brasileiros rodar o LTX-2.5 localmente?

Para criadores no Brasil, a auto-hospedagem pode compensar: APIs internacionais cobram em dólar e o câmbio encarece cada clipe. Com uma RTX 4090 ou superior (16 GB de VRAM), é possível gerar vídeos sem depender de serviços na nuvem. Comunidades brasileiras de ComfyUI no Discord e Telegram já compartilham fluxos otimizados para hardware disponível no mercado local.

Fontes

  1. LTX-2.5 can generate a 10-second AI video in just 6.8 seconds on Nvidia superchips - VentureBeat, 11 de agosto de 2026
  2. The Video Production Stack Now Fits on One Desk: LTX-2.5 Launches - MarkTechPost, 11 de agosto de 2026
  3. LTX-2.5 Targets Real-Time Video Generation - Open Source For You, 12 de agosto de 2026
  4. LTX-2.5 ComfyUI Documentation - ComfyUI Docs
  5. Lightricks/LTX-2.5 Model Repository - Hugging Face

Este artigo foi útil?

0:00