LTX-2.5 gera vídeo de 10s em 6,8s e aposta em pesos abertos
Modelo de vídeo e mundo da LTX chega integrado ao ComfyUI e gratuito para empresas com receita anual abaixo de US$ 10 mi
O que aconteceu
A LTX liberou o LTX-2.5, a nova versão de seu modelo aberto de vídeo e "mundo", com integração nativa de primeiro dia ao ComfyUI, a ferramenta de fluxos de trabalho em nós que virou o ambiente padrão de prototipagem para mídia generativa aberta. A parceria de lançamento entre as duas empresas foi anunciada em conjunto (VentureBeat).
O modelo está disponível como pesos abertos no Hugging Face, dentro do ComfyUI e via API da LTX para equipes que preferem geração gerenciada. O uso é gratuito para organizações com receita recorrente anual (ARR) abaixo de US$ 10 milhões; empresas maiores negociam licença. A LTX afirma que seus modelos ultrapassaram 33 milhões de downloads, o que tornaria a família LTX a linha de modelos "mundo" abertos mais usada do mercado.
Segundo a empresa, o LTX-2.5 reconstrói quase todas as etapas do pipeline de geração, em vez de apenas adicionar recursos ao núcleo antigo. As mudanças principais incluem um novo decoder de vídeo por difusão, que reduz artefatos visuais em cenas de alto movimento e reconstrói detalhes finos como texto, além de suporte a multi-shot, novos modos de condicionamento e melhor suporte a modelos autorregressivos, críticos para casos de uso em tempo real e robótica.
Contexto
A LTX nasceu como um spin-off da Lightricks, empresa israelense de edição de imagem e vídeo. O lançamento reforça a aposta da companhia em pesos abertos como estratégia central, em contraste com APIs fechadas de concorrentes. O ComfyUI, por sua vez, consolidou-se como o ambiente de fato para quem trabalha com geração aberta, o que explica a integração day-one.
Em entrevista exclusiva ao VentureBeat antes do lançamento, o cofundador e CEO da LTX, Zeev Farbman, disse que a empresa busca manter a eficiência e a velocidade de inferência pelas quais é conhecida, enquanto eleva a qualidade. "Estamos introduzindo muitas coisas interessantes nesta versão: suporte a multi-shot, um decoder de difusão para melhor qualidade, novos modos de condicionamento e melhor suporte a modelos autorregressivos", afirmou Farbman. O cofundador e CEO do ComfyUI, Yoland Yan, também participou da conversa sobre a parceria.
Por que importa
O LTX-2.5 ataca dois pontos sensíveis do mercado de vídeo generativo: velocidade e custo. Gerar 10 segundos de vídeo a partir de uma imagem em 6,8 segundos em hardware Nvidia reduz o tempo de iteração para criadores e estúdios, algo relevante em fluxos de produção que dependem de múltiplas tentativas. A política de preços — gratuita para empresas menores — também reduz a barreira de entrada para estúdios independentes e desenvolvedores no Brasil e no mundo.
A integração com o ComfyUI significa que o modelo chega pronto para uso em um ecossistema já estabelecido, sem exigir que equipes migrem de ferramenta. Para o mercado brasileiro, que tem uma comunidade ativa de criadores de conteúdo e estúdios de pós-produção, o acesso a um modelo aberto com essa velocidade pode viabilizar projetos que antes dependiam de APIs caras ou de infraestrutura própria pesada.
Impacto
No curto prazo, o LTX-2.5 deve acelerar a adoção de modelos abertos de vídeo em prototipagem e produção experimental, especialmente entre usuários do ComfyUI. A redução de artefatos em cenas de alto movimento e a reconstrução de texto em vídeo ampliam os casos de uso viáveis, como legendas e elementos gráficos dinâmicos.
No médio prazo, a disputa entre pesos abertos e APIs fechadas tende a se intensificar. A LTX aposta que a abertura vence o mercado de vídeo e modelos de mundo, e os 33 milhões de downloads acumulados dão alguma evidência de tração. Para empresas que dependem de geração gerenciada, a API da LTX oferece um caminho intermediário.
O que muda
Para criadores e estúdios, muda a relação entre custo e capacidade: um modelo aberto, rápido e integrado ao ComfyUI reduz a dependência de fornecedores de API fechada. Para desenvolvedores que trabalham com robótica e sistemas em tempo real, o suporte a modelos autorregressivos abre caminho para aplicações que exigem latência baixa.
O que vem agora
A LTX deve continuar iterando sobre qualidade e velocidade, como indicou Farbman. A expectativa é que a integração com o ComfyUI seja aprofundada e que novos modos de condicionamento apareçam em versões futuras. Empresas acima do limite de US$ 10 milhões de ARR precisarão negociar licenças, o que deve ser detalhado nos próximos meses.
Fontes
- VentureBeat: LTX-2.5 can generate a 10-second AI video from an image in just 6.8 seconds on Nvidia superchips — and it's open weights (https://venturebeat.com/technology/ltx-2-5-can-generate-a-10-second-ai-video-from-an-image-in-just-6-8-seconds-on-nvidia-superchips-and-its-open-weights)
