Dreamega

Gerador de Vídeo IA LTX-2.3

Lightricks LTX-2.3 é um modelo fundação áudio-vídeo DiT de 22 bilhões de parâmetros com VAE reconstruído para texturas, rostos, cabelos e textos mais nítidos. Com conector de texto 4x maior para melhor aderência ao prompt, modo retrato nativo 9:16 até 1080x1920, suporte LoRA com até 3 adaptadores personalizados e áudio mais limpo via vocoder HiFi-GAN. Gera vídeos 480p a 1080p de 5 a 20 segundos com áudio sincronizado.

/models
Lightricks Ltx
Reel · Specifications

O que é LTX-2.3?

Modelo fundação áudio-vídeo DiT de 22 bilhões de parâmetros da Lightricks com VAE reconstruído e pesos open-source

  1. · 0122BParâmetros
  2. · 02Até 4KResolução
  3. · 035-20sDuração
  4. · 04Apache 2.0Licença

Um modelo open-source de nova geração com detalhes mais nítidos, melhor aderência ao prompt, vídeo retrato nativo e áudio sincronizado mais limpo sob licença Apache 2.0.

Reel · Capabilities

Recursos LTX-2.3

Descubra as poderosas capacidades do Lightricks LTX-2.3 para produção de vídeo de nova geração

  1. Feature 01 / 08

    Motor VAE Reconstruído

    Um autoencoder variacional completamente reconstruído entrega detalhes finos drasticamente mais nítidos, incluindo texturas, rostos, fios de cabelo, sobreposições de texto e bordas nítidas. Uma atualização fundamental em relação ao LTX-2 para qualidade de saída profissional.

  2. Feature 02 / 08

    Aderência ao Prompt Aprimorada

    Um conector de texto 4x maior garante que o LTX-2.3 siga seus prompts com precisão significativamente maior. Descrições de cenas complexas, ações específicas e instruções visuais detalhadas são fielmente renderizadas no vídeo gerado.

  3. Feature 03 / 08

    Vídeo Retrato Nativo

    Suporte de vídeo vertical 9:16 de primeira classe com até 1080x1920 de resolução, projetado para TikTok, Instagram Reels e YouTube Shorts. Sem mais cortes ou letterboxing de modelos somente paisagem.

  4. Feature 04 / 08

    Áudio-Vídeo Sincronizado

    Geração de áudio mais limpa e de maior fidelidade alimentada por um novo vocoder HiFi-GAN. Produz efeitos sonoros contextuais, áudio ambiente e diálogos que sincronizam naturalmente com o conteúdo visual.

  5. Feature 05 / 08

    Adaptadores LoRA Personalizados

    Aplique até 3 adaptadores LoRA simultâneos para personalizar estilo, consistência de personagem ou padrões de movimento. Ajuste as saídas para estéticas específicas de marca ou fluxos criativos especializados.

  6. Feature 06 / 08

    Saída Multi-Resolução

    Resolução flexível de 480p para rascunhos rápidos até 1080p para saída pronta para produção, com suporte de upscaling até 4K. Escolha 24 ou 48 FPS para atender aos requisitos do seu projeto.

  7. Feature 07 / 08

    Imagem-Vídeo Aprimorado

    Redução significativa do efeito Ken Burns e artefatos de congelamento estático. Imagens são animadas com movimento genuíno e trabalho de câmera dinâmico, produzindo movimento natural que dá vida a imagens estáticas.

  8. Feature 08 / 08

    Fundação Open-Source

    Lançado sob licença Apache 2.0 com pesos completos do modelo e código de treinamento disponíveis. Construa aplicações personalizadas, ajuste para casos de uso específicos ou integre diretamente em seu pipeline de produção.

Como Usar LTX-2.3 para Imagem-Vídeo

Transforme imagens estáticas em vídeos dinâmicos com movimento aprimorado em três passos simples

  1. Selecione o Modelo Imagem-Vídeo LTX-2.3 e Carregue uma Imagem

    Navegue até a página de geração de vídeo e selecione o modelo imagem-vídeo LTX-2.3. Carregue uma imagem estática de alta qualidade (formato JPG, PNG ou WEBP). Escolha resolução (480p a 1080p), proporção (16:9 ou 9:16 retrato), taxa de quadros (24 ou 48 FPS) e duração (5-20 segundos). Opcionalmente anexe adaptadores LoRA para estilos personalizados.

  2. Adicione Prompt de Movimento e Configure as Definições

    Escreva um prompt detalhado descrevendo como você quer que sua imagem ganhe vida. O imagem-vídeo aprimorado do LTX-2.3 produz movimento genuíno com menos efeito Ken Burns e menos congelamento. Especifique movimentos de câmera, ações do assunto e efeitos ambientais. Habilite a geração de áudio para som HiFi-GAN sincronizado e use otimização de prompt para melhores resultados.

  3. Gere e Baixe Seu Vídeo

    Clique em gerar e aguarde o LTX-2.3 animar sua imagem com o VAE reconstruído para detalhes mais nítidos e movimento natural. O modelo preserva a composição da sua imagem enquanto adiciona movimento dinâmico e profundidade. Visualize o resultado com áudio sincronizado, depois baixe seu vídeo finalizado em formato MP4.

Como Usar LTX-2.3 para Texto-Vídeo

Crie vídeos AI impressionantes com áudio sincronizado em três passos simples

  1. Selecione o Modelo Texto-Vídeo LTX-2.3

    Navegue até a página de geração de vídeo e selecione o modelo texto-vídeo LTX-2.3. Escolha sua resolução preferida (480p a 1080p), proporção (16:9 paisagem ou 9:16 retrato), taxa de quadros (24 ou 48 FPS) e duração do vídeo (5-20 segundos). Opcionalmente anexe até 3 adaptadores LoRA para estilos personalizados.

  2. Escreva Seu Prompt e Configure as Definições

    Crie uma descrição textual detalhada do vídeo que você quer criar. O conector de texto 4x maior do LTX-2.3 garante aderência superior ao prompt, então seja específico sobre composição da cena, movimentos de câmera, iluminação e ações. Habilite a otimização de prompt, ative a geração de áudio sincronizado e ajuste parâmetros adicionais.

  3. Gere e Baixe Seu Vídeo

    Clique em gerar e aguarde o LTX-2.3 renderizar seu vídeo com o VAE reconstruído para texturas, rostos e texto mais nítidos. Visualize o resultado com áudio sincronizado HiFi-GAN. Baixe seu vídeo finalizado em formato MP4 para uso imediato em seus projetos, mídia social ou fluxos de produção.

Vídeos do YouTube LTX-2.3

Assista demonstrações e tutoriais do LTX-2.3, o modelo fundação áudio-vídeo open-source de 22 bilhões de parâmetros

  • Introducing LTX Desktop: An Open Source Video Editor Powered by LTX-2.3 - LTX
  • Run LTX 2.3 Video Generation AI Model Locally with ComfyUI - Easy Guide - Fahd Mirza
  • LTX 2.3 in Comfy UI — Text to Video & Image to Video - AI Ninja
  • LTX-2.3 In ComfyUI = AI Video Generation At 0 Credits Per Run - Nerdy Rodent
  • LTX-2.3 ComfyUI Workflow Tutorial | Text-to-Video, Image-to-Video, Talking Avatar & Audio Generation - Vantage with AI
  • LTX 2.3 Released - ComfyUI Workflow & A New Tool I Built To Run AI😃😃😃 - Benji’s AI Playground

Vídeos do YouTube LTX-2.3

Assista demonstrações e tutoriais do LTX-2.3, o modelo fundação áudio-vídeo open-source de 22 bilhões de parâmetros

Avaliações populares do LTX-2.3 no X

Veja o que a comunidade de IA está dizendo sobre o LTX-2.3, o modelo fundação áudio-vídeo open-source de 22 bilhões de parâmetros

Acaban de liberar LTX-2.3. Un modelo de video con IA que genera 4K + audio + lip-sync. 100% gratis y open-source. Puedes crear clips de hasta 20s desde tu propio PC. Te dejo el enlace en el comentario: (Si no, prueba lo último de Kling) x.com/ivnways/status…

Image
IVAN | IA
IVAN | IA
@ivnways

Kling 3.0 Motion Control se actualiza por completo. Basado en la versión 2.6, ahora ofrece: - Consistencia facial impecable - Estabilidad desde múltiples ángulos - Eidelidad en secuencias largas - Reproducción fiel de emociones complejas

166
Reply

LTX-2.3 releasing soon 😊 LTX-2.3 brings four major improvements over LTX-2. A redesigned VAE produces sharper fine details, more realistic textures, and cleaner edges. A new gated attention text connector means prompts are followed more closely – descriptions of timing,  Show more

Image
Wildminder
Wildminder
@wildmindai

LTX-2.3 officially released! Wait, unreleased. 404. ComfyUI team: “Nah, we already support it.” github.com/Comfy-Org/Comf…

Image
5
Reply
FAQ

Perguntas Frequentes

LTX-2.3 é um modelo fundação áudio-vídeo DiT de 22 bilhões de parâmetros da Lightricks, lançado em 5 de março de 2026. Possui um VAE completamente reconstruído para texturas, rostos, cabelos e renderização de texto mais nítidos, conector de texto 4x maior para melhor aderência ao prompt, suporte retrato nativo 9:16, suporte a adaptadores LoRA e um novo vocoder HiFi-GAN para áudio mais limpo. É open-source sob Apache 2.0.
LTX-2.3 introduz várias atualizações importantes: o VAE foi completamente reconstruído para detalhes finos dramaticamente mais nítidos. O conector de texto é 4x maior, resultando em uma aderência ao prompt muito melhor. A geração imagem-vídeo foi melhorada com menos efeito Ken Burns e menos congelamento. A qualidade do áudio é mais limpa graças ao novo vocoder HiFi-GAN. Também adiciona suporte nativo a vídeo retrato 9:16 e suporte a adaptadores LoRA.
LTX-2.3 gera vídeos nativamente de 480p até 1080p, com suporte de upscaling até 4K. Suporta tanto formato paisagem (16:9) quanto retrato (9:16), com o modo retrato suportando até 1080x1920 de resolução. A duração do vídeo varia de 5 a 20 segundos, com opções de taxa de quadros de 24 ou 48 FPS.
LTX-2.3 suporta até 3 adaptadores LoRA (Low-Rank Adaptation) simultâneos para personalizar a saída do modelo. LoRAs podem ser usados para manter aparências consistentes de personagens, aplicar estilos artísticos específicos ou controlar padrões de movimento. Isso permite personalização específica de marca e fluxos criativos especializados sem retreinar o modelo completo.
LTX-2.3 gera conteúdo áudio-vídeo sincronizado usando um novo vocoder HiFi-GAN que produz áudio mais limpo e de maior fidelidade em comparação ao LTX-2. O modelo gera efeitos sonoros contextuais, áudio ambiente e diálogos que correspondem naturalmente ao conteúdo visual. A geração de áudio pode ser ativada ou desativada conforme suas necessidades.
Sim, o LTX-2.3 é lançado sob a licença Apache 2.0, uma das licenças open-source mais permissivas. Os pesos completos do modelo e o código de treinamento são acessíveis publicamente, permitindo que desenvolvedores construam aplicações personalizadas, ajustem para casos de uso específicos ou integrem o modelo diretamente em pipelines de produção para uso pessoal e comercial.