Dreamega

Generador de Video IA LTX-2.3

Lightricks LTX-2.3 es un modelo fundación audio-video DiT de 22 mil millones de parámetros con VAE reconstruido para texturas, rostros, cabello y texto más nítidos. Con conector de texto 4x más grande para mejor adherencia al prompt, modo retrato nativo 9:16 hasta 1080x1920, soporte LoRA con hasta 3 adaptadores personalizados y audio más limpio vía vocoder HiFi-GAN. Genera videos 480p a 1080p de 5 a 20 segundos con audio sincronizado.

/models
Lightricks Ltx
Reel · Specifications

¿Qué es LTX-2.3?

Modelo fundación audio-video DiT de 22 mil millones de parámetros de Lightricks con VAE reconstruido y pesos de código abierto

  1. · 0122BParámetros
  2. · 02Hasta 4KResolución
  3. · 035-20sDuración
  4. · 04Apache 2.0Licencia

Un modelo de código abierto de nueva generación que ofrece detalles más nítidos, mejor adherencia al prompt, video retrato nativo y audio sincronizado más limpio bajo licencia Apache 2.0.

Reel · Capabilities

Características LTX-2.3

Descubra las poderosas capacidades de Lightricks LTX-2.3 para producción de video de nueva generación

  1. Feature 01 / 08

    Motor VAE Reconstruido

    Un autoencoder variacional completamente reconstruido entrega detalles finos dramáticamente más nítidos, incluyendo texturas, rostros, mechones de cabello, superposiciones de texto y bordes nítidos. Una actualización fundamental respecto a LTX-2 para calidad de salida profesional.

  2. Feature 02 / 08

    Adherencia al Prompt Mejorada

    Un conector de texto 4x más grande asegura que LTX-2.3 siga sus prompts con precisión significativamente mayor. Descripciones de escenas complejas, acciones específicas e instrucciones visuales detalladas se reproducen fielmente en el video generado.

  3. Feature 03 / 08

    Video Vertical Nativo

    Soporte de video vertical 9:16 de primera clase hasta 1080x1920 de resolución, diseñado para TikTok, Instagram Reels y YouTube Shorts. Sin más recortes ni letterboxing de modelos solo horizontales.

  4. Feature 04 / 08

    Audio-Video Sincronizado

    Generación de audio más limpia y de mayor fidelidad impulsada por un nuevo vocoder HiFi-GAN. Produce efectos de sonido contextuales, audio ambiental y diálogos que se sincronizan naturalmente con el contenido visual.

  5. Feature 05 / 08

    Adaptadores LoRA Personalizados

    Aplique hasta 3 adaptadores LoRA simultáneos para personalizar estilo, consistencia de personaje o patrones de movimiento. Ajuste las salidas para estéticas específicas de marca o flujos creativos especializados.

  6. Feature 06 / 08

    Salida Multi-Resolución

    Resolución flexible desde 480p para borradores rápidos hasta 1080p para salida lista para producción, con soporte de upscaling hasta 4K. Elija 24 o 48 FPS según los requisitos de su proyecto.

  7. Feature 07 / 08

    Imagen-Video Mejorado

    Reducción significativa del efecto Ken Burns y artefactos de congelamiento estático. Las imágenes se animan con movimiento genuino y trabajo de cámara dinámico, produciendo movimiento natural que da vida a las imágenes fijas.

  8. Feature 08 / 08

    Fundación de Código Abierto

    Lanzado bajo licencia Apache 2.0 con pesos completos del modelo y código de entrenamiento disponibles. Construya aplicaciones personalizadas, ajuste para casos de uso específicos o integre directamente en su pipeline de producción.

Cómo Usar LTX-2.3 para Imagen-Video

Transforme imágenes fijas en videos dinámicos con movimiento mejorado en tres simples pasos

  1. Seleccione el Modelo Imagen-Video LTX-2.3 y Cargue una Imagen

    Navegue a la página de generación de video y seleccione el modelo imagen-video LTX-2.3. Cargue una imagen fija de alta calidad (formato JPG, PNG o WEBP). Elija resolución (480p a 1080p), relación de aspecto (16:9 o 9:16 vertical), tasa de cuadros (24 o 48 FPS) y duración (5-20 segundos). Opcionalmente adjunte adaptadores LoRA para estilos personalizados.

  2. Agregue Prompt de Movimiento y Configure los Ajustes

    Escriba un prompt detallado describiendo cómo quiere que su imagen cobre vida. El imagen-video mejorado de LTX-2.3 produce movimiento genuino con menos efecto Ken Burns y menos congelamiento. Especifique movimientos de cámara, acciones del sujeto y efectos ambientales. Habilite la generación de audio para sonido HiFi-GAN sincronizado y use la optimización de prompt para mejores resultados.

  3. Genere y Descargue Su Video

    Haga clic en generar y espere a que LTX-2.3 anime su imagen con el VAE reconstruido para detalles más nítidos y movimiento natural. El modelo preserva la composición de su imagen mientras agrega movimiento dinámico y profundidad. Previsualice el resultado con audio sincronizado, luego descargue su video terminado en formato MP4.

Cómo Usar LTX-2.3 para Texto-Video

Cree impresionantes videos de IA con audio sincronizado en tres simples pasos

  1. Seleccione el Modelo Texto-Video LTX-2.3

    Navegue a la página de generación de video y seleccione el modelo texto-video LTX-2.3. Elija su resolución preferida (480p a 1080p), relación de aspecto (16:9 horizontal o 9:16 vertical), tasa de cuadros (24 o 48 FPS) y duración del video (5-20 segundos). Opcionalmente adjunte hasta 3 adaptadores LoRA para estilos personalizados.

  2. Escriba Su Prompt y Configure los Ajustes

    Elabore una descripción textual detallada del video que desea crear. El conector de texto 4x más grande de LTX-2.3 asegura una adherencia superior al prompt, así que sea específico sobre la composición de la escena, movimientos de cámara, iluminación y acciones. Habilite la optimización del prompt, active la generación de audio sincronizado y ajuste parámetros adicionales.

  3. Genere y Descargue Su Video

    Haga clic en generar y espere a que LTX-2.3 renderice su video con el VAE reconstruido para texturas, rostros y texto más nítidos. Previsualice el resultado con audio sincronizado HiFi-GAN. Descargue su video terminado en formato MP4 para uso inmediato en sus proyectos, redes sociales o flujos de producción.

Videos de YouTube LTX-2.3

Mira demostraciones y tutoriales de LTX-2.3, el modelo fundación audio-video de código abierto de 22 mil millones de parámetros

  • Introducing LTX Desktop: An Open Source Video Editor Powered by LTX-2.3 - LTX
  • Run LTX 2.3 Video Generation AI Model Locally with ComfyUI - Easy Guide - Fahd Mirza
  • LTX 2.3 in Comfy UI — Text to Video & Image to Video - AI Ninja
  • LTX-2.3 In ComfyUI = AI Video Generation At 0 Credits Per Run - Nerdy Rodent
  • LTX-2.3 ComfyUI Workflow Tutorial | Text-to-Video, Image-to-Video, Talking Avatar & Audio Generation - Vantage with AI
  • LTX 2.3 Released - ComfyUI Workflow & A New Tool I Built To Run AI😃😃😃 - Benji’s AI Playground

Videos de YouTube LTX-2.3

Mira demostraciones y tutoriales de LTX-2.3, el modelo fundación audio-video de código abierto de 22 mil millones de parámetros

Reseñas populares de LTX-2.3 en X

Vea lo que dice la comunidad de IA sobre LTX-2.3, el modelo fundación audio-video de código abierto de 22 mil millones de parámetros

Acaban de liberar LTX-2.3. Un modelo de video con IA que genera 4K + audio + lip-sync. 100% gratis y open-source. Puedes crear clips de hasta 20s desde tu propio PC. Te dejo el enlace en el comentario: (Si no, prueba lo último de Kling) x.com/ivnways/status…

Image
IVAN | IA
IVAN | IA
@ivnways

Kling 3.0 Motion Control se actualiza por completo. Basado en la versión 2.6, ahora ofrece: - Consistencia facial impecable - Estabilidad desde múltiples ángulos - Eidelidad en secuencias largas - Reproducción fiel de emociones complejas

166
Reply

LTX-2.3 releasing soon 😊 LTX-2.3 brings four major improvements over LTX-2. A redesigned VAE produces sharper fine details, more realistic textures, and cleaner edges. A new gated attention text connector means prompts are followed more closely – descriptions of timing,  Show more

Image
Wildminder
Wildminder
@wildmindai

LTX-2.3 officially released! Wait, unreleased. 404. ComfyUI team: “Nah, we already support it.” github.com/Comfy-Org/Comf…

Image
5
Reply
FAQ

Preguntas Frecuentes

¿Tienes más preguntas?

LTX-2.3 es un modelo fundación audio-video DiT de 22 mil millones de parámetros de Lightricks, lanzado el 5 de marzo de 2026. Cuenta con un VAE completamente reconstruido para texturas, rostros, cabello y renderizado de texto más nítidos, un conector de texto 4x más grande para mejor adherencia al prompt, soporte retrato nativo 9:16, soporte de adaptadores LoRA y un nuevo vocoder HiFi-GAN para audio más limpio. Es de código abierto bajo Apache 2.0.
LTX-2.3 introduce varias actualizaciones importantes: el VAE fue completamente reconstruido para detalles finos dramáticamente más nítidos. El conector de texto es 4x más grande, resultando en una adherencia al prompt mucho mejor. La generación imagen-video ha sido mejorada con menos efecto Ken Burns y menos congelamiento. La calidad de audio es más limpia gracias al nuevo vocoder HiFi-GAN. También agrega soporte nativo de video vertical 9:16 y soporte de adaptadores LoRA.
LTX-2.3 genera videos nativamente desde 480p hasta 1080p, con soporte de upscaling hasta 4K. Soporta tanto formato horizontal (16:9) como vertical (9:16), con el modo vertical soportando hasta 1080x1920 de resolución. La duración del video varía de 5 a 20 segundos, con opciones de tasa de cuadros de 24 o 48 FPS.
LTX-2.3 soporta hasta 3 adaptadores LoRA (Low-Rank Adaptation) simultáneos para personalizar la salida del modelo. Los LoRA pueden usarse para mantener apariencias consistentes de personajes, aplicar estilos artísticos específicos o controlar patrones de movimiento. Esto permite la personalización específica de marca y flujos creativos especializados sin reentrenar el modelo completo.
LTX-2.3 genera contenido audio-video sincronizado usando un nuevo vocoder HiFi-GAN que produce audio más limpio y de mayor fidelidad en comparación con LTX-2. El modelo genera efectos de sonido contextuales, audio ambiental y diálogos que coinciden naturalmente con el contenido visual. La generación de audio puede activarse o desactivarse según sus necesidades.
Sí, LTX-2.3 se lanza bajo la licencia Apache 2.0, una de las licencias de código abierto más permisivas. Los pesos completos del modelo y el código de entrenamiento son accesibles públicamente, permitiendo a los desarrolladores construir aplicaciones personalizadas, ajustar para casos de uso específicos o integrar el modelo directamente en pipelines de producción para uso personal y comercial.