Dreamega

Générateur Vidéo IA LTX-2.3

Lightricks LTX-2.3 est un modèle fondation audio-vidéo DiT de 22 milliards de paramètres avec un VAE reconstruit pour des textures, visages, cheveux et textes plus nets. Doté d'un connecteur texte 4x plus grand pour une meilleure adhérence au prompt, mode portrait natif 9:16 jusqu'à 1080x1920, support LoRA avec jusqu'à 3 adaptateurs personnalisés, et audio plus propre via le vocodeur HiFi-GAN. Génère des vidéos 480p à 1080p de 5 à 20 secondes avec audio synchronisé.

/models
Lightricks Ltx
Reel · Specifications

Qu'est-ce que LTX-2.3 ?

Modèle fondation audio-vidéo DiT de 22 milliards de paramètres de Lightricks avec VAE reconstruit et poids open-source

  1. · 0122BParamètres
  2. · 02Jusqu'à 4KRésolution
  3. · 035-20sDurée
  4. · 04Apache 2.0Licence

Un modèle open-source de nouvelle génération offrant des détails plus nets, une meilleure adhérence au prompt, une vidéo portrait native et un audio synchronisé plus propre sous licence Apache 2.0.

Reel · Capabilities

Fonctionnalités LTX-2.3

Découvrez les puissantes capacités de Lightricks LTX-2.3 pour la production vidéo de nouvelle génération

  1. Feature 01 / 08

    Moteur VAE Reconstruit

    Un autoencodeur variationnel entièrement reconstruit offrant des détails fins nettement plus précis, incluant textures, visages, mèches de cheveux, superpositions de texte et bords nets. Une mise à niveau fondamentale par rapport à LTX-2 pour une qualité de sortie professionnelle.

  2. Feature 02 / 08

    Adhérence au Prompt Améliorée

    Un connecteur texte 4x plus grand garantit que LTX-2.3 suit vos prompts avec une précision significativement accrue. Les descriptions de scènes complexes, actions spécifiques et instructions visuelles détaillées sont fidèlement rendues dans la vidéo générée.

  3. Feature 03 / 08

    Vidéo Portrait Native

    Support vidéo vertical 9:16 de premier ordre jusqu'à 1080x1920 de résolution, conçu pour TikTok, Instagram Reels et YouTube Shorts. Plus de recadrage ni de bandes noires depuis des modèles uniquement paysage.

  4. Feature 04 / 08

    Audio-Vidéo Synchronisé

    Génération audio plus propre et de plus haute fidélité alimentée par un nouveau vocodeur HiFi-GAN. Produit des effets sonores contextuels, de l'audio ambiant et des dialogues qui se synchronisent naturellement avec le contenu visuel.

  5. Feature 05 / 08

    Adaptateurs LoRA Personnalisés

    Appliquez jusqu'à 3 adaptateurs LoRA simultanés pour personnaliser le style, la cohérence des personnages ou les motifs de mouvement. Affinez les sorties pour des esthétiques de marque spécifiques ou des flux créatifs spécialisés.

  6. Feature 06 / 08

    Sortie Multi-Résolution

    Résolution flexible de 480p pour les brouillons rapides jusqu'à 1080p pour une sortie prête production, avec support d'upscaling jusqu'à 4K. Choisissez 24 ou 48 FPS pour correspondre aux exigences de votre projet.

  7. Feature 07 / 08

    Image-Vidéo Améliorée

    Réduction significative de l'effet Ken Burns et des artefacts de gel statique. Les images sont animées avec un mouvement authentique et un travail de caméra dynamique, produisant un mouvement naturel qui donne vie aux images fixes.

  8. Feature 08 / 08

    Fondation Open-Source

    Publié sous licence Apache 2.0 avec poids du modèle complets et code d'entraînement disponibles. Construisez des applications personnalisées, affinez pour des cas d'usage spécifiques ou intégrez directement dans votre pipeline de production.

Comment Utiliser LTX-2.3 pour Image-Vidéo

Transformez des images fixes en vidéos dynamiques avec un mouvement amélioré en trois étapes simples

  1. Sélectionnez le Modèle Image-Vidéo LTX-2.3 et Téléchargez une Image

    Naviguez vers la page de génération vidéo et sélectionnez le modèle image-vidéo LTX-2.3. Téléchargez une image fixe de haute qualité (format JPG, PNG ou WEBP). Choisissez votre résolution (480p à 1080p), ratio d'aspect (16:9 ou 9:16 portrait), fréquence d'images (24 ou 48 FPS) et durée (5-20 secondes). Attachez optionnellement des adaptateurs LoRA pour des styles personnalisés.

  2. Ajoutez un Prompt de Mouvement et Configurez les Paramètres

    Rédigez un prompt détaillé décrivant comment vous voulez que votre image prenne vie. L'image-vidéo améliorée de LTX-2.3 produit un mouvement authentique avec moins d'effet Ken Burns et moins de gel. Spécifiez les mouvements de caméra, les actions du sujet et les effets environnementaux. Activez la génération audio pour un son HiFi-GAN synchronisé, et utilisez l'optimisation du prompt pour de meilleurs résultats.

  3. Générez et Téléchargez Votre Vidéo

    Cliquez sur générer et attendez que LTX-2.3 anime votre image avec le VAE reconstruit pour des détails plus nets et un mouvement naturel. Le modèle préserve la composition de votre image tout en ajoutant mouvement dynamique et profondeur. Prévisualisez le résultat avec audio synchronisé, puis téléchargez votre vidéo terminée au format MP4.

Comment Utiliser LTX-2.3 pour le Texte-Vidéo

Créez des vidéos IA époustouflantes avec audio synchronisé en trois étapes simples

  1. Sélectionnez le Modèle Texte-Vidéo LTX-2.3

    Naviguez vers la page de génération vidéo et sélectionnez le modèle texte-vidéo LTX-2.3. Choisissez votre résolution préférée (480p à 1080p), ratio d'aspect (16:9 paysage ou 9:16 portrait), fréquence d'images (24 ou 48 FPS) et durée vidéo (5-20 secondes). Attachez optionnellement jusqu'à 3 adaptateurs LoRA pour des styles personnalisés.

  2. Rédigez Votre Invite et Configurez les Paramètres

    Élaborez une description textuelle détaillée de la vidéo que vous souhaitez créer. Le connecteur texte 4x plus grand de LTX-2.3 assure une adhérence supérieure au prompt, soyez donc spécifique sur la composition de scène, les mouvements de caméra, l'éclairage et les actions. Activez l'optimisation du prompt, basculez la génération audio synchronisée et ajustez les paramètres supplémentaires.

  3. Générez et Téléchargez Votre Vidéo

    Cliquez sur générer et attendez que LTX-2.3 rende votre vidéo avec le VAE reconstruit pour des textures, visages et textes plus nets. Prévisualisez le résultat avec l'audio synchronisé HiFi-GAN. Téléchargez votre vidéo terminée au format MP4 pour une utilisation immédiate dans vos projets, réseaux sociaux ou flux de production.

Vidéos YouTube LTX-2.3

Regardez des démonstrations et tutoriels de LTX-2.3, le modèle fondation audio-vidéo open-source de 22 milliards de paramètres

  • Introducing LTX Desktop: An Open Source Video Editor Powered by LTX-2.3 - LTX
  • Run LTX 2.3 Video Generation AI Model Locally with ComfyUI - Easy Guide - Fahd Mirza
  • LTX 2.3 in Comfy UI — Text to Video & Image to Video - AI Ninja
  • LTX-2.3 In ComfyUI = AI Video Generation At 0 Credits Per Run - Nerdy Rodent
  • LTX-2.3 ComfyUI Workflow Tutorial | Text-to-Video, Image-to-Video, Talking Avatar & Audio Generation - Vantage with AI
  • LTX 2.3 Released - ComfyUI Workflow & A New Tool I Built To Run AI😃😃😃 - Benji’s AI Playground

Vidéos YouTube LTX-2.3

Regardez des démonstrations et tutoriels de LTX-2.3, le modèle fondation audio-vidéo open-source de 22 milliards de paramètres

Avis populaires sur LTX-2.3 sur X

Découvrez ce que dit la communauté IA sur LTX-2.3, le modèle fondation audio-vidéo open-source de 22 milliards de paramètres

Acaban de liberar LTX-2.3. Un modelo de video con IA que genera 4K + audio + lip-sync. 100% gratis y open-source. Puedes crear clips de hasta 20s desde tu propio PC. Te dejo el enlace en el comentario: (Si no, prueba lo último de Kling) x.com/ivnways/status…

Image
IVAN | IA
IVAN | IA
@ivnways

Kling 3.0 Motion Control se actualiza por completo. Basado en la versión 2.6, ahora ofrece: - Consistencia facial impecable - Estabilidad desde múltiples ángulos - Eidelidad en secuencias largas - Reproducción fiel de emociones complejas

166
Reply

LTX-2.3 releasing soon 😊 LTX-2.3 brings four major improvements over LTX-2. A redesigned VAE produces sharper fine details, more realistic textures, and cleaner edges. A new gated attention text connector means prompts are followed more closely – descriptions of timing,  Show more

Image
Wildminder
Wildminder
@wildmindai

LTX-2.3 officially released! Wait, unreleased. 404. ComfyUI team: “Nah, we already support it.” github.com/Comfy-Org/Comf…

Image
5
Reply
FAQ

Questions Fréquemment Posées

LTX-2.3 est un modèle fondation audio-vidéo DiT de 22 milliards de paramètres par Lightricks, publié le 5 mars 2026. Il dispose d'un VAE entièrement reconstruit pour des textures, visages, cheveux et rendus de texte plus nets, d'un connecteur texte 4x plus grand pour une meilleure adhérence au prompt, d'un support portrait natif 9:16, d'un support d'adaptateurs LoRA et d'un nouveau vocodeur HiFi-GAN pour un audio plus propre. Il est open-source sous Apache 2.0.
LTX-2.3 introduit plusieurs mises à niveau majeures : le VAE a été entièrement reconstruit pour des détails fins nettement plus précis. Le connecteur texte est 4x plus grand, résultant en une bien meilleure adhérence au prompt. La génération image-vidéo a été améliorée avec moins d'effet Ken Burns et moins de gel. La qualité audio est plus propre grâce à un nouveau vocodeur HiFi-GAN. Il ajoute également le support vidéo portrait natif 9:16 et le support des adaptateurs LoRA.
LTX-2.3 génère des vidéos nativement de 480p à 1080p, avec support d'upscaling jusqu'à 4K. Il supporte les formats paysage (16:9) et portrait (9:16), le mode portrait supportant jusqu'à 1080x1920 de résolution. La durée vidéo varie de 5 à 20 secondes, avec des options de fréquence d'images de 24 ou 48 FPS.
LTX-2.3 supporte jusqu'à 3 adaptateurs LoRA (Low-Rank Adaptation) simultanés pour personnaliser la sortie du modèle. Les LoRA peuvent être utilisés pour maintenir des apparences de personnages cohérentes, appliquer des styles artistiques spécifiques ou contrôler les motifs de mouvement. Cela permet une personnalisation spécifique à la marque et des flux créatifs spécialisés sans réentraîner le modèle complet.
LTX-2.3 génère du contenu audio-vidéo synchronisé utilisant un nouveau vocodeur HiFi-GAN qui produit un audio plus propre et de plus haute fidélité par rapport à LTX-2. Le modèle génère des effets sonores contextuels, de l'audio ambiant et des dialogues qui correspondent naturellement au contenu visuel. La génération audio peut être activée ou désactivée selon vos besoins.
Oui, LTX-2.3 est publié sous licence Apache 2.0, l'une des licences open-source les plus permissives. Les poids complets du modèle et le code d'entraînement sont accessibles publiquement, permettant aux développeurs de construire des applications personnalisées, d'affiner pour des cas d'usage spécifiques ou d'intégrer le modèle directement dans des pipelines de production pour un usage personnel et commercial.