Dreamega

LTX-2.3 KI-Videogenerator

Lightricks LTX-2.3 ist ein 22-Milliarden-Parameter DiT Audio-Video-Grundlagenmodell mit neugebautem VAE für schärfere Texturen, Gesichter, Haare und Textdarstellung. Mit 4x größerem Text-Konnektor für bessere Prompt-Befolgung, nativem 9:16 Hochformat-Modus bis 1080x1920, LoRA-Unterstützung mit bis zu 3 benutzerdefinierten Adaptern und sauberem Audio über HiFi-GAN-Vokoder. Generiert 480p bis 1080p Videos von 5 bis 20 Sekunden mit synchronisiertem Audio.

/models
Lightricks Ltx
Reel · Specifications

Was ist LTX-2.3?

Lightricks' 22-Milliarden-Parameter DiT Audio-Video-Grundlagenmodell mit neugebautem VAE und Open-Source-Gewichten

  1. · 0122BParameter
  2. · 02Bis zu 4KAuflösung
  3. · 035-20sDauer
  4. · 04Apache 2.0Lizenz

Ein Open-Source-Modell der nächsten Generation mit schärferen Details, besserer Prompt-Befolgung, nativem Hochformat-Video und sauberem synchronisiertem Audio unter Apache 2.0-Lizenz.

Reel · Capabilities

LTX-2.3 Funktionen

Entdecken Sie die leistungsstarken Fähigkeiten von Lightricks LTX-2.3 für Videoproduktion der nächsten Generation

  1. Feature 01 / 08

    Neugebauter VAE-Motor

    Ein vollständig neugebauter Variational Autoencoder liefert dramatisch schärfere feine Details einschließlich Texturen, Gesichter, Haarsträhnen, Textüberlagerungen und scharfe Kanten. Ein grundlegendes Upgrade gegenüber LTX-2 für professionelle Ausgabequalität.

  2. Feature 02 / 08

    Verbesserte Prompt-Befolgung

    Ein 4x größerer Text-Konnektor stellt sicher, dass LTX-2.3 Ihre Prompts mit deutlich höherer Genauigkeit befolgt. Komplexe Szenenbeschreibungen, spezifische Aktionen und detaillierte visuelle Anweisungen werden im generierten Video originalgetreu wiedergegeben.

  3. Feature 03 / 08

    Natives Hochformat-Video

    Erstklassige 9:16 vertikale Video-Unterstützung mit bis zu 1080x1920 Auflösung, speziell für TikTok, Instagram Reels und YouTube Shorts entwickelt. Kein Zuschneiden oder Letterboxing von reinen Querformat-Modellen mehr.

  4. Feature 04 / 08

    Synchronisiertes Audio-Video

    Sauberere, hochtreuere Audiogenerierung durch einen neuen HiFi-GAN-Vokoder. Erzeugt kontextgerechte Soundeffekte, Umgebungsaudio und Dialoge, die sich natürlich mit dem visuellen Inhalt synchronisieren.

  5. Feature 05 / 08

    Benutzerdefinierte LoRA-Adapter

    Wenden Sie bis zu 3 gleichzeitige LoRA-Adapter an, um Stil, Charakterkonsistenz oder Bewegungsmuster anzupassen. Optimieren Sie Ausgaben für markenspezifische Ästhetik oder spezialisierte kreative Workflows.

  6. Feature 06 / 08

    Multi-Auflösungs-Ausgabe

    Flexible Auflösung von 480p für schnelle Entwürfe bis 1080p für produktionsreife Ausgabe, mit Upscaling-Unterstützung bis 4K. Wählen Sie 24 oder 48 FPS Bildrate je nach Projektanforderungen.

  7. Feature 07 / 08

    Verbessertes Bild-zu-Video

    Deutlich reduzierter Ken-Burns-Effekt und statische Einfrier-Artefakte. Bilder werden mit echtem Motion und dynamischer Kameraarbeit animiert und erzeugen natürliche Bewegung, die Standbilder zum Leben erweckt.

  8. Feature 08 / 08

    Open-Source-Grundlage

    Veröffentlicht unter Apache 2.0-Lizenz mit vollständigen Modellgewichten und Trainingscode. Erstellen Sie benutzerdefinierte Anwendungen, optimieren Sie für spezifische Anwendungsfälle oder integrieren Sie direkt in Ihre Produktionspipeline.

So Verwenden Sie LTX-2.3 für Bild-zu-Video

Verwandeln Sie stehende Bilder in dynamische Videos mit verbesserter Bewegung in drei einfachen Schritten

  1. Wählen Sie das LTX-2.3 Bild-zu-Video-Modell und Laden Sie ein Bild Hoch

    Navigieren Sie zur Videogenerierungsseite und wählen Sie das LTX-2.3 Bild-zu-Video-Modell. Laden Sie ein hochwertiges Standbild (JPG-, PNG- oder WEBP-Format) hoch. Wählen Sie Auflösung (480p bis 1080p), Seitenverhältnis (16:9 oder 9:16 Hochformat), Bildrate (24 oder 48 FPS) und Dauer (5-20 Sekunden). Optional LoRA-Adapter für benutzerdefinierte Stile anhängen.

  2. Fügen Sie einen Bewegungs-Prompt Hinzu und Konfigurieren Sie die Einstellungen

    Schreiben Sie einen detaillierten Prompt, der beschreibt, wie Sie möchten, dass Ihr Bild zum Leben erweckt wird. LTX-2.3s verbessertes Bild-zu-Video erzeugt echte Bewegung mit weniger Ken-Burns-Effekt und weniger Einfrieren. Spezifizieren Sie Kamerabewegungen, Motivaktionen und Umgebungseffekte. Aktivieren Sie die Audiogenerierung für synchronisierten HiFi-GAN-Sound und verwenden Sie Prompt-Optimierung für beste Ergebnisse.

  3. Generieren und Laden Sie Ihr Video Herunter

    Klicken Sie auf Generieren und warten Sie, bis LTX-2.3 Ihr Bild mit dem neugebauten VAE für schärfere Details und natürliche Bewegung animiert. Das Modell bewahrt die Komposition Ihres Bildes, während es dynamische Bewegung und Tiefe hinzufügt. Sehen Sie die Vorschau mit synchronisiertem Audio an und laden Sie dann Ihr fertiges Video im MP4-Format herunter.

So Verwenden Sie LTX-2.3 für Text-zu-Video

Erstellen Sie beeindruckende KI-Videos mit synchronisiertem Audio in drei einfachen Schritten

  1. Wählen Sie das LTX-2.3 Text-zu-Video-Modell

    Navigieren Sie zur Videogenerierungsseite und wählen Sie das LTX-2.3 Text-zu-Video-Modell. Wählen Sie Ihre bevorzugte Auflösung (480p bis 1080p), Seitenverhältnis (16:9 Querformat oder 9:16 Hochformat), Bildrate (24 oder 48 FPS) und Videodauer (5-20 Sekunden). Optional bis zu 3 LoRA-Adapter für benutzerdefinierte Stile anhängen.

  2. Schreiben Sie Ihre Aufforderung und Konfigurieren Sie die Einstellungen

    Erstellen Sie eine detaillierte Textbeschreibung des Videos, das Sie erstellen möchten. LTX-2.3s 4x größerer Text-Konnektor gewährleistet überlegene Prompt-Befolgung, seien Sie also spezifisch bei Szenenkomposition, Kamerabewegungen, Beleuchtung und Aktionen. Aktivieren Sie die Prompt-Optimierung, schalten Sie die synchronisierte Audiogenerierung ein und passen Sie weitere Parameter an.

  3. Generieren und Laden Sie Ihr Video Herunter

    Klicken Sie auf Generieren und warten Sie, bis LTX-2.3 Ihr Video mit dem neugebauten VAE für schärfere Texturen, Gesichter und Text rendert. Sehen Sie sich die Vorschau mit synchronisiertem HiFi-GAN-Audio an. Laden Sie Ihr fertiges Video im MP4-Format für die sofortige Verwendung in Ihren Projekten, sozialen Medien oder Produktionsworkflows herunter.

LTX-2.3 YouTube-Videos

Sehen Sie sich Demonstrationen und Tutorials zu LTX-2.3 an, dem 22-Milliarden-Parameter Open-Source Audio-Video-Grundlagenmodell

  • Introducing LTX Desktop: An Open Source Video Editor Powered by LTX-2.3 - LTX
  • Run LTX 2.3 Video Generation AI Model Locally with ComfyUI - Easy Guide - Fahd Mirza
  • LTX 2.3 in Comfy UI — Text to Video & Image to Video - AI Ninja
  • LTX-2.3 In ComfyUI = AI Video Generation At 0 Credits Per Run - Nerdy Rodent
  • LTX-2.3 ComfyUI Workflow Tutorial | Text-to-Video, Image-to-Video, Talking Avatar & Audio Generation - Vantage with AI
  • LTX 2.3 Released - ComfyUI Workflow & A New Tool I Built To Run AI😃😃😃 - Benji’s AI Playground

LTX-2.3 YouTube-Videos

Sehen Sie sich Demonstrationen und Tutorials zu LTX-2.3 an, dem 22-Milliarden-Parameter Open-Source Audio-Video-Grundlagenmodell

Beliebte Bewertungen zu LTX-2.3 auf X

Sehen Sie, was die KI-Community über LTX-2.3 sagt, das 22-Milliarden-Parameter Open-Source Audio-Video-Grundlagenmodell

Acaban de liberar LTX-2.3. Un modelo de video con IA que genera 4K + audio + lip-sync. 100% gratis y open-source. Puedes crear clips de hasta 20s desde tu propio PC. Te dejo el enlace en el comentario: (Si no, prueba lo último de Kling) x.com/ivnways/status…

Image
IVAN | IA
IVAN | IA
@ivnways

Kling 3.0 Motion Control se actualiza por completo. Basado en la versión 2.6, ahora ofrece: - Consistencia facial impecable - Estabilidad desde múltiples ángulos - Eidelidad en secuencias largas - Reproducción fiel de emociones complejas

166
Reply

LTX-2.3 releasing soon 😊 LTX-2.3 brings four major improvements over LTX-2. A redesigned VAE produces sharper fine details, more realistic textures, and cleaner edges. A new gated attention text connector means prompts are followed more closely – descriptions of timing,  Show more

Image
Wildminder
Wildminder
@wildmindai

LTX-2.3 officially released! Wait, unreleased. 404. ComfyUI team: “Nah, we already support it.” github.com/Comfy-Org/Comf…

Image
5
Reply
FAQ

Häufig Gestellte Fragen

LTX-2.3 ist ein 22-Milliarden-Parameter DiT Audio-Video-Grundlagenmodell von Lightricks, veröffentlicht am 5. März 2026. Es verfügt über einen vollständig neugebauten VAE für schärfere Texturen, Gesichter, Haare und Textdarstellung, einen 4x größeren Text-Konnektor für bessere Prompt-Befolgung, nativen 9:16 Hochformat-Support, LoRA-Adapter-Unterstützung und einen neuen HiFi-GAN-Vokoder für saubereres Audio. Es ist Open-Source unter Apache 2.0.
LTX-2.3 führt mehrere wichtige Upgrades ein: Der VAE wurde für dramatisch schärfere feine Details vollständig neugebaut. Der Text-Konnektor ist 4x größer, was zu einer deutlich besseren Prompt-Befolgung führt. Die Bild-zu-Video-Generierung wurde mit weniger Ken-Burns-Effekt und weniger Einfrieren verbessert. Die Audioqualität ist dank des neuen HiFi-GAN-Vokoders sauberer. Es fügt auch nativen 9:16 Hochformat-Video-Support und LoRA-Adapter-Unterstützung hinzu.
LTX-2.3 generiert Videos nativ von 480p bis 1080p, mit Upscaling-Unterstützung bis 4K. Es unterstützt sowohl Querformat (16:9) als auch Hochformat (9:16) Seitenverhältnisse, wobei der Hochformat-Modus bis zu 1080x1920 Auflösung unterstützt. Die Videodauer reicht von 5 bis 20 Sekunden, mit Bildratenoptionen von 24 oder 48 FPS.
LTX-2.3 unterstützt bis zu 3 gleichzeitige LoRA-Adapter (Low-Rank Adaptation) zur Anpassung der Modellausgabe. LoRAs können verwendet werden, um konsistente Charaktererscheinungen beizubehalten, bestimmte künstlerische Stile anzuwenden oder Bewegungsmuster zu steuern. Dies ermöglicht markenspezifische Anpassungen und spezialisierte kreative Workflows ohne Neutraining des gesamten Modells.
LTX-2.3 generiert synchronisiertes Audio-Video-Content unter Verwendung eines neuen HiFi-GAN-Vokoders, der im Vergleich zu LTX-2 saubereres und hochtreueres Audio erzeugt. Das Modell generiert kontextgerechte Soundeffekte, Umgebungsaudio und Dialoge, die natürlich zum visuellen Inhalt passen. Die Audiogenerierung kann je nach Bedarf ein- oder ausgeschaltet werden.
Ja, LTX-2.3 ist unter der Apache 2.0-Lizenz veröffentlicht, einer der freizügigsten Open-Source-Lizenzen. Die vollständigen Modellgewichte und der Trainingscode sind öffentlich zugänglich, sodass Entwickler benutzerdefinierte Anwendungen erstellen, für spezifische Anwendungsfälle optimieren oder das Modell direkt in Produktionspipelines für persönliche und kommerzielle Nutzung integrieren können.