Introducing LTX-2.3 Our most production-ready model yet. The fastest 4K video generation in the world with built-in native dialogue. Here’s what’s new 🧵 1/9
مولّد الفيديو LTX-2.3 بالذكاء الاصطناعي
LTX-2.3 من Lightricks نموذج أساسي للصوت والفيديو مبني على بنية DiT بـ 22 مليار معامل، مع VAE مُعاد بناؤه لتقديم قوام وأوجه وشعر ونصوص أكثر حدة. يتضمن موصل نص أكبر بـ 4 مرات لاتباع أفضل للمطالبات، ووضع عمودي أصلي 9:16 بحد أقصى 1080x1920، ودعم LoRA بما يصل إلى 3 محوّلات مخصصة، وصوت أنقى عبر مُشكّل موجات HiFi-GAN. يولّد مقاطع فيديو من 480p إلى 1080p بمدة 5 إلى 20 ثانية مع صوت متزامن.
/modelsما هو LTX-2.3؟
نموذج أساسي للصوت والفيديو DiT من Lightricks بـ 22 مليار معامل مع VAE مُعاد بناؤه وأوزان مفتوحة المصدر
- · 0122Bالمعاملات
- · 02حتى 4Kالدقة
- · 035-20 ثانيةالمدة
- · 04Apache 2.0الترخيص
نموذج مفتوح المصدر من الجيل القادم يُقدّم تفاصيل أكثر حدة، والتزاماً أفضل بالمطالبات، وفيديو عمودي أصلي، وصوتاً متزامناً أنظف بموجب ترخيص Apache 2.0.
ميزات LTX-2.3
اكتشف القدرات القوية لـ Lightricks LTX-2.3 لإنتاج الفيديو من الجيل التالي
- Feature 01 / 08
محرك VAE مُعاد بناؤه
يُقدّم محرك الترميز التلقائي المتغير المُعاد بناؤه كلياً تفاصيل دقيقة أكثر حدةً بشكل ملحوظ تشمل الملمس والوجوه وخصلات الشعر والنصوص المتراكبة والحواف الحادة. ترقية جوهرية على LTX-2 للمخرجات ذات الجودة الاحترافية.
- Feature 02 / 08
التزام محسّن بالمطالبة
يضمن موصل نصي أكبر بـ 4 مرات أن يتبع LTX-2.3 مطالباتك بدقة أكبر بكثير. أوصاف المشاهد المعقدة والأفعال المحددة والتعليمات البصرية التفصيلية تُعرض بأمانة في الفيديو المُولَّد.
- Feature 03 / 08
فيديو عمودي أصيل
دعم من الدرجة الأولى للفيديو العمودي بنسبة 9:16 بدقة تصل إلى 1080x1920، مصمم خصيصاً لـ TikTok وInstagram Reels وYouTube Shorts. لا مزيد من القص أو الحواف السوداء من النماذج الأفقية فحسب.
- Feature 04 / 08
صوت وفيديو متزامنان
توليد صوت أنظف وذو جودة أعلى مدعوم بمُشكّل صوت HiFi-GAN الجديد. يُنتج مؤثرات صوتية مناسبة للسياق وصوتاً محيطياً وحوارات تتزامن بشكل طبيعي مع المحتوى المرئي.
- Feature 05 / 08
محوّلات LoRA مخصصة
طبّق ما يصل إلى 3 محوّلات LoRA في آنٍ واحد لتخصيص الأسلوب أو تناسق الشخصية أو أنماط الحركة. ضبط دقيق للمخرجات لجماليات خاصة بعلامة تجارية أو سير عمل إبداعية متخصصة.
- Feature 06 / 08
مخرجات متعددة الدقة
دقة مرنة من 480p للمسودات السريعة حتى 1080p للمخرجات الجاهزة للإنتاج، مع دعم التكبير إلى 4K. اختر معدلات إطارات 24 أو 48 إطاراً في الثانية لتلبية متطلبات مشروعك.
- Feature 07 / 08
تحسين تحويل الصورة إلى فيديو
تقليل ملحوظ لتأثير Ken Burns وتشويهات التجميد الثابت. تُحرَّك الصور بحركة حقيقية وعمل كاميرا ديناميكي، مُنتجاً حركة طبيعية تُحيي الصور الثابتة.
- Feature 08 / 08
أساس مفتوح المصدر
مُصدَر تحت رخصة Apache 2.0 مع أوزان النموذج الكاملة ورمز التدريب متاحَين. أنشئ تطبيقات مخصصة أو اضبط لحالات استخدام محددة أو ادمج مباشرةً في خط إنتاجك.
كيفية استخدام LTX-2.3 لتوليد الفيديو من الصورة
حوّل الصور الثابتة إلى مقاطع فيديو ديناميكية بحركة محسّنة في ثلاث خطوات بسيطة
اختر نموذج LTX-2.3 للفيديو من الصورة وارفع صورتك
انتقل إلى صفحة توليد الفيديو واختر نموذج LTX-2.3 للفيديو من الصورة. ارفع صورة ثابتة عالية الجودة (بصيغة JPG أو PNG أو WEBP). اختر الدقة (من 480p إلى 1080p) ونسبة العرض إلى الارتفاع (16:9 أو 9:16 عمودي) ومعدل الإطارات (24 أو 48 FPS) والمدة (5-20 ثانية). يمكنك اختيارياً إرفاق محوّلات LoRA للأساليب المخصصة.
أضف موجّه الحركة واضبط الإعدادات
اكتب موجّهاً تفصيلياً يصف كيف تريد أن تنبض صورتك بالحياة. يُنتج LTX-2.3 المحسّن للفيديو من الصورة حركة حقيقية مع تأثير Ken Burns أقل وتجميد أقل. حدّد حركات الكاميرا وأفعال الموضوع والتأثيرات البيئية. فعّل توليد الصوت للحصول على صوت HiFi-GAN متزامن.
ولّد الفيديو ونزّله
انقر على توليد وانتظر حتى يحرّك LTX-2.3 صورتك بواسطة VAE المُعاد بناؤه للحصول على تفاصيل أحدّ وحركة طبيعية. يحافظ النموذج على تكوين صورتك مع إضافة حركة ديناميكية وعمق. استعرض النتيجة مع الصوت المتزامن، ثم نزّل الفيديو المنتهي بصيغة MP4.
كيفية استخدام LTX-2.3 لتوليد الفيديو من النص
أنشئ مقاطع فيديو ذكاء اصطناعي مذهلة مع صوت متزامن في ثلاث خطوات بسيطة
اختر نموذج LTX-2.3 للفيديو من النص
انتقل إلى صفحة توليد الفيديو واختر نموذج LTX-2.3 للفيديو من النص. اختر الدقة المفضلة (من 480p إلى 1080p) ونسبة العرض إلى الارتفاع (16:9 أفقي أو 9:16 عمودي) ومعدل الإطارات (24 أو 48 FPS) ومدة الفيديو (5-20 ثانية). يمكنك اختيارياً إرفاق حتى 3 محوّلات LoRA للأساليب المخصصة.
اكتب موجّهك واضبط الإعدادات
صِغ وصفاً نصياً تفصيلياً للفيديو الذي تريد إنشاءه. يضمن موصّل النص الأكبر 4 مرات في LTX-2.3 التزاماً فائقاً بالموجّه، لذا كن محدداً بشأن تكوين المشهد وحركات الكاميرا والإضاءة والأفعال. فعّل تحسين الموجّه للحصول على نتائج أفضل وفعّل توليد الصوت المتزامن.
ولّد الفيديو ونزّله
انقر على توليد وانتظر حتى يُصيّر LTX-2.3 فيديوك بواسطة VAE المُعاد بناؤه للحصول على ملمس ووجوه ونص أحدّ. استعرض النتيجة مع الصوت المتزامن HiFi-GAN. نزّل الفيديو المنتهي بصيغة MP4 للاستخدام الفوري في مشاريعك أو وسائل التواصل الاجتماعي أو سير عمل الإنتاج.
مقاطع فيديو LTX-2.3 على YouTube
شاهد العروض والدروس التعليمية لـ LTX-2.3، النموذج الأساسي مفتوح المصدر للصوت والفيديو بـ 22 مليار معامل
- Introducing LTX Desktop: An Open Source Video Editor Powered by LTX-2.3 - LTX
- Run LTX 2.3 Video Generation AI Model Locally with ComfyUI - Easy Guide - Fahd Mirza
- LTX 2.3 in Comfy UI — Text to Video & Image to Video - AI Ninja
- LTX-2.3 In ComfyUI = AI Video Generation At 0 Credits Per Run - Nerdy Rodent
- LTX-2.3 ComfyUI Workflow Tutorial | Text-to-Video, Image-to-Video, Talking Avatar & Audio Generation - Vantage with AI
- LTX 2.3 Released - ComfyUI Workflow & A New Tool I Built To Run AI😃😃😃 - Benji’s AI Playground
مقاطع فيديو LTX-2.3 على YouTube
شاهد العروض والدروس التعليمية لـ LTX-2.3، النموذج الأساسي مفتوح المصدر للصوت والفيديو بـ 22 مليار معامل
آراء شائعة حول LTX-2.3 على X
اطّلع على ما تقوله مجتمع الذكاء الاصطناعي عن LTX-2.3، النموذج الأساسي مفتوح المصدر للصوت والفيديو بـ 22 مليار معامل
Keyframes and structured control are now more deeply integrated. LTX-2.3 is trained with multi-task objectives from the pretraining stage, including image-to-video, retake, keyframes, and more. This makes transitions, controlled scene evolution, and multi-shot workflows more Show more
🚀 Today we’re releasing LTX-2.3 with open weights + training code, alongside the API, LTX Studio, and LTX-Desktop - a full-featured video editing app that runs on your local GPU. Audio+video generation just leveled up: quality + capabilities + tooling - all open-source. 🧵👇
https://t.co/MGZ9rXyOsh
Acaban de liberar LTX-2.3. Un modelo de video con IA que genera 4K + audio + lip-sync. 100% gratis y open-source. Puedes crear clips de hasta 20s desde tu propio PC. Te dejo el enlace en el comentario: (Si no, prueba lo último de Kling) x.com/ivnways/status…
Kling 3.0 Motion Control se actualiza por completo. Basado en la versión 2.6, ahora ofrece: - Consistencia facial impecable - Estabilidad desde múltiples ángulos - Eidelidad en secuencias largas - Reproducción fiel de emociones complejas
LTX 2.3 seems to be coming out soon. No models on Hugging Faces just yet, but soon I'm sure ~ ltx.io/model/ltx-2-3
LTX-2.3 releasing soon 😊 LTX-2.3 brings four major improvements over LTX-2. A redesigned VAE produces sharper fine details, more realistic textures, and cleaner edges. A new gated attention text connector means prompts are followed more closely – descriptions of timing, Show more
LTX-2.3 officially released! Wait, unreleased. 404. ComfyUI team: “Nah, we already support it.” github.com/Comfy-Org/Comf…