Dreamega

LTX-2.3 AI 影片生成器

Lightricks LTX-2.3 是一款220億參數的DiT音影片基礎模型,配備重建的VAE,可生成更清晰的紋理、面部、頭髮和文字渲染。具有4倍大的文本連接器以實現更好的提示詞遵循,原生9:16直向模式最高1080x1920,支援最多3個自定義LoRA適配器,以及通過HiFi-GAN聲碼器生成更清晰的音訊。生成480p至1080p、5至20秒的同步音影片。

/models
Lightricks Ltx
Reel · Specifications

什麼是LTX-2.3?

Lightricks 220億參數的DiT音影片基礎模型,具有重建VAE和開源權重

  1. · 01220參數量
  2. · 02最高4K解析度
  3. · 035-20秒時長
  4. · 04Apache 2.0許可證

新一代開源模型,在Apache 2.0許可下提供更清晰的細節、更好的提示詞遵循、原生直向影片和更乾淨的同步音訊。

Reel · Capabilities

LTX-2.3功能

探索Lightricks LTX-2.3用於新一代影片製作的強大功能

  1. Feature 01 / 08

    重建VAE引擎

    完全重建的變分自編碼器提供顯著更清晰的精細細節,包括紋理、面部、髮絲、文字疊加和銳利邊緣。相比LTX-2的根本性升級,實現專業級輸出質量。

  2. Feature 02 / 08

    增強提示詞遵循

    4倍大的文本連接器確保LTX-2.3以顯著更高的準確性遵循您的提示詞。複雜的場景描述、特定動作和詳細的視覺指令都能在生成的影片中忠實呈現。

  3. Feature 03 / 08

    原生直向影片

    一流的9:16直向影片支援,解析度最高1080x1920,專為TikTok、Instagram Reels和YouTube Shorts打造。無需再從橫向模型裁剪或添加黑邊。

  4. Feature 04 / 08

    同步音影片

    由全新HiFi-GAN聲碼器驅動的更乾淨、更高保真的音訊生成。生成與視覺內容自然同步的上下文音效、環境音訊和對話。

  5. Feature 05 / 08

    自定義LoRA適配器

    支援同時應用最多3個LoRA適配器來自定義風格、角色一致性或運動模式。為品牌特定美學或專業創意工作流程微調輸出。

  6. Feature 06 / 08

    多解析度輸出

    靈活解析度從480p快速草稿到1080p生產級輸出,支援放大至4K。選擇24或48 FPS幀率以匹配您的項目需求。

  7. Feature 07 / 08

    改進的圖生影片

    顯著減少Ken Burns效果和靜態凍結偽影。影像以真實的運動和動態鏡頭製作進行動畫化,產生自然的運動,使靜態影像栩栩如生。

  8. Feature 08 / 08

    開源基礎

    基於Apache 2.0許可發佈,提供完整的模型權重和訓練代碼。構建自定義應用程式,針對特定用例微調,或直接整合到您的生產流程中。

如何使用LTX-2.3進行圖生影片

通過三個簡單步驟將靜態影像轉化為具有改進運動的動態影片

  1. 選擇LTX-2.3圖生影片模型並上傳影像

    導航到影片生成頁面並選擇LTX-2.3圖生影片模型。上傳高質量的靜態影像(JPG、PNG或WEBP格式)。選擇解析度(480p至1080p)、寬高比(16:9或9:16直向)、幀率(24或48 FPS)和時長(5-20秒)。可選附加LoRA適配器以自定義風格。

  2. 添加運動提示詞並配置設定

    撰寫詳細的提示詞描述您希望影像如何動起來。LTX-2.3改進的圖生影片產生真實的運動,更少Ken Burns效果和更少凍結。指定鏡頭運動、主體動作和環境效果。啟用音訊生成以獲取同步的HiFi-GAN聲音,使用提示詞最佳化以獲得最佳結果。

  3. 生成並下載影片

    點擊生成並等待LTX-2.3使用重建的VAE為更清晰的細節和自然運動動畫化您的影像。模型在添加動態運動和深度的同時保持影像的構圖。預覽帶同步音訊的結果,然後以MP4格式下載完成的影片。

如何使用LTX-2.3進行文生影片

通過三個簡單步驟創建帶同步音訊的精彩AI影片

  1. 選擇LTX-2.3文生影片模型

    導航到影片生成頁面並選擇LTX-2.3文生影片模型。選擇首選解析度(480p至1080p)、寬高比(16:9橫向或9:16直向)、幀率(24或48 FPS)和影片時長(5-20秒)。可選附加最多3個LoRA適配器以自定義風格。

  2. 撰寫提示詞並配置設定

    詳細描述您想要創建的影片。LTX-2.3的4倍大文本連接器確保優越的提示詞遵循,請具體描述場景構圖、鏡頭運動、照明和動作。啟用提示詞最佳化以獲得更好的結果,切換同步音訊生成,並調整其他參數。

  3. 生成並下載影片

    點擊生成並等待LTX-2.3使用重建的VAE渲染更清晰的紋理、面部和文字。預覽帶有同步HiFi-GAN音訊的結果。以MP4格式下載完成的影片,可立即用於您的項目、社交媒體或生產工作流程。

LTX-2.3 YouTube 影片

觀看 LTX-2.3 示範和教學,220億參數的開源音影片基礎模型

  • Introducing LTX Desktop: An Open Source Video Editor Powered by LTX-2.3 - LTX
  • Run LTX 2.3 Video Generation AI Model Locally with ComfyUI - Easy Guide - Fahd Mirza
  • LTX 2.3 in Comfy UI — Text to Video & Image to Video - AI Ninja
  • LTX-2.3 In ComfyUI = AI Video Generation At 0 Credits Per Run - Nerdy Rodent
  • LTX-2.3 ComfyUI Workflow Tutorial | Text-to-Video, Image-to-Video, Talking Avatar & Audio Generation - Vantage with AI
  • LTX 2.3 Released - ComfyUI Workflow & A New Tool I Built To Run AI😃😃😃 - Benji’s AI Playground

LTX-2.3 YouTube 影片

觀看 LTX-2.3 示範和教學,220億參數的開源音影片基礎模型

LTX-2.3 在 X 上的熱門評價

了解 AI 社群對 LTX-2.3 的評價,220億參數的開源音影片基礎模型

Acaban de liberar LTX-2.3. Un modelo de video con IA que genera 4K + audio + lip-sync. 100% gratis y open-source. Puedes crear clips de hasta 20s desde tu propio PC. Te dejo el enlace en el comentario: (Si no, prueba lo último de Kling) x.com/ivnways/status…

Image
IVAN | IA
IVAN | IA
@ivnways

Kling 3.0 Motion Control se actualiza por completo. Basado en la versión 2.6, ahora ofrece: - Consistencia facial impecable - Estabilidad desde múltiples ángulos - Eidelidad en secuencias largas - Reproducción fiel de emociones complejas

166
Reply

LTX-2.3 releasing soon 😊 LTX-2.3 brings four major improvements over LTX-2. A redesigned VAE produces sharper fine details, more realistic textures, and cleaner edges. A new gated attention text connector means prompts are followed more closely – descriptions of timing,  Show more

Image
Wildminder
Wildminder
@wildmindai

LTX-2.3 officially released! Wait, unreleased. 404. ComfyUI team: “Nah, we already support it.” github.com/Comfy-Org/Comf…

Image
5
Reply
FAQ

常見問題

仲有其他問題?

LTX-2.3是Lightricks於2026年3月5日發佈的220億參數DiT音影片基礎模型。具有完全重建的VAE以實現更清晰的紋理、面部、頭髮和文字渲染,4倍大的文本連接器以更好地遵循提示詞,原生9:16直向支援,LoRA適配器支援,以及新的HiFi-GAN聲碼器以獲得更清晰的音訊。基於Apache 2.0開源。
LTX-2.3引入了幾項重大升級:VAE已完全重建,精細細節顯著更清晰。文本連接器大了4倍,提示詞遵循效果大幅提升。圖生影片改進了減少Ken Burns效果和凍結現象。由於新的HiFi-GAN聲碼器,音訊質量更乾淨。還新增了原生9:16直向影片支援和LoRA適配器支援。
LTX-2.3原生生成480p至1080p的影片,支援放大至4K。支援橫向(16:9)和直向(9:16)兩種寬高比,直向模式最高支援1080x1920解析度。影片時長從5到20秒,幀率可選24或48 FPS。
LTX-2.3支援同時使用最多3個LoRA(低秩自適應)適配器來自定義模型輸出。LoRA可用於保持一致的角色外觀、應用特定的藝術風格或控制運動模式。這允許品牌特定的定製和專業創意工作流程,而無需重新訓練完整模型。
LTX-2.3使用新的HiFi-GAN聲碼器生成同步的音影片內容,與LTX-2相比產生更乾淨、更高保真的音訊。模型生成與視覺內容自然匹配的上下文音效、環境音訊和對話。音訊生成可根據需要開啟或關閉。
是的,LTX-2.3基於Apache 2.0許可發佈,這是最寬鬆的開源許可之一。完整的模型權重和訓練代碼可公開存取,允許開發者構建自定義應用程式、針對特定用例微調,或將模型直接整合到個人和商業用途的生產流程中。