Introducing LTX-2.3 Our most production-ready model yet. The fastest 4K video generation in the world with built-in native dialogue. Here’s what’s new 🧵 1/9
LTX-2.3 AI動画生成器
Lightricks LTX-2.3は、より鮮明なテクスチャ、顔、髪、テキストレンダリングのために再構築されたVAEを備えた220億パラメータのDiT音声動画基盤モデルです。プロンプト遵守のための4倍大きなテキストコネクタ、最大1080x1920のネイティブ9:16縦型モード、最大3つのカスタムLoRAアダプター、HiFi-GANボコーダーによるクリーンなオーディオを搭載。480pから1080p、5〜20秒の同期音声動画を生成します。
/modelsLTX-2.3とは?
再構築されたVAEとオープンソースの重みを持つLightricksの220億パラメータDiT音声動画基盤モデル
- · 01220億パラメータ
- · 02最大4K解像度
- · 035-20秒期間
- · 04Apache 2.0ライセンス
Apache 2.0ライセンスの下、よりシャープなディテール、より優れたプロンプト遵守、ネイティブ縦型動画、よりクリーンな同期オーディオを提供する次世代オープンソースモデル。
LTX-2.3機能
次世代ビデオ制作のためのLightricks LTX-2.3の強力な機能を発見してください
- Feature 01 / 08
再構築VAEエンジン
完全に再構築された変分オートエンコーダが、テクスチャ、顔、髪の毛、テキストオーバーレイ、鮮明なエッジを含む劇的にシャープな微細ディテールを提供します。プロフェッショナル品質の出力のためのLTX-2からの根本的なアップグレード。
- Feature 02 / 08
強化されたプロンプト遵守
4倍大きなテキストコネクタにより、LTX-2.3は大幅に高い精度でプロンプトに従います。複雑なシーン記述、特定のアクション、詳細な視覚的指示が生成されたビデオで忠実にレンダリングされます。
- Feature 03 / 08
ネイティブ縦型ビデオ
TikTok、Instagram Reels、YouTube Shorts向けに設計された、最大1080x1920解像度の一流の9:16縦型ビデオサポート。横向き専用モデルからのクロップやレターボックスは不要です。
- Feature 04 / 08
同期オーディオ-ビデオ
新しいHiFi-GANボコーダーによる、よりクリーンで高忠実度のオーディオ生成。視覚コンテンツと自然に同期するコンテキストに適した効果音、環境オーディオ、ダイアログを生成します。
- Feature 05 / 08
カスタムLoRAアダプター
最大3つの同時LoRAアダプターを適用して、スタイル、キャラクターの一貫性、またはモーションパターンをカスタマイズ。ブランド固有の美学や専門的なクリエイティブワークフロー向けに出力を微調整。
- Feature 06 / 08
マルチ解像度出力
高速ドラフト用の480pから本番対応出力用の1080pまでの柔軟な解像度、4Kまでのアップスケーリングサポート付き。プロジェクト要件に合わせて24または48 FPSを選択。
- Feature 07 / 08
改良された画像からビデオ
ケンバーンズ効果と静的フリーズアーティファクトを大幅に削減。画像は本物のモーションとダイナミックなカメラワークでアニメーション化され、静止画像に命を吹き込む自然な動きを生み出します。
- Feature 08 / 08
オープンソース基盤
完全なモデル重みとトレーニングコードが利用可能なApache 2.0ライセンスでリリース。カスタムアプリケーションの構築、特定のユースケース向けの微調整、またはプロダクションパイプラインへの直接統合が可能です。
LTX-2.3で画像からビデオを作成する方法
3つの簡単なステップで静止画像を改善されたモーションの動的ビデオに変換
LTX-2.3画像-ビデオモデルを選択して画像をアップロード
ビデオ生成ページに移動し、LTX-2.3画像-ビデオモデルを選択します。高品質の静止画像(JPG、PNG、またはWEBP形式)をアップロードします。解像度(480pから1080p)、アスペクト比(16:9または9:16縦向き)、フレームレート(24または48 FPS)、期間(5-20秒)を選択します。オプションでカスタムスタイル用にLoRAアダプターを添付。
モーションプロンプトを追加して設定を構成
画像をどのように生き生きとさせたいかを説明する詳細なプロンプトを書きます。LTX-2.3の改良された画像からビデオは、ケンバーンズ効果の減少とフリーズの減少で本物のモーションを生成します。カメラの動き、被写体のアクション、環境効果を指定します。同期されたHiFi-GANサウンドのためにオーディオ生成を有効にし、最良の結果のためにプロンプト最適化を使用します。
ビデオを生成してダウンロード
生成をクリックし、LTX-2.3が再構築されたVAEでよりシャープなディテールと自然な動きで画像をアニメーション化するのを待ちます。モデルは動的な動きと深さを追加しながら画像の構成を保持します。同期されたオーディオで結果をプレビューし、完成したビデオをMP4形式でダウンロードします。
LTX-2.3でテキストからビデオを作成する方法
3つの簡単なステップで同期オーディオ付きの見事なAIビデオを作成
LTX-2.3テキスト-ビデオモデルを選択
ビデオ生成ページに移動し、LTX-2.3テキスト-ビデオモデルを選択します。好みの解像度(480pから1080p)、アスペクト比(16:9横向きまたは9:16縦向き)、フレームレート(24または48 FPS)、ビデオ長(5-20秒)を選択します。オプションでカスタムスタイル用に最大3つのLoRAアダプターを添付。
プロンプトを書いて設定を構成
作成したいビデオの詳細なテキスト説明を作成します。LTX-2.3の4倍大きなテキストコネクタが優れたプロンプト遵守を保証するので、シーン構成、カメラの動き、照明、アクションについて具体的に記述してください。プロンプト最適化を有効にし、同期オーディオ生成を切り替え、追加パラメータを調整します。
ビデオを生成してダウンロード
生成をクリックし、LTX-2.3が再構築されたVAEでよりシャープなテクスチャ、顔、テキストのビデオをレンダリングするのを待ちます。同期されたHiFi-GANオーディオで結果をプレビューします。完成したビデオをMP4形式でダウンロードし、プロジェクト、ソーシャルメディア、または制作ワークフローで即座に使用します。
LTX-2.3 YouTube動画
220億パラメータのオープンソース音声動画基盤モデルLTX-2.3のデモとチュートリアルをご覧ください
- Introducing LTX Desktop: An Open Source Video Editor Powered by LTX-2.3 - LTX
- Run LTX 2.3 Video Generation AI Model Locally with ComfyUI - Easy Guide - Fahd Mirza
- LTX 2.3 in Comfy UI — Text to Video & Image to Video - AI Ninja
- LTX-2.3 In ComfyUI = AI Video Generation At 0 Credits Per Run - Nerdy Rodent
- LTX-2.3 ComfyUI Workflow Tutorial | Text-to-Video, Image-to-Video, Talking Avatar & Audio Generation - Vantage with AI
- LTX 2.3 Released - ComfyUI Workflow & A New Tool I Built To Run AI😃😃😃 - Benji’s AI Playground
LTX-2.3 YouTube動画
220億パラメータのオープンソース音声動画基盤モデルLTX-2.3のデモとチュートリアルをご覧ください
X上のLTX-2.3人気レビュー
220億パラメータのオープンソース音声動画基盤モデルLTX-2.3について、AIコミュニティが何を言っているかご覧ください
Keyframes and structured control are now more deeply integrated. LTX-2.3 is trained with multi-task objectives from the pretraining stage, including image-to-video, retake, keyframes, and more. This makes transitions, controlled scene evolution, and multi-shot workflows more Show more
🚀 Today we’re releasing LTX-2.3 with open weights + training code, alongside the API, LTX Studio, and LTX-Desktop - a full-featured video editing app that runs on your local GPU. Audio+video generation just leveled up: quality + capabilities + tooling - all open-source. 🧵👇
https://t.co/MGZ9rXyOsh
Acaban de liberar LTX-2.3. Un modelo de video con IA que genera 4K + audio + lip-sync. 100% gratis y open-source. Puedes crear clips de hasta 20s desde tu propio PC. Te dejo el enlace en el comentario: (Si no, prueba lo último de Kling) x.com/ivnways/status…
Kling 3.0 Motion Control se actualiza por completo. Basado en la versión 2.6, ahora ofrece: - Consistencia facial impecable - Estabilidad desde múltiples ángulos - Eidelidad en secuencias largas - Reproducción fiel de emociones complejas
LTX 2.3 seems to be coming out soon. No models on Hugging Faces just yet, but soon I'm sure ~ ltx.io/model/ltx-2-3
LTX-2.3 releasing soon 😊 LTX-2.3 brings four major improvements over LTX-2. A redesigned VAE produces sharper fine details, more realistic textures, and cleaner edges. A new gated attention text connector means prompts are followed more closely – descriptions of timing, Show more
LTX-2.3 officially released! Wait, unreleased. 404. ComfyUI team: “Nah, we already support it.” github.com/Comfy-Org/Comf…