Dreamega

LTX-2.3 AI動画生成器

Lightricks LTX-2.3は、より鮮明なテクスチャ、顔、髪、テキストレンダリングのために再構築されたVAEを備えた220億パラメータのDiT音声動画基盤モデルです。プロンプト遵守のための4倍大きなテキストコネクタ、最大1080x1920のネイティブ9:16縦型モード、最大3つのカスタムLoRAアダプター、HiFi-GANボコーダーによるクリーンなオーディオを搭載。480pから1080p、5〜20秒の同期音声動画を生成します。

/models
Lightricks Ltx
Reel · Specifications

LTX-2.3とは?

再構築されたVAEとオープンソースの重みを持つLightricksの220億パラメータDiT音声動画基盤モデル

  1. · 01220パラメータ
  2. · 02最大4K解像度
  3. · 035-20秒期間
  4. · 04Apache 2.0ライセンス

Apache 2.0ライセンスの下、よりシャープなディテール、より優れたプロンプト遵守、ネイティブ縦型動画、よりクリーンな同期オーディオを提供する次世代オープンソースモデル。

Reel · Capabilities

LTX-2.3機能

次世代ビデオ制作のためのLightricks LTX-2.3の強力な機能を発見してください

  1. Feature 01 / 08

    再構築VAEエンジン

    完全に再構築された変分オートエンコーダが、テクスチャ、顔、髪の毛、テキストオーバーレイ、鮮明なエッジを含む劇的にシャープな微細ディテールを提供します。プロフェッショナル品質の出力のためのLTX-2からの根本的なアップグレード。

  2. Feature 02 / 08

    強化されたプロンプト遵守

    4倍大きなテキストコネクタにより、LTX-2.3は大幅に高い精度でプロンプトに従います。複雑なシーン記述、特定のアクション、詳細な視覚的指示が生成されたビデオで忠実にレンダリングされます。

  3. Feature 03 / 08

    ネイティブ縦型ビデオ

    TikTok、Instagram Reels、YouTube Shorts向けに設計された、最大1080x1920解像度の一流の9:16縦型ビデオサポート。横向き専用モデルからのクロップやレターボックスは不要です。

  4. Feature 04 / 08

    同期オーディオ-ビデオ

    新しいHiFi-GANボコーダーによる、よりクリーンで高忠実度のオーディオ生成。視覚コンテンツと自然に同期するコンテキストに適した効果音、環境オーディオ、ダイアログを生成します。

  5. Feature 05 / 08

    カスタムLoRAアダプター

    最大3つの同時LoRAアダプターを適用して、スタイル、キャラクターの一貫性、またはモーションパターンをカスタマイズ。ブランド固有の美学や専門的なクリエイティブワークフロー向けに出力を微調整。

  6. Feature 06 / 08

    マルチ解像度出力

    高速ドラフト用の480pから本番対応出力用の1080pまでの柔軟な解像度、4Kまでのアップスケーリングサポート付き。プロジェクト要件に合わせて24または48 FPSを選択。

  7. Feature 07 / 08

    改良された画像からビデオ

    ケンバーンズ効果と静的フリーズアーティファクトを大幅に削減。画像は本物のモーションとダイナミックなカメラワークでアニメーション化され、静止画像に命を吹き込む自然な動きを生み出します。

  8. Feature 08 / 08

    オープンソース基盤

    完全なモデル重みとトレーニングコードが利用可能なApache 2.0ライセンスでリリース。カスタムアプリケーションの構築、特定のユースケース向けの微調整、またはプロダクションパイプラインへの直接統合が可能です。

LTX-2.3で画像からビデオを作成する方法

3つの簡単なステップで静止画像を改善されたモーションの動的ビデオに変換

  1. LTX-2.3画像-ビデオモデルを選択して画像をアップロード

    ビデオ生成ページに移動し、LTX-2.3画像-ビデオモデルを選択します。高品質の静止画像(JPG、PNG、またはWEBP形式)をアップロードします。解像度(480pから1080p)、アスペクト比(16:9または9:16縦向き)、フレームレート(24または48 FPS)、期間(5-20秒)を選択します。オプションでカスタムスタイル用にLoRAアダプターを添付。

  2. モーションプロンプトを追加して設定を構成

    画像をどのように生き生きとさせたいかを説明する詳細なプロンプトを書きます。LTX-2.3の改良された画像からビデオは、ケンバーンズ効果の減少とフリーズの減少で本物のモーションを生成します。カメラの動き、被写体のアクション、環境効果を指定します。同期されたHiFi-GANサウンドのためにオーディオ生成を有効にし、最良の結果のためにプロンプト最適化を使用します。

  3. ビデオを生成してダウンロード

    生成をクリックし、LTX-2.3が再構築されたVAEでよりシャープなディテールと自然な動きで画像をアニメーション化するのを待ちます。モデルは動的な動きと深さを追加しながら画像の構成を保持します。同期されたオーディオで結果をプレビューし、完成したビデオをMP4形式でダウンロードします。

LTX-2.3でテキストからビデオを作成する方法

3つの簡単なステップで同期オーディオ付きの見事なAIビデオを作成

  1. LTX-2.3テキスト-ビデオモデルを選択

    ビデオ生成ページに移動し、LTX-2.3テキスト-ビデオモデルを選択します。好みの解像度(480pから1080p)、アスペクト比(16:9横向きまたは9:16縦向き)、フレームレート(24または48 FPS)、ビデオ長(5-20秒)を選択します。オプションでカスタムスタイル用に最大3つのLoRAアダプターを添付。

  2. プロンプトを書いて設定を構成

    作成したいビデオの詳細なテキスト説明を作成します。LTX-2.3の4倍大きなテキストコネクタが優れたプロンプト遵守を保証するので、シーン構成、カメラの動き、照明、アクションについて具体的に記述してください。プロンプト最適化を有効にし、同期オーディオ生成を切り替え、追加パラメータを調整します。

  3. ビデオを生成してダウンロード

    生成をクリックし、LTX-2.3が再構築されたVAEでよりシャープなテクスチャ、顔、テキストのビデオをレンダリングするのを待ちます。同期されたHiFi-GANオーディオで結果をプレビューします。完成したビデオをMP4形式でダウンロードし、プロジェクト、ソーシャルメディア、または制作ワークフローで即座に使用します。

LTX-2.3 YouTube動画

220億パラメータのオープンソース音声動画基盤モデルLTX-2.3のデモとチュートリアルをご覧ください

  • Introducing LTX Desktop: An Open Source Video Editor Powered by LTX-2.3 - LTX
  • Run LTX 2.3 Video Generation AI Model Locally with ComfyUI - Easy Guide - Fahd Mirza
  • LTX 2.3 in Comfy UI — Text to Video & Image to Video - AI Ninja
  • LTX-2.3 In ComfyUI = AI Video Generation At 0 Credits Per Run - Nerdy Rodent
  • LTX-2.3 ComfyUI Workflow Tutorial | Text-to-Video, Image-to-Video, Talking Avatar & Audio Generation - Vantage with AI
  • LTX 2.3 Released - ComfyUI Workflow & A New Tool I Built To Run AI😃😃😃 - Benji’s AI Playground

LTX-2.3 YouTube動画

220億パラメータのオープンソース音声動画基盤モデルLTX-2.3のデモとチュートリアルをご覧ください

X上のLTX-2.3人気レビュー

220億パラメータのオープンソース音声動画基盤モデルLTX-2.3について、AIコミュニティが何を言っているかご覧ください

Acaban de liberar LTX-2.3. Un modelo de video con IA que genera 4K + audio + lip-sync. 100% gratis y open-source. Puedes crear clips de hasta 20s desde tu propio PC. Te dejo el enlace en el comentario: (Si no, prueba lo último de Kling) x.com/ivnways/status…

Image
IVAN | IA
IVAN | IA
@ivnways

Kling 3.0 Motion Control se actualiza por completo. Basado en la versión 2.6, ahora ofrece: - Consistencia facial impecable - Estabilidad desde múltiples ángulos - Eidelidad en secuencias largas - Reproducción fiel de emociones complejas

166
Reply

LTX-2.3 releasing soon 😊 LTX-2.3 brings four major improvements over LTX-2. A redesigned VAE produces sharper fine details, more realistic textures, and cleaner edges. A new gated attention text connector means prompts are followed more closely – descriptions of timing,  Show more

Image
Wildminder
Wildminder
@wildmindai

LTX-2.3 officially released! Wait, unreleased. 404. ComfyUI team: “Nah, we already support it.” github.com/Comfy-Org/Comf…

Image
5
Reply
FAQ

よくある質問

LTX-2.3は、2026年3月5日にリリースされたLightricksの220億パラメータDiT音声動画基盤モデルです。よりシャープなテクスチャ、顔、髪、テキストレンダリングのための完全に再構築されたVAE、より良いプロンプト遵守のための4倍大きなテキストコネクタ、ネイティブ9:16縦型サポート、LoRAアダプターサポート、よりクリーンなオーディオのための新しいHiFi-GANボコーダーを搭載しています。Apache 2.0でオープンソースです。
LTX-2.3はいくつかの主要なアップグレードを導入しています:VAEは劇的にシャープな微細ディテールのために完全に再構築されました。テキストコネクタは4倍大きくなり、プロンプト遵守が大幅に向上しました。画像からビデオの生成はケンバーンズ効果の減少とフリーズの減少で改善されました。新しいHiFi-GANボコーダーによりオーディオ品質がクリーンになりました。ネイティブ9:16縦型ビデオサポートとLoRAアダプターサポートも追加されました。
LTX-2.3は480pから1080pまでネイティブにビデオを生成し、4Kまでのアップスケーリングをサポートしています。横向き(16:9)と縦向き(9:16)の両方のアスペクト比をサポートし、縦向きモードは最大1080x1920の解像度をサポートしています。ビデオの長さは5〜20秒で、フレームレートは24または48 FPSのオプションがあります。
LTX-2.3はモデル出力をカスタマイズするために最大3つの同時LoRA(Low-Rank Adaptation)アダプターをサポートしています。LoRAは一貫したキャラクターの外見の維持、特定の芸術スタイルの適用、またはモーションパターンの制御に使用できます。これにより、フルモデルの再トレーニングなしで、ブランド固有のカスタマイズや専門的なクリエイティブワークフローが可能になります。
LTX-2.3はLTX-2と比較してよりクリーンで高忠実度のオーディオを生成する新しいHiFi-GANボコーダーを使用して同期されたオーディオ-ビデオコンテンツを生成します。モデルは視覚コンテンツと自然にマッチするコンテキストに適した効果音、環境オーディオ、ダイアログを生成します。オーディオ生成はニーズに応じてオンまたはオフに切り替えることができます。
はい、LTX-2.3はApache 2.0ライセンスの下でリリースされており、利用可能な最も寛容なオープンソースライセンスの一つです。完全なモデルの重みとトレーニングコードが公開されており、開発者がカスタムアプリケーションを構築し、特定のユースケース向けに微調整し、または個人および商用利用のために本番パイプラインに直接統合できます。