Introducing LTX-2.3 Our most production-ready model yet. The fastest 4K video generation in the world with built-in native dialogue. Here’s what’s new 🧵 1/9
LTX-2.3 AI 비디오 생성기
Lightricks LTX-2.3은 더 선명한 텍스처, 얼굴, 머리카락, 텍스트 렌더링을 위해 재구축된 VAE를 갖춘 220억 파라미터 DiT 오디오-비디오 파운데이션 모델입니다. 더 나은 프롬프트 준수를 위한 4배 큰 텍스트 커넥터, 최대 1080x1920의 네이티브 9:16 세로 모드, 최대 3개의 커스텀 LoRA 어댑터, HiFi-GAN 보코더를 통한 깨끗한 오디오를 지원합니다. 480p~1080p, 5~20초의 동기화 오디오 비디오를 생성합니다.
/modelsLTX-2.3란 무엇인가요?
재구축된 VAE와 오픈소스 가중치를 갖춘 Lightricks의 220억 파라미터 DiT 오디오-비디오 파운데이션 모델
- · 01220억파라미터
- · 02최대 4K해상도
- · 035-20초길이
- · 04Apache 2.0라이선스
Apache 2.0 라이선스 하에 더 선명한 디테일, 더 나은 프롬프트 준수, 네이티브 세로 비디오, 더 깨끗한 동기화 오디오를 제공하는 차세대 오픈소스 모델.
LTX-2.3 기능
차세대 비디오 제작을 위한 Lightricks LTX-2.3의 강력한 기능을 발견하세요
- Feature 01 / 08
재구축된 VAE 엔진
완전히 재구축된 변분 오토인코더가 텍스처, 얼굴, 머리카락, 텍스트 오버레이, 선명한 엣지를 포함한 극적으로 더 선명한 미세 디테일을 제공합니다. 전문적 품질 출력을 위한 LTX-2 대비 근본적 업그레이드.
- Feature 02 / 08
향상된 프롬프트 준수
4배 큰 텍스트 커넥터가 LTX-2.3이 프롬프트를 훨씬 더 높은 정확도로 따르도록 보장합니다. 복잡한 장면 설명, 특정 동작, 상세한 시각적 지시가 생성된 비디오에 충실하게 렌더링됩니다.
- Feature 03 / 08
네이티브 세로 비디오
TikTok, Instagram Reels, YouTube Shorts를 위해 설계된 최대 1080x1920 해상도의 일류 9:16 세로 비디오 지원. 가로 전용 모델에서의 자르기나 레터박싱이 더 이상 필요 없습니다.
- Feature 04 / 08
동기화된 오디오-비디오
새로운 HiFi-GAN 보코더로 구동되는 더 깨끗하고 고충실도의 오디오 생성. 시각적 콘텐츠와 자연스럽게 동기화되는 상황 맞춤 음향 효과, 주변 오디오, 대화를 생성합니다.
- Feature 05 / 08
커스텀 LoRA 어댑터
최대 3개의 동시 LoRA 어댑터를 적용하여 스타일, 캐릭터 일관성 또는 모션 패턴을 커스터마이즈합니다. 브랜드 특화 미학이나 전문 크리에이티브 워크플로우에 맞게 출력을 미세 조정합니다.
- Feature 06 / 08
다중 해상도 출력
빠른 초안용 480p부터 프로덕션 준비 출력용 1080p까지 유연한 해상도, 4K까지 업스케일링 지원. 프로젝트 요구사항에 맞게 24 또는 48 FPS 프레임 레이트를 선택하세요.
- Feature 07 / 08
개선된 이미지-투-비디오
Ken Burns 효과와 정적 프리징 아티팩트를 크게 감소시켰습니다. 이미지는 진정한 모션과 동적 카메라 작업으로 애니메이션되어 정지 이미지에 생명을 불어넣는 자연스러운 움직임을 생성합니다.
- Feature 08 / 08
오픈소스 파운데이션
전체 모델 가중치와 트레이닝 코드가 제공되는 Apache 2.0 라이선스로 출시. 커스텀 애플리케이션 구축, 특정 사용 사례에 맞는 미세 조정, 또는 프로덕션 파이프라인에 직접 통합이 가능합니다.
LTX-2.3으로 이미지-투-비디오 사용하는 방법
세 가지 간단한 단계로 정지 이미지를 개선된 모션의 동적 비디오로 변환
LTX-2.3 이미지-투-비디오 모델 선택 및 이미지 업로드
비디오 생성 페이지로 이동하여 LTX-2.3 이미지-투-비디오 모델을 선택하세요. 고품질 정지 이미지(JPG, PNG 또는 WEBP 형식)를 업로드하세요. 해상도(480p~1080p), 화면비(16:9 또는 9:16 세로), 프레임 레이트(24 또는 48 FPS), 길이(5-20초)를 선택하세요. 선택적으로 커스텀 스타일을 위해 LoRA 어댑터를 첨부하세요.
모션 프롬프트 추가 및 설정 구성
이미지를 어떻게 생생하게 만들고 싶은지 설명하는 상세한 프롬프트를 작성하세요. LTX-2.3의 개선된 이미지-투-비디오는 Ken Burns 효과와 프리징이 적은 진정한 모션을 생성합니다. 카메라 움직임, 피사체 동작, 환경 효과를 지정하세요. 동기화된 HiFi-GAN 사운드를 위해 오디오 생성을 활성화하고, 최상의 결과를 위해 프롬프트 최적화를 사용하세요.
비디오 생성 및 다운로드
생성을 클릭하고 LTX-2.3이 재구축된 VAE로 더 선명한 디테일과 자연스러운 움직임으로 이미지를 애니메이션하는 것을 기다리세요. 모델은 동적 모션과 깊이를 추가하면서 이미지의 구성을 보존합니다. 동기화된 오디오로 결과를 미리 본 후 완성된 비디오를 MP4 형식으로 다운로드하세요.
LTX-2.3으로 텍스트-투-비디오 사용하는 방법
세 가지 간단한 단계로 동기화된 오디오가 포함된 놀라운 AI 비디오 생성
LTX-2.3 텍스트-투-비디오 모델 선택
비디오 생성 페이지로 이동하여 LTX-2.3 텍스트-투-비디오 모델을 선택하세요. 선호하는 해상도(480p~1080p), 화면비(16:9 가로 또는 9:16 세로), 프레임 레이트(24 또는 48 FPS), 비디오 길이(5-20초)를 선택하세요. 선택적으로 커스텀 스타일을 위해 최대 3개의 LoRA 어댑터를 첨부하세요.
프롬프트 작성 및 설정 구성
생성하려는 비디오의 상세한 텍스트 설명을 작성하세요. LTX-2.3의 4배 큰 텍스트 커넥터가 우수한 프롬프트 준수를 보장하므로 장면 구성, 카메라 움직임, 조명, 동작에 대해 구체적으로 설명하세요. 프롬프트 최적화를 활성화하고, 동기화 오디오 생성을 토글하고, 추가 매개변수를 조정하세요.
비디오 생성 및 다운로드
생성을 클릭하고 LTX-2.3이 재구축된 VAE로 더 선명한 텍스처, 얼굴, 텍스트의 비디오를 렌더링하는 것을 기다리세요. 동기화된 HiFi-GAN 오디오로 결과를 미리 보세요. 완성된 비디오를 MP4 형식으로 다운로드하여 프로젝트, 소셜 미디어 또는 프로덕션 워크플로우에서 즉시 사용하세요.
LTX-2.3 YouTube 동영상
220억 파라미터 오픈소스 오디오-비디오 파운데이션 모델 LTX-2.3의 시연 및 튜토리얼 시청
- Introducing LTX Desktop: An Open Source Video Editor Powered by LTX-2.3 - LTX
- Run LTX 2.3 Video Generation AI Model Locally with ComfyUI - Easy Guide - Fahd Mirza
- LTX 2.3 in Comfy UI — Text to Video & Image to Video - AI Ninja
- LTX-2.3 In ComfyUI = AI Video Generation At 0 Credits Per Run - Nerdy Rodent
- LTX-2.3 ComfyUI Workflow Tutorial | Text-to-Video, Image-to-Video, Talking Avatar & Audio Generation - Vantage with AI
- LTX 2.3 Released - ComfyUI Workflow & A New Tool I Built To Run AI😃😃😃 - Benji’s AI Playground
LTX-2.3 YouTube 동영상
220억 파라미터 오픈소스 오디오-비디오 파운데이션 모델 LTX-2.3의 시연 및 튜토리얼 시청
X의 인기 LTX-2.3 리뷰
220억 파라미터 오픈소스 오디오-비디오 파운데이션 모델 LTX-2.3에 대한 AI 커뮤니티의 평가를 확인하세요
Keyframes and structured control are now more deeply integrated. LTX-2.3 is trained with multi-task objectives from the pretraining stage, including image-to-video, retake, keyframes, and more. This makes transitions, controlled scene evolution, and multi-shot workflows more Show more
🚀 Today we’re releasing LTX-2.3 with open weights + training code, alongside the API, LTX Studio, and LTX-Desktop - a full-featured video editing app that runs on your local GPU. Audio+video generation just leveled up: quality + capabilities + tooling - all open-source. 🧵👇
https://t.co/MGZ9rXyOsh
Acaban de liberar LTX-2.3. Un modelo de video con IA que genera 4K + audio + lip-sync. 100% gratis y open-source. Puedes crear clips de hasta 20s desde tu propio PC. Te dejo el enlace en el comentario: (Si no, prueba lo último de Kling) x.com/ivnways/status…
Kling 3.0 Motion Control se actualiza por completo. Basado en la versión 2.6, ahora ofrece: - Consistencia facial impecable - Estabilidad desde múltiples ángulos - Eidelidad en secuencias largas - Reproducción fiel de emociones complejas
LTX 2.3 seems to be coming out soon. No models on Hugging Faces just yet, but soon I'm sure ~ ltx.io/model/ltx-2-3
LTX-2.3 releasing soon 😊 LTX-2.3 brings four major improvements over LTX-2. A redesigned VAE produces sharper fine details, more realistic textures, and cleaner edges. A new gated attention text connector means prompts are followed more closely – descriptions of timing, Show more
LTX-2.3 officially released! Wait, unreleased. 404. ComfyUI team: “Nah, we already support it.” github.com/Comfy-Org/Comf…