logo
RunComfy
  • ComfyUI
  • 트레이너신규
  • 모델
  • API
  • 가격
discord logo
모델
탐색
모든 모델
라이브러리
생성 기록
모델 API
API 문서
API 키
계정
사용량

LTX-2 19B Text-to-Video LoRA: 오디오 동기화를 지원하는 사실적 텍스트 영상 생성 | RunComfy

ltx/ltx-2-19b/text-to-video/lora

텍스트 프롬프트를 동기화된 오디오, LoRA 스타일 제어, 4K급 선명도, 부드러운 움직임을 갖춘 영상으로 변환해 영화적 광고, 스토리텔링, 브랜드 콘텐츠에 활용하세요.

출력 해상도입니다.
출력 형식입니다.
영상 길이(5~20초, 기본값: 5초)입니다.
적용할 LoRA 목록입니다(최대 3개).
재현 가능한 결과를 위한 시드입니다(-1은 무작위).
Idle
The rate is $0.017 per second for 480p, $0.022 per second for 720p, and $0.033 per second for 1080p.

LTX-2 19B Text-to-Video LoRA 소개

Lightricks의 LTX-2 19B Text-to-Video LoRA는 프롬프트로부터 오디오가 동기화되고 LoRA로 스타일을 제어할 수 있는 영상을 생성합니다. RunComfy 요금은 480p가 초당 0.017달러, 720p가 0.022달러, 1080p가 0.033달러이며 영상 길이는 5~20초입니다. 기반 모델은 네이티브 4K, 50 fps 출력을 지원합니다. 오디오와 영상을 한 번에 생성하고 카메라 제어 및 IC-LoRA 가이드를 제공하므로 프레임별 수작업, 별도의 오디오 후반 작업, 마스크 중심의 합성 작업을 줄일 수 있습니다.

추천 용도: 성과형 영상 광고 | 영화 프리비주얼라이제이션 | 브랜드 일관성을 갖춘 소셜 영상

Lightricks / LTX-2 19B Text-to-Video LoRA#


LTX-2 19B Text-to-Video LoRA는 텍스트로부터 오디오가 동기화된 짧은 영상을 생성하는 190억 매개변수 LoRA 지원 Diffusion Transformer입니다. prompt와 선택적 LoRA 어댑터를 입력받아 여러 해상도, 길이, 화면 비율로 구도와 스타일이 일관된 영상을 만듭니다. 브랜드 콘텐츠, 소셜 영상, 애니메이션, 빠른 프로토타이핑에 적합합니다.


출력 사양: 480p~1080p / 5~20초 / 16:9 또는 9:16 / 오디오 포함


주요 특징#

  • LoRA 사용자 지정: 최대 3개의 어댑터를 적용해 장면 의도를 유지하면서 스타일, 캐릭터, 움직임을 조절할 수 있습니다.
  • 오디오와 영상을 동시 생성: 환경음, 효과음, 대화와 영상을 한 번에 생성해 자연스럽게 동기화합니다.
  • 유연한 출력 설정: 480p, 720p, 1080p, 16:9 또는 9:16, 5~20초 중에서 선택할 수 있습니다.
  • 재현 가능한 반복 작업: seed를 고정하고 같은 기본 결과를 유지하면서 prompt를 조정할 수 있습니다.
  • 안정적인 피사체와 움직임: 프레임 사이에서 피사체의 일관성을 유지하고 부드러운 전환을 만듭니다.
  • 효율적인 제작: RunComfy와 API를 사용해 GPU 인프라를 직접 관리하지 않고 빠르게 반복할 수 있습니다.

매개변수#


매개변수필수유형기본값범위/옵션설명
prompt*예 (*)string——장면, 동작, 오디오 지시 사항
resolution아니요enum720p480p, 720p, 1080p출력 해상도
aspect_ratio아니요enum16:916:9, 9:16출력 화면 비율
duration아니요number55~20초영상 길이
loras아니요list—최대 3개적용할 LoRA 어댑터
seed아니요integer-1-1은 무작위재현 가능한 결과를 위한 시드

가격#


요금은 생성 시간과 해상도에 따라 결정됩니다.


해상도초당 가격과금 단위
480p$0.017생성 1초당
720p$0.022생성 1초당
1080p$0.033생성 1초당

사용 방법#


  1. RunComfy 모델 목록에서 LTX-2 19B Text-to-Video LoRA를 선택합니다.
  2. prompt에 피사체, 동작, 장소, 카메라 움직임, 조명, 환경음이나 대화 같은 오디오 요구 사항을 작성합니다.
  3. 필요하면 loras에 최대 3개의 LoRA를 지정해 스타일이나 캐릭터를 조정합니다.
  4. 용도에 맞게 resolution, aspect_ratio, duration을 설정합니다.
  5. 비슷한 결과를 재현하려면 seed를 고정 정수로 설정하고, 새로운 변형을 만들려면 -1로 둡니다.
  6. 오디오가 동기화된 생성 영상을 미리 봅니다.
  7. prompt나 LoRA를 조정하고, 구도가 맞지 않으면 길이나 화면 비율도 변경합니다. 같은 seed를 사용하면 결과를 비교하기 쉽습니다.
  8. RunComfy API를 사용하면 GPU나 인프라를 직접 관리하지 않고 일괄 생성을 자동화할 수 있습니다.

프롬프트 작성 팁#


  • 피사체, 동작, 샷 유형, 오디오 의도를 구체적으로 설명하세요.
  • 서로 충돌하는 스타일은 피하고, 영상 하나에는 주요 스타일 LoRA 또는 캐릭터 LoRA를 하나만 사용하는 편이 안정적입니다.
  • 5~8초의 짧은 영상은 움직임이 더 일관되기 쉬우며, 서사상 필요한 경우에만 20초까지 늘리는 것이 좋습니다.
  • seed를 고정한 채 prompt를 조금씩 바꾸면 차이를 안정적으로 비교할 수 있습니다.
  • 세로형 소셜 영상에는 9:16, 가로형에는 16:9를 사용하고 배포 채널에 맞는 해상도를 선택하세요.
  • 동작이나 효과음을 한꺼번에 너무 많이 지시하면 일관성이 낮아질 수 있으므로 중요한 요소를 우선하세요.
  • 화면이 답답하면 영상 길이를 줄이거나 화면 비율을 바꾸고, 스타일이 너무 강하면 LoRA 수나 영향력을 줄이세요.

관련 모델#


  • LTX-2 19B Image-to-Video LoRA
  • LTX-2 19B Video-to-Video LoRA

공식 리소스#


  • 공식 사이트: https://app.ltx.studio/ltx-2-playground/t2v
  • 공식 GitHub: https://github.com/Lightricks/LTX-2/tree/main
  • 공식 Hugging Face: https://huggingface.co/Lightricks/LTX-2

관련 모델

seedance-2.5/first-last-frame/480p

Seedance 2.5 FLF2V 480p: 저렴한 비용으로 첫 번째 마지막 프레임 초안 전환

kling-video-o3/4K/text-to-video

출력 1초당 $0.47로 만드는 영화 같은 4K 텍스트-투-비디오.

runway-gen-3-alpha/turbo/image-to-video

현실감 넘치는 영상과 캐릭터 표현을 자유롭게 제어하세요

ltx-2/pro/text-to-video

필수 프롬프트로 동영상을 생성합니다. 6·8·10초, 1080p~2160p, 25·50 FPS, 고정 16:9, 오디오 생성 여부를 설정할 수 있습니다.

kling-3.0/pro/image-to-video

Kling V3.0 제품군에서 가장 높은 시각적 완성도와 사실적인 움직임을 제공하는 프리미엄 이미지 영상 모델입니다.

kling-video-o1/image-to-video/reference

필수 참조 이미지와 요소 정의로 동영상을 생성합니다. 배열 순서에 맞는 @Image 및 @Element 토큰을 사용하고 길이와 화면 비율을 정확히 지정할 수 있습니다.

자주 묻는 질문

출력 해상도와 화면 비율에는 어떤 기술적 제한이 있나요?

LTX-2 19B Text-to-Video LoRA 모델은 최대 네이티브 4K(3840×2160), 50 fps를 지원합니다. 이 워크플로에서 선택 가능한 프리셋은 480p, 720p, 1080p이며 화면 비율은 16:9와 9:16입니다. 한 번의 생성에 사용할 수 있는 프롬프트는 현재 약 512 tokens입니다.

참조 어댑터는 동시에 몇 개까지 사용할 수 있나요?

최대 3개의 LoRA 모듈을 동시에 불러올 수 있습니다. 포즈, 깊이, 가장자리 등을 제어해 구도의 구조적 일관성을 높이는 IC-LoRA도 사용할 수 있습니다.

RunComfy 모델 페이지에서 프로덕션 환경으로 전환하려면 어떻게 하나요?

먼저 브라우저에서 프롬프트와 설정을 조정하세요. 프로덕션에서는 RunComfy API로 영상 생성, 어댑터 로드, 후처리를 자동화할 수 있습니다. 요금에는 모델 페이지와 동일한 미국 달러 기반 크레딧 시스템이 적용됩니다.

어떤 콘텐츠 제작에 가장 적합한가요?

마케팅 영상, 교육용 설명 영상, 애니메이션 캐릭터 대화, 높은 프레임 속도와 동기화된 오디오가 필요한 짧은 영상에 적합합니다. 설정 가능한 LoRA는 브랜드 표현의 일관성을 유지하는 데도 도움이 됩니다.

영상과 오디오는 어떻게 동기화되나요?

Diffusion Transformer(DiT)가 영상 프레임과 오디오 파형을 함께 모델링합니다. 대화 타이밍, 립싱크, 주변 소리를 한 번에 생성하므로 오디오를 별도로 합성할 필요가 없습니다.

전체 모델을 다시 학습하지 않고 사용자 지정 LoRA를 학습할 수 있나요?

네. 가벼운 LoRA 학습으로 스타일, 움직임, 캐릭터를 조정한 뒤 어댑터를 주 파이프라인에 연결할 수 있습니다. RunComfy Trainer에서 직접 LoRA를 학습할 수 있습니다.

팔로우하기
  • 링크드인
  • 페이스북
  • Instagram
  • 트위터
지원
  • 디스코드
  • 이메일
  • 시스템 상태
  • 제휴사
비디오 모델
  • MiniMax H3 Max
  • MiniMax H3 Max Reference to video
  • MiniMax H3 Max text to video
  • MiniMax H3 Open Reference To Video
  • Wan 3.0 Prime
  • Wan 2.7 Image to Video
  • 모든 모델 보기 →
이미지 모델
  • Wan 2.6 Image to Image
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • GPT Image 2 Image Edit
  • Qwen Image 3.0 Edit
  • Qwen Image 3.0 Pro Edit
  • 모든 모델 보기 →
법적 고지
  • 서비스 약관
  • 개인정보 보호정책
  • 쿠키 정책
RunComfy
저작권 2026 RunComfy. All Rights Reserved.

RunComfy는 최고의 ComfyUI 플랫폼으로서 ComfyUI 온라인 환경과 서비스를 제공하며 ComfyUI 워크플로우 멋진 비주얼을 제공합니다. RunComfy는 또한 제공합니다 AI Models, 예술가들이 최신 AI 도구를 활용하여 놀라운 예술을 창조할 수 있도록 지원합니다.

LTX-2 19B Text-to-Video LoRA 생성 예시

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...