LTX 2.5 ComfyUI 텍스트에서 비디오로: 동기화된 오디오와 함께 프롬프트에서 비디오로#
LTX 2.5 ComfyUI 텍스트에서 비디오로는 RunComfy 준비가 된 워크플로우로, 짧은 프롬프트를 시네마틱 비디오와 정렬된 오디오 트랙으로 변환합니다. Lightricks의 LTX-2.5 디스틸 변환기를 사용한 텍스트에서 비디오 생성, 복원을 위한 컴팩트 비디오/오디오 VAE, 더 선명한 세부 사항을 위한 잠재 업스케일러, 강력한 프롬프트 적합성을 위한 Gemma 기반 프롬프트 향상을 결합합니다.
ComfyUI 내부에서 빠르고 로컬 중심의 반복을 원하는 창작자를 위해 제작된 이 그래프는 분위기 있는 장면, 제품 샷, 캐릭터 순간 및 무드 피스를 잘 처리합니다. LTX 2.5 ComfyUI 텍스트에서 비디오로를 사용하면 아이디어에서 미리보기까지 몇 분 만에 이동할 수 있으며, RunComfy를 떠나지 않고 모션, 외관 및 타이밍을 수정할 수 있습니다.
Comfyui LTX 2.5 ComfyUI 텍스트에서 비디오로 워크플로우의 주요 모델#
- Lightricks LTX-2.5. 텍스트에서 시간적으로 일관된 비디오를 합성하는 핵심 디스틸 변환기입니다. 프롬프트 충실도와 모션 현실성을 균형 있게 유지하면서 추론 속도를 빠르게 유지합니다. 공식 모델 카드는 Lightricks/LTX-2.5에서, 참조 파이프라인은 Lightricks/LTX-2.5-Diffusers에서 확인할 수 있습니다.
- Google Gemma 2 Instruct. 사용자의 프롬프트를 확장하고 명확하게 하기 위한 컴팩트한 지시 조정 언어 모델로, 스타일 가이드와 샷 의도를 개선합니다. 대표적인 체크포인트는 google/gemma-2-9b-it입니다.
- Lightricks 조직 허브. LTX 릴리스 및 텍스트에서 비디오로 제품군에 대한 업데이트의 중앙 목록으로, 모델 노트 및 알려진 동작에 유용합니다: huggingface.co/Lightricks.
Comfyui LTX 2.5 ComfyUI 텍스트에서 비디오로 워크플로우 사용 방법#
이 워크플로우는 프롬프트 향상, 텍스트 조건화, 잠재 비디오 합성, 업스케일링, 디코딩, 오디오 정렬 및 내보내기를 통해 프롬프트에서 비디오로의 깔끔한 경로를 따릅니다. 아래 섹션은 각 단계를 쉽게 설명하므로 무엇을 변경해야 하고 그 이유를 알 수 있습니다.
프롬프트 및 프리셋#
주제, 설정, 조명, 렌즈 또는 카메라 느낌, 모션 의도를 명시하는 간결한 프롬프트를 작성하여 시작하십시오. 원치 않는 요소를 피하기 위해 부정적인 프롬프트를 추가할 수 있습니다. 제공된 경우 스타일 프리셋을 선택하여 색상 및 대비 경향을 빠르게 설정하십시오. 그래프가 시드 컨트롤을 노출하는 경우, 단어를 반복하여 차이가 편집을 반영하도록 시드를 안정적으로 유지하십시오. LTX 2.5 ComfyUI 텍스트에서 비디오로는 "slow dolly in", "handheld" 또는 "subtle breeze"와 같은 명확한 모션 동사를 사용하면 유리합니다.
텍스트 조건화#
프롬프트는 토큰화 및 인코딩된 다음, Gemma에 의해 의도를 강화하고 모호성을 제거하기 위해 가볍게 재작성됩니다. 강화된 텍스트는 비디오 모델이 레이아웃, 주제 외관 및 모션 큐를 결정하는 데 사용하는 조건 벡터를 생성합니다. 설명은 구체적이고 시각적으로 유지하십시오; 서로 경쟁하는 긴 수식어 목록을 피하십시오. 일관된 정체성이나 브랜딩이 필요한 경우, 프롬프트 초기에 해당 용어를 배치하십시오. 이 단계는 LTX 2.5 ComfyUI 텍스트에서 비디오로가 픽셀이 생성되기 전에 의미를 고정하는 곳입니다.
잠재 비디오 합성#
워크플로우는 선택한 화면 비율과 지속 시간에 맞춘 잠재 타임라인을 초기화합니다. LTX-2.5는 이 잠재 비디오를 반복적으로 디노이즈하여 각 프레임에 구조, 모션 및 외관을 엮으면서 시간적 일관성을 유지합니다. 짧은 샷은 더 빨리 수렴되고 지시하기 쉽습니다; 첫 번째 비트를 좋아한 후에만 지속 시간을 확장하십시오. 부정적인 프롬프트를 사용하여 여분의 사지, 깜박임 또는 텍스트 오버레이와 같은 아티팩트를 억제하십시오. 목표는 의도한 장면으로 읽히는 깨끗한 잠재 클립입니다.
모션 및 타이밍#
디노이징 동안, 모델은 공간적 세부 사항과 부드러운 모션을 균형 있게 유지합니다. 프롬프트에 강한 모션 큐가 있으면 정적처럼 보이는 클립을 피할 수 있습니다; 너무 많은 미세한 텍스처 요구는 모션 명확성을 감소시킬 수 있습니다. 그래프에 모션 강도 컨트롤이 포함된 경우, 동적 샷을 위해 증가시키고 초상화나 매크로 제품 각도에는 줄이십시오. 변형을 테스트할 때, 한 요소씩 변경하여 특정 편집으로 차이를 귀속할 수 있도록 하십시오. LTX 2.5 ComfyUI 텍스트에서 비디오로는 일반적으로 명확한 카메라 동사와 단일 주제 초점을 보상합니다.
잠재 업스케일링#
전용 잠재 업스케일러가 시간적 안정성을 깨지 않고 세부 사항을 정제합니다. 기본 모션과 구성이 올바르게 보이면 이 패스를 활성화하십시오. 하이라이트가 번지거나 가장자리가 과도하게 선명해지면 강도를 약간 줄이고 다시 실행하십시오; 이미지가 부드럽게 느껴지면 증가시키십시오. 모션이 정착된 후 업스케일링은 더 높은 기본 해상도로 시작하는 것보다 일관성을 더 잘 유지합니다. 이 단계는 LTX 2.5 ComfyUI 텍스트에서 비디오로에 선명함을 제공하면서 깜박임을 도입하지 않습니다.
디코딩 및 색상#
비디오 VAE는 잠재를 프레임으로 디코딩하며, 미리보기 및 내보내기에 적합한 색상 공간 및 톤 매핑을 적용합니다. 가능한 경우, 의도에 맞는 룩 프로파일을 선택하십시오: 나중에 그레이딩을 위한 중립적, 즉시 공유 가능한 데일리를 위한 시네마틱. 사소한 밴딩이나 깜박임은 종종 상류에서 너무 공격적인 선명화를 나타냅니다; 더 강한 후처리 대비를 강요하기보다는 업스케일러 강도를 조정하십시오. 실행 간에 결과를 공정하게 비교하기 위해 화면 비율을 일관되게 유지하십시오. 디코딩은 프레임이 평가할 수 있는 픽셀로 변환되는 곳입니다.
오디오 생성 및 동기화#
오디오 모듈은 동일한 프롬프트에서 가벼운 사운드트랙을 생성하고 비디오 타임라인에 맞춥니다. "eerie drone", "upbeat synth" 또는 "soft rain foley"와 같은 무드 단어를 사용하여 침대를 조정하십시오. 워크플로우가 오디오 전환을 노출하는 경우, 모션을 탐색하는 동안 비활성화하고, 최종에는 활성화하십시오. 약간의 프롬프트 조정으로 리듬과 강도가 변화할 수 있습니다; 오디오 변형을 오디션할 때는 시각적 시드를 잠그십시오. 목표는 장면을 지원하면서 충돌하지 않는 일관된 오디오입니다.
내보내기 및 검토#
간단한 미리보기 또는 더 높은 품질의 공유 가능한 파일을 위한 컨테이너 및 코덱 프리셋을 선택하십시오. 그래프에 프레임 내보내기가 포함된 경우, 전체 실행에 커밋하기 전에 개별 프레임을 검사하여 아티팩트를 확인할 수 있습니다. 프롬프트, 시드 및 모든 전환의 기록을 유지하여 아이디어를 재현하거나 분기할 수 있습니다. 소셜 또는 제품 검토를 위해 미리보기 프리셋을 사용하십시오; 릴 또는 클라이언트 덱을 위해 고품질 프리셋을 사용하십시오. LTX 2.5 ComfyUI 텍스트에서 비디오로는 빠르게 반복할 수 있도록 최적화되어 있으며, 준비되었을 때 업스케일링 및 내보내기를 수행합니다.
선택적 추가#
- 샷 언어로 프롬프트 작성: 주제 + 설정 + 조명 + 렌즈 + 모션 (예: "product hero on marble, soft backlight, 50 mm, slow arc left").
- 약한 여러 스타일 큐보다 결정적인 하나의 스타일 큐를 선호하십시오. 너무 많은 형용사는 지침을 희석시킵니다.
- 텍스트 오버레이, 과도한 그레인, 또는 로고 같은 모양을 억제하기 위해 부정적인 프롬프트를 사용하십시오.
- 프롬프트 편집을 비교하기 위해 시드를 잠그고, 새로운 구성을 탐색하기 위해 시드를 변경하십시오.
- 모션이 명확하게 읽히면 짧게 시작하고, 지속 시간을 연장하십시오; 긴 클립은 작은 문제를 복합화합니다.
- 얼굴이 중심인 경우, 카메라 모션을 부드럽게 유지하고 조명을 안정적으로 유지하여 시간적 이동을 줄이십시오.
- 깨끗한 내보내기를 위해, 후처리에서 크기를 조정하지 마십시오; 그래프에서 화면 비율 및 해상도를 설정하고 일관되게 유지하십시오.
이 LTX 2.5 ComfyUI 텍스트에서 비디오로 워크플로우는 설득력 있는 모션, 선명한 세부 사항 및 정렬된 오디오를 최소한의 설정으로 얻을 수 있도록 설계되었습니다. 빠르게 반복하고, 명확한 의도로 안내하고, 그래프가 텍스트에서 비디오로의 무거운 작업을 처리하게 하십시오.
감사#
이 워크플로우는 다음 작업 및 리소스를 구현하고 기반으로 합니다. 소스 워크플로우 템플릿을 제공한 Comfy.org, LTX-2.5 모델 가중치를 제공한 Lightricks, LTX-2.5 Diffusers 프로젝트에 대한 기여 및 유지보수에 대해 Lightricks에 감사드립니다. 권위 있는 세부 사항은 아래에 링크된 원본 문서 및 저장소를 참조하십시오.
리소스#
- Comfy.org/소스 워크플로우 템플릿
- 문서 / 릴리스 노트: 소스 워크플로우 템플릿
- Lightricks/LTX-2.5
- Hugging Face: Lightricks/LTX-2.5
- Lightricks/LTX-2.5-Diffusers
- Hugging Face: Lightricks/LTX-2.5-Diffusers
- Lightricks/Hugging Face 조직
- Hugging Face: Lightricks
참고: 언급된 모델, 데이터셋 및 코드의 사용은 저자 및 유지보수자가 제공한 해당 라이선스 및 조건에 따릅니다.

