MiniMax H3 Taomate 3단계 가속: 참조 이미지에서 영화적 비디오로, 동기화된 오디오와 함께#
이 ComfyUI 워크플로우는 하나 또는 두 개의 정지 이미지와 영화적 프롬프트를 일관된 비디오로 변환하며 동기화된 사운드를 제공합니다. MiniMax H3 및 TaoMate H3 3단계 가속 LoRA를 중심으로 구축되어 빠른 샘플링을 달성하면서 주제의 정체성, 장면의 연속성, 카메라 모션 및 오디오 큐를 유지합니다. MiniMax H3 Taomate 3단계 가속 파이프라인은 캐릭터 초상화, SF 비트, 역사적 재현 및 세련된 단편 개념에 이상적이며 강력한 유사성 제어와 자연스러운 모션을 원할 때 적합합니다.
참조 이미지를 샷 구조화된 프롬프트와 결합하여 MiniMax H3 Taomate 3단계 가속 워크플로우는 일관된 퍼포머, 안정적인 조명 및 세트 드레싱, 그리고 텍스트 방향을 따르는 분위기 트랙을 제공합니다. 메모리 효율적인 주의 패치와 청크 추론이 포함되어 있어 낮은 VRAM에서 더 큰 프레임을 실행할 수 있으며 오디오와 비디오의 정렬을 유지합니다.
Comfyui MiniMax H3 Taomate 3단계 가속 워크플로우의 주요 모델#
- MiniMax H3 참조-비디오 기초 모델. 텍스트 및 시각적 참조에서 공동 비디오 및 오디오 생성을 주도합니다. 기능 및 형식에 대한 공식 모델 카드를 MiniMaxAI/MiniMax-H3에서 확인하세요.
- TaoMate-H3 3단계 가속 LoRA. 노이즈 제거 스케줄을 개혁하여 이 워크플로우가 사용하는 3단계 스타일 스케줄을 가능하게 합니다. 프로젝트 및 가중치: TaoMate-H3 on GitHub 및 TaoLiveAIGC/TaoMate-H3.
- Qwen3-VL 32B 텍스트 인코더 변형으로 MiniMax H3를 위한 것입니다. 카메라 및 사운드 지시를 포함한 긴, 샷 인식 프롬프트를 인코딩하여 더 강력한 조건화를 제공합니다. Comfy-ready H3 번들과 함께 배포됩니다: Comfy-Org/MiniMax-H3.
- MiniMax H3 Video VAE 및 Audio VAE. 이미지를 프레임과 동기화된 오디오로 변환하여 입술 안전 타이밍과 분위기 연속성을 보장합니다. Comfy-Org/MiniMax-H3 포함.
Comfyui MiniMax H3 Taomate 3단계 가속 워크플로우 사용 방법#
워크플로우는 입력에서 단일 샘플러 경로로 흐르며, 이 경로는 비디오와 오디오를 위한 통합 잠재 변수를 생성하고, 그런 다음 최종 파일로 디코딩 및 멀티플렉싱합니다. 참조와 텍스트를 먼저 설정한 후 MiniMax H3 Taomate 3단계 가속 처리 스택이 작동하도록 그룹이 구성됩니다.
이미지/비디오 입력 (2)#
LoadImage (#94) 및 LoadImage (#9)에 하나 또는 두 개의 주제 프레임을 로드하세요. 깨끗하고 정면을 향한 이미지로 안정적인 조명과 무거운 차폐가 없는 이미지를 사용하여 정체성을 고정하세요. 강력한 참조 하나가 작동하며, 두 번째 각도는 의상, 비율 및 환경을 유지하는 데 도움이 될 수 있습니다. 참조는 노이즈 제거가 시작되기 전에 정체성, 자세 범위 및 레이아웃을 초기화하기 위해 MiniMaxH3ReferenceToVideo에 피드됩니다.
텍스트 입력 (1)#
Prompt (#93)에 영화적 프롬프트를 입력하세요. 인코더는 샷 분석, 카메라 이동, 모션 동사 및 사운드를 위한 두 개의 선택적 블록과 같은 섹션을 포함한 구조화된 산문을 선호합니다. 제공된 템플릿 스타일을 유지하고 그 내용을 장면 및 타이밍 마커로 교체할 수 있습니다. 이러한 방향은 사진과 사운드를 모두 조건화하여 MiniMax H3 Taomate 3단계 가속 스택이 오디오 이벤트를 화면상의 행동과 일치시킬 수 있도록 합니다.
처리 (22)#
이 그룹은 MiniMax H3를 로드하고, TaoMate 3단계 가속 LoRA를 적용하며, 낮은 VRAM 실행을 위한 메모리 효율적인 주의를 설치합니다. MiniMaxH3ReferenceToVideo (#11)는 참조 이미지와 프롬프트를 융합하여 잠재 계획을 만듭니다; Resolution Selector (Size) (#20)는 너비와 높이를 설정합니다; Float (Duration) (#17)는 실행 시간을 주도합니다. 작은 표현 노드는 지속 시간을 H3에 친화적인 프레임 수로 변환하여 내부 보폭과 일치하도록 하여 모션이 부드럽게 유지됩니다. 샘플러, 가이드, 스케줄러 및 시그마 시프트는 정체성이나 장면 안정성을 희생하지 않고 MiniMax H3 Taomate 3단계 가속을 위한 짧고 공격적인 스케줄을 실행합니다.
출력 (2)#
샘플러의 노이즈 제거된 잠재 변수는 두 번 디코딩됩니다: VAEDecode (#25)는 프레임을 생성하고 VAEDecodeAudio (#14)는 사운드를 생성합니다. CreateVideo (#34)는 선택한 fps로 프레임과 오디오를 하나의 공유 가능한 클립으로 멀티플렉싱하고, SaveVideo (#5)는 파일 이름 접두사로 저장합니다. 출력은 샷 수준의 텍스트를 반영하고 참조 이미지의 얼굴 유사성을 보존합니다. 비디오와 오디오는 동일한 잠재 변수를 공유하므로 동기화가 유지됩니다.
Comfyui MiniMax H3 Taomate 3단계 가속 워크플로우의 주요 노드#
MiniMaxH3ReferenceToVideo (#11)#
이 노드는 H3 파이프라인으로 텍스트-이미지 조건화를 위한 진입점입니다. 프롬프트, 하나 또는 두 개의 참조 이미지, 효과적인 width, height, length를 제공하는 데 사용하세요. 정확한 타이밍을 위해 상류에서 지속 시간을 조정하고 계산된 length가 자동으로 정렬되도록 하세요; 여기에서 원시 크기를 입력하는 대신 선택기를 통해 해상도를 변경하세요. 참조를 교체하거나 추가할 경우, 정체성 드리프트를 방지하기 위해 이미지 간 프레이밍을 일관되게 유지하세요.
LoraLoaderModelOnly (#92) — TaoMate H3 3단계 가속#
MiniMax H3 Taomate 3단계 가속 스케줄을 가능하게 하는 TaoMate H3 LoRA를 적용합니다. 더 낮은 단계에서 더 빠른 속도나 강력한 지침이 필요할 경우에만 그 영향을 증가시키세요; 과도한 날카로움이나 미세한 모션 감소가 관찰되면 약간 줄이세요. 짧은 스케줄이 수렴할 명확한 목표를 갖도록 간결하고 구체적인 프롬프트와 짝지으세요.
MiniMaxH3SigmaShift (#38)#
비디오에서 선명함과 시간적 일관성을 유지하면서 오디오를 안정적으로 유지하기 위해 노이즈 스케줄을 조정합니다. 프레임이 너무 부드럽게 보일 경우 비디오 시프트를 위로 밀고; 분위기가 너무 지배적이거나 부서질 경우 오디오 시프트를 완화하세요. 작은, 조정된 변경을 하고 전체 렌더링을 커밋하기 전에 몇 초 미리보기를 하세요.
SamplerCustomAdvanced (#21)#
선택한 샘플러와 스케줄러의 시그마 곡선으로 짧은 노이즈 제거 경로를 실행합니다. 샘플링 시 프롬프트를 비교할 때 샘플러를 일관되게 유지하여 텍스트와 참조의 변경 사항을 샘플링이 아닌 것으로 귀속할 수 있습니다. 다양성을 위해 상류에서 RandomNoise 시드를 변경하세요; 이는 미세 모션 및 카메라 느낌을 변경하지만 정체성을 손상시키지 않습니다.
ComfyMathExpression (#19) — 자동 프레임 수#
지속 시간을 H3의 내부 보폭에 맞게 정렬된 프레임 수로 변환하여 리듬 끊김을 방지합니다. 지속 시간 입력 노드만 편집하세요; 표현식은 자동으로 가장 가까운 호환 가능한 수로 반올림됩니다. 이는 부드러운 모션을 유지하고 시각적 비트와 오디오 베드를 동기화합니다.
Resolution Selector (Size) (#20)#
모델 친화적인 타일 크기의 배수인 두 차원을 유지하면서 종횡비와 픽셀 예산을 선택합니다. 전달물에 맞는 측면을 선택한 다음, 세부 사항을 속도와 VRAM으로 교환하기 위해 메가픽셀을 올리거나 내리세요. VAE 및 주의 창에서 잘못된 정렬을 피하기 위해 임의의 크기 대신 이것을 사용하세요.
CreateVideo (#34) 및 SaveVideo (#5)#
프레임과 오디오를 하나의 파일로 멀티플렉싱하여 선호하는 접두사 및 형식으로 저장합니다. 여기서 fps를 조정하여 모델을 다시 샘플링하지 않고 인식된 모션 속도와 사운드 타이밍을 변경합니다. 일관된 비트 깊이와 색상 공간을 사용하여 시리즈를 구축할 때 클립이 균일하게 등급을 매기도록 하세요.
선택적 추가 기능#
- 최상의 결과를 위한 프롬프트 제작
- 한 문장의 장면 요약으로 시작한 다음, 명확한 동사와 타이밍 큐가 있는 1–3개의 샷 블록을 나열합니다.
- 하나의 분위기 라인과, 선택적으로, 억제된 음악 노트를 포함하여 오디오가 의도적으로 느껴지도록 합니다.
- 모순된 지침을 피하세요; MiniMax H3 Taomate 3단계 가속의 짧은 일정은 명확성을 보상합니다.
- 강력한 참조 이미지
- 주제의 얼굴이 보이고 의상이 읽기 쉬운 깨끗한 중간 또는 중간 와이드 프레임을 사용하세요.
- 대상 장면과 유사한 조명 온도와 배경을 유지하여 색상 이동을 줄이세요.
- 빠르고 안정적인 반복
- 시드를 고정하여 프롬프트를 공정하게 비교하고, 한 번에 하나의 제어만 변경하세요.
- 중간 해상도에서 시작하여 모션과 동기화를 확인한 다음, 최종 패스를 위해 동일한 시드로 확장하세요.
- 스타일 제어
- 다른 장르의 외관을 원할 경우 포함된 스타일 LoRA를 H3 호환 LoRA로 교체하세요.
- MiniMax H3 Taomate 3단계 가속 속도 프로파일을 유지하려면 TaoMate H3 가속 LoRA를 활성 상태로 유지하세요.
감사의 말씀#
이 워크플로우는 다음 작품 및 리소스를 구현하고 구축합니다. 우리는 워크플로우 소스를 제공한 RunningHub.ai, TaoMate-H3 프로젝트 및 모델을 제공한 TaoLiveAIGC, MiniMax-H3 모델을 제공한 MiniMaxAI의 기여와 유지 관리에 대해 감사드립니다. 권위 있는 세부 정보는 아래에 연결된 원본 문서 및 저장소를 참조하십시오.
리소스#
- RunningHub.ai/Workflow source
- Docs / Release Notes: RunningHub.ai post
- TaoLiveAIGC/TaoMate-H3 project
- GitHub: TaoLiveAIGC/TaoMate-H3
- Hugging Face: TaoLiveAIGC/TaoMate-H3
- TaoLiveAIGC/TaoMate-H3 model
- Hugging Face: TaoLiveAIGC/TaoMate-H3
- GitHub: TaoLiveAIGC/TaoMate-H3
- MiniMaxAI/MiniMax H3 official model
- Hugging Face: MiniMaxAI/MiniMax-H3
Note: 참조된 모델, 데이터세트 및 코드의 사용은 작성자 및 유지 관리자가 제공한 해당 라이선스 및 조건에 따릅니다.


