ComfyUI>워크플로우>Minimax H3 I2V 듀얼 클럭 8단계| 초고속 고품질 비디오

Minimax H3 I2V 듀얼 클럭 8단계| 초고속 고품질 비디오

Workflow Name: RunComfy/Minimax-H3-I2V-Dual-Clock
Workflow ID: 0000...1496
단일 이미지를 짧은 오디오-비디오 장면으로 변환합니다. 간단한 프롬프트로 모션과 사운드를 안내하세요. 듀얼 클럭이 비주얼과 스테레오 오디오를 동기화 상태로 유지합니다. 8단계 터보 설정은 렌더링 시간을 단축합니다. 캐릭터, 제품, 차량 또는 풍경을 애니메이션화하세요. 적은 설정으로 영화 같은 모션을 얻으세요.

ComfyUI Minimax H3 I2V Dual Clock 8-Step High-Quality Ultra-Fast Workflow

Minimax H3 I2V ComfyUI | 8-Step Dual Clock Audio Video
Want to run this workflow?
  • Fully operational workflows
  • No missing nodes or models
  • No manual setups required
  • Features stunning visuals

ComfyUI Minimax H3 I2V Dual Clock 8-Step High-Quality Ultra-Fast Examples

Minimax H3 I2V 듀얼 클럭 8단계 고품질 초고속#

이 RunComfy-ready ComfyUI 워크플로우는 단일 참조 이미지와 결합된 모션 및 오디오 프롬프트를 짧고 동기화된 비디오로 변환하여 네이티브 스테레오 사운드를 제공합니다. MiniMax H3 Ref2VA 조건부와 8단계 듀얼 클럭 샘플러를 중심으로 구축되어 빠른 이미지 애니메이션과 시각적 일관성을 유지하면서도 긴밀하게 결합된 사운드를 제공합니다.

영화 같은 이미지 애니메이션, 캐릭터 퍼포먼스, 차량, 제품 촬영 및 동기화된 모션과 생성된 오디오가 필요한 분위기 있는 장면에 Minimax H3 I2V 듀얼 클럭 8단계 고품질 초고속 워크플로우를 사용하세요. 그래프는 메모리 효율적인 추론을 위한 SageAttention을 통합하고 MiniMax-H3 Turbo LoRA를 사용하여 사용자 친화적인 I2V 경험을 단순하게 유지하면서도 생성 속도를 가속화합니다.

Comfyui Minimax H3 I2V 듀얼 클럭 8단계 고품질 초고속 워크플로우의 주요 모델#

  • MiniMax-H3 AV Foundation Model. 참조 이미지 조건부, 모션 생성 및 네이티브 오디오 합성을 지원하는 핵심 오디오비주얼 변환기입니다. 공식 모델 카드: MiniMaxAI/MiniMax-H3.
  • MiniMax-H3 Turbo LoRA V4 step600. 8단계 샘플링을 위해 MiniMax-H3를 가속화하고 안정화하는 경량 어댑터로, 충실도를 유지합니다. 모델 카드: larryvrh/MiniMax-H3-Turbo-Lora.
  • MiniMax-H3 Video VAE 및 Audio VAE. 오디오비주얼 잠재 변수를 RGB 프레임과 스테레오 파형으로 변환하는 페어링된 디코더입니다. 샘플링 중 효율적인 잠재 전송과 고품질 디코딩을 보장합니다.

Comfyui Minimax H3 I2V 듀얼 클럭 8단계 고품질 초고속 워크플로우 사용 방법#

이 워크플로우는 세 가지 그룹화된 단계로 왼쪽에서 오른쪽으로 실행됩니다: 모델 및 자산 설정, 듀얼 클럭 샘플링, 디코드 및 MP4 멀티플렉싱. 하나의 참조 이미지와 시각적 방향 및 원하는 사운드를 설명하는 “Audio:” 섹션을 포함한 단일 프롬프트를 제공합니다.

H3 로더 + Turbo LoRA (EMA)#

이 그룹은 MiniMax-H3 스택을 준비하고 속도를 위해 Turbo LoRA를 적용합니다. LoadImage에 참조 이미지를 로드한 후, CR Prompt Text에 “Audio: …” 절로 끝나는 설명적인 모션 프롬프트를 작성하세요. ResolutionSelector를 사용하여 출력 크기를 선택하세요. 이는 비디오 안정성을 위해 32의 배수로 치수를 유지합니다. Float (duration) 제어를 사용하여 목표 지속 시간을 초 단위로 설정하세요. 그래프의 내부 수학이 샘플러가 원활하게 실행될 수 있도록 모델의 타이밍에 맞춰 프레임 수로 변환합니다. SageAttention 패치가 모델에 적용되어 VRAM 사용을 줄이고 최종 모양을 변경하지 않고 처리량을 개선합니다.

STABLE: 비디오 4 / 오디오 4#

이 그룹은 8단계 MiniMax H3 듀얼 클럭 샘플러로 생성의 핵심을 수행합니다. 조건부 블록은 Ref2VA를 사용하여 참조 이미지와 텍스트 프롬프트를 AV 잠재 변수로 융합하여 정체성, 구성 및 고급 사운드 큐를 앵커로 만듭니다. 듀얼 클럭 샘플러는 별도의 동기화된 클럭으로 비디오와 오디오를 진행하여 모션과 사운드가 자연스럽게 잠금 상태를 유지하도록 합니다. 인지된 리드 또는 지연을 수정해야 할 경우, 비디오 및 오디오 클럭 이동을 조정하여 성능이 동기화될 때까지 어느 스트림을 앞으로 또는 뒤로 미세 조정합니다. 기본 CFG 스타일의 안내자가 프롬프트에 대한 충실도와 모델의 학습된 우선순위 사이의 균형을 맞춰 깨끗하고 영화 같은 모션을 제공합니다.

디코드 + 동기화된 MP4#

디코더는 전용 MiniMax-H3 VAE를 사용하여 최종 AV 잠재 변수를 프레임 시퀀스와 스테레오 오디오 트랙으로 변환합니다. VHS_VideoCombine 단계는 프레임과 오디오를 단일 H.264 MP4로 패키지화하여 선택한 프레임 속도로 저장하여 공유할 준비가 된 비디오를 만듭니다. 나중에 자체 오디오를 가져올 경우, 오디오 길이에 맞춰 자르거나 외부 편집을 위해 이미지 전용으로 내보낼 수 있습니다. 결과는 참조 이미지의 모양을 유지하면서 생동감 있는 움직임과 사운드를 추가한 간결하고 동기화된 클립입니다.

Comfyui Minimax H3 I2V 듀얼 클럭 8단계 고품질 초고속 워크플로우의 주요 노드#

MiniMaxH3AudioConditioningT8 (#6)#

이 노드는 Ref2VA 조건부를 구현하여 프롬프트, 참조 이미지, 목표 너비, 높이, 길이를 사용하여 오디오비주얼 잠재 변수와 긍정적 조건부를 생성합니다. 창의적 의도를 설정하는 데 사용하세요: 모션, 카메라 동작, 장면 연속성을 설명한 다음, 악기, 음색, 분위기, 다이내믹스를 지정하는 “Audio:” 세그먼트를 추가하세요. 너비와 높이를 참조 이미지의 비율과 일치시켜 가장 일관된 레이아웃을 유지하세요. 길이 제어는 샘플러의 내부 타이밍에 맞춰 프레임으로 지속 시간을 매핑하여 부드러운 모션과 안정적인 오디오를 유지하는 데 도움을 줍니다. ComfyUI MiniMax H3 Turbo 프로젝트에서 제공: Larryvrh/ComfyUI-MiniMax-H3-Turbo.

MiniMaxH3DualClockSamplerT8 (#7)#

MiniMax-H3 AV 생성을 위해 별도의 비디오 및 오디오 클럭으로 설계된 8단계 샘플러입니다. Ref2VA 제약을 준수하면서 두 타임라인을 조율하여 빠르고 고품질의 결과를 생산합니다. 비주얼이 비트 또는 액션에 비해 약간 빠르거나 느리게 느껴진다면, 비디오 및 오디오 클럭 이동을 소폭 조정하여 동기화를 다시 중앙에 맞추세요. 고품질 초고속 균형을 위해 단계 수를 8로 유지하세요. 동일한 플러그인에서 구현됨: Larryvrh/ComfyUI-MiniMax-H3-Turbo.

LoraLoaderBypassModelOnly (#2)#

MiniMax-H3 Turbo LoRA를 기본 모델에 주입하여 수렴 속도를 가속화하고 낮은 단계에서의 안정성을 개선합니다. 특정 이미지에서 과도한 선명화 또는 정체성 드리프트가 발생하면 LoRA 강도를 약간 줄여 중립성을 되찾으세요. 더 강한 세부 사항이나 강한 시간 잠금을 원할 경우, 강도를 적절히 증가시키세요. LoRA 참조: larryvrh/MiniMax-H3-Turbo-Lora.

MiniMaxH3MemoryEfficientSageAttentionPatch (#17)#

일반적인 GPU에서 더 나은 처리량을 위해 MiniMax-H3 모델에 메모리 효율적인 주의 구현을 적용합니다. 더 큰 해상도와 긴 지속 시간에 대한 VRAM 압력을 줄이기 위해 그대로 사용하세요. 패치는 ComfyUI의 KJNodes 스위트의 일부입니다: kijai/ComfyUI-KJNodes.

MiniMaxH3AVDecodeT8 (#11)#

페어링된 MiniMax-H3 VAE를 사용하여 오디오비주얼 잠재 변수를 RGB 프레임과 스테레오 오디오로 디코딩합니다. 여기서 최종 충실도가 실현되므로 해상도 선택을 GPU에 현실적으로 유지하여 디코드 병목을 피하세요. 노드는 샘플러의 클럭과 시간 정렬된 프레임과 오디오 신호를 출력하여 멀티플렉싱 준비가 되어 있습니다. MiniMax H3 Turbo 플러그인에서 제공됨: Larryvrh/ComfyUI-MiniMax-H3-Turbo.

VHS_VideoCombine (#12)#

Video Helper Suite를 사용하여 디코딩된 프레임과 스테레오 오디오를 단일 MP4로 결합합니다. 선호하는 프레임 속도를 설정하고 나중에 사용자 정의 오디오를 대체할 경우 트리밍을 활성화하세요. 이 노드는 미리보기 및 빠른 내보내기를 위해 전달을 완료합니다. 프로젝트 참조: Kosinkadink/ComfyUI-VideoHelperSuite.

선택적 추가 기능#

  • 프롬프팅은 시각적 방향과 사운드 디자인을 나누어 작성할 때 가장 잘 작동합니다. 장면을 먼저 작성한 후, 악기, 스타일, 방 유형 및 강도를 포함하는 “Audio:”를 추가하세요.
  • 모션과 타이밍이 마음에 들면, 이미지 비율에 맞는 중간 크기로 시작하세요. 그 후 크기를 늘리세요.
  • 동기화가 맞지 않으면 지속 시간을 변경하는 대신 비디오 또는 오디오 클럭 이동을 조정하세요. 작은 조정이 비트에 성능을 잠글 수 있습니다.
  • 캐릭터 촬영의 경우, 모션을 통해 정체성을 유지하기 위해 명확한 주제 분리와 일관된 조명이 있는 이미지를 선택하세요.
  • 동일한 설정을 유지하면서 구문 및 타이밍의 미세한 변화를 탐색하기 위해 재시드하세요.

감사의 말#

이 워크플로우는 다음 작업 및 리소스를 구현하고 기반으로 합니다. 우리는 Source 워크플로우 템플릿에 대한 RunningHub, MiniMax-H3 모델 가중치에 대한 MiniMaxAI, 그리고 MiniMax-H3 Turbo LoRA 및 ComfyUI MiniMax H3 Turbo 프로젝트에 대한 Larryvrh의 기여와 유지 보수에 대해 감사드립니다. 권위 있는 세부 사항은 아래에 링크된 원본 문서 및 저장소를 참조하세요.

리소스#

참고: 참조된 모델, 데이터세트 및 코드의 사용은 작성자 및 유지 관리자가 제공하는 해당 라이센스 및 조건에 따릅니다.

RunComfy
저작권 2026 RunComfy. All Rights Reserved.

RunComfy는 최고의 ComfyUI 플랫폼으로서 ComfyUI 온라인 환경과 서비스를 제공하며 ComfyUI 워크플로우 멋진 비주얼을 제공합니다. RunComfy는 또한 제공합니다 AI Models, 예술가들이 최신 AI 도구를 활용하여 놀라운 예술을 창조할 수 있도록 지원합니다.