ComfyUI>워크플로우>MiniMax H3 이미지에서 비디오로 ComfyUI - 영화적

MiniMax H3 이미지에서 비디오로 ComfyUI - 영화적

Workflow Name: RunComfy/MiniMax-H3-Video
Workflow ID: 0000...1476
하나의 이미지를 짧은 영화적 비디오로 변환하세요. MiniMax H3 첫 프레임 제어를 사용하여 장면을 안내하세요. 인물, 동물, 제품, 풍경에 자연스러운 모션을 추가하세요. 동기화된 네이티브 오디오를 생성하세요. 설정을 간단하고 효율적으로 유지하세요. 단일 프레임에서 세련된 클립을 만드세요.

MiniMax H3 Image To Video ComfyUI Workflow

MiniMax H3 Image To Video ComfyUI - Native Audio
Want to run this workflow?
  • Fully operational workflows
  • No missing nodes or models
  • No manual setups required
  • Features stunning visuals

MiniMax H3 Image To Video ComfyUI Examples

MiniMax H3 이미지에서 비디오로 ComfyUI: 첫 프레임 애니메이션과 네이티브 오디오#

이 RunComfy 준비된 그래프는 단일 이미지를 모델 생성 오디오와 동기화된 짧은 영화적 비디오로 변환합니다. 이는 MiniMax H3의 FL2VA 경로를 중심으로 구축된 컴팩트하고 검증된 첫 프레임 설정으로, 모션과 사운드가 포스트 프로덕션에서 레이어링 되는 대신 하나의 프롬프트에서 함께 생성됩니다. MiniMax H3 이미지에서 비디오로 ComfyUI는 카메라 모션, 장면 액션, 사운드 디자인을 한 번에 통합하고자 할 때 초상화, 동물, 제품, 분위기 있는 장면에 이상적입니다.

저장된 버전은 첫 프레임만 연결하고 마지막 프레임은 연결하지 않습니다. 이는 제공된 이미지에서 촬영이 진화하도록 하며 두 개의 키프레임 전환을 강요하지 않습니다. 시각과 오디오를 모두 안내하는 하나의 프롬프트를 여전히 작성할 수 있어 MiniMax H3 이미지에서 비디오로 ComfyUI는 빠르게 반복 가능하고 창의적 방향에 신뢰할 수 있습니다.

Comfyui MiniMax H3 이미지에서 비디오로 ComfyUI 워크플로우의 주요 모델#

  • MiniMax H3 FL2VA 확산 백본 (UNet). 텍스트와 키프레임에 의해 조건부 비디오 생성 기능을 제공합니다. 모델 파일
  • Qwen3-VL 32B 인코더 for MiniMax H3 (AWQ/NVFP4). 프롬프트를 내장하여 모델이 장면 콘텐츠, 모션 및 오디오 큐를 정렬할 수 있도록 합니다. 모델 파일
  • MiniMax H3 비디오 VAE. 잠재 비디오 기능을 RGB 프레임으로 디코딩합니다. 모델 파일
  • MiniMax H3 오디오 VAE. 잠재 오디오를 파형으로 디코딩하여 네이티브 사운드트랙 출력을 제공합니다. 모델 파일

Comfyui MiniMax H3 이미지에서 비디오로 ComfyUI 워크플로우 사용 방법#

이 워크플로우는 MiniMax H3를 통해 단일 키프레임을 애니메이션화하고 디코딩된 비디오와 오디오를 하나의 파일로 다중화합니다. 프레임 크기를 설정하고 창의적 개요를 작성하고 렌더링할 수 있도록 작은 읽기 쉬운 그룹으로 구성되어 있습니다. 기본적으로 우회되는 보조 "이미지 크기 사용" 유틸리티가 포함되어 있습니다.

첫 프레임 로드하기 (LoadImage (#114))#

애니메이션화하려는 정지 이미지를 가져옵니다. 그래프는 의도적으로 last_frame을 사용하지 않으므로 모션이 이 하나의 이미지에서 성장합니다. 최적의 시간적 안정성을 위해 명확한 경계와 균형 잡힌 노출을 가진 주제를 선택하세요. 나중에 시작부터 끝까지 보간을 원할 경우, 두 번째 이미지를 서브그래프의 last_frame 입력에 연결할 수 있습니다.

프레임 크기 선택하기 (ResolutionSelector (#115))#

widthheight를 정의하기 위해 측면 프리셋을 선택하고 스케일링합니다. MiniMax H3는 32의 배수와 적당한 짧은 변을 가진 차원에서 최상의 성능을 발휘합니다. 카메라가 움직일 때 주제가 편안하게 프레임 안에 남도록 구성을 비율에 맞추세요. 소스 차원을 정확히 반영하고 싶다면, "이미지 크기 사용" 미니 그룹이 이를 읽을 수 있지만, 이 프리셋에서 선택기를 무시하도록 연결되어 있지 않습니다.

샷 설명 및 타이밍 (MiniMaxH3ImageToVideo (#104) + Float (duration) (#111) + ComfyMathExpression (#107))#

사진과 사운드를 결합하는 하나의 프롬프트를 작성하세요: 카메라 움직임, 주제 행동, 화면 텍스트, 분위기, "대화 없음" 또는 "음악 없음"과 같은 제약 조건. 초 단위로 지속 시간을 설정합니다; 수학 노드는 이를 MiniMax H3의 내부 단계 그리드를 위한 유효한 프레임 length로 변환하여 타이밍을 일관되게 유지합니다. 첫 프레임 이미지가 구성을 고정하는 동안 모델은 모션, 조명 및 효과를 애니메이션화하여 설명을 존중합니다. 같은 프롬프트에서 명확한 오디오 큐는 생성 중에 생성된 사운드트랙을 안내합니다.

샘플링 및 모션 느낌 (RandomNoise (#15) + KSamplerSelect (#17) + BasicScheduler (#9) + SamplerCustomAdvanced (#14))#

샘플링은 잠재 비디오가 어떻게 진화하는지를 정의합니다. 선택된 샘플러와 스케줄러는 균형 잡힌 모습을 제공합니다; 반복 가능한 촬영을 위해 시드를 고정하거나 모션 대안을 탐색하려면 무작위화할 수 있습니다. 프레임이나 행동에 대한 강한 준수를 원하면 매개변수를 과도하게 지정하기보다는 시드와 워딩 변경으로 반복하세요. 이는 MiniMax H3 이미지에서 비디오로 ComfyUI를 창의적이면서도 제어 가능하게 유지합니다.

디코딩 및 다중화 (VAELoader (#11, #24) + VAEDecode + VAEDecodeAudio + CreateVideo (#91))#

디노이징 후, 비디오 VAE는 프레임을 재구성하고 오디오 VAE는 사운드트랙을 재구성합니다. CreateVideo는 이를 하나의 시간 정렬된 스트림으로 병합합니다. 이 설계는 두 가지 모달리티가 동일한 생성 패스에서 기원하기 때문에 동기화를 유지합니다. 외부 편집기 없이 결과를 빠르게 미리 볼 수 있습니다.

결과 저장 (SaveVideo (#92))#

최종 노드는 렌더링된 클립을 디스크에 작성합니다. 출력에는 모델에서 생성된 이미지와 네이티브 오디오가 포함되어 있어 MiniMax H3 이미지에서 비디오로 ComfyUI는 공유하거나 등급을 매길 수 있는 완성된 파일을 제공합니다.

Comfyui MiniMax H3 이미지에서 비디오로 ComfyUI 워크플로우의 주요 노드#

MiniMaxH3ImageToVideo (#104)#

그래프의 중심입니다. 프롬프트, 로드된 인코더/VAEs, 첫 프레임을 결합하여 동기화된 오디오가 있는 잠재 비디오를 생성합니다. 장면과 사운드를 위한 prompt, 캔버스를 위한 widthheight, 지속 시간을 위한 length를 조정하세요. 차원을 32의 배수로 유지하고, "바람 소리, 먼 파도 소리, 대화 없음"과 같은 간결한 오디오 지침을 사용하여 사운드트랙을 안내합니다.

ComfyMathExpression (#107)#

선택한 초를 MiniMax H3의 내부 타이밍 단계와 일치하는 프레임 수로 변환합니다. 비트나 화면 텍스트가 정확한 순간에 도착해야 한다면, 여기서 지속 시간을 조정하고 다시 렌더링하세요. 이는 반복 사이에 컷 포인트와 오디오 이벤트를 일관되게 유지합니다.

ResolutionSelector (#115)#

수동 계산 없이 공통 화면 비율과 픽셀 예산을 대상으로 하는 빠른 방법입니다. 주제에 맞는 비율을 선택하고 속도와 세부 사항을 위해 확장하거나 축소하세요. 키가 크거나 넓은 주제에서 잘림이 발생하면 극단적인 스케일을 강요하지 말고 비율을 변경하세요.

RandomNoise (#15)#

초기 잠재 상태를 제어합니다. 정확한 촬영을 재현하려면 시드를 고정하거나 다른 모션 경로와 오디오 이벤트의 미세 타이밍을 탐색하려면 무작위화하세요. A/B 비교를 위해, 시드만 변경하여 그 효과를 격리하세요.

선택적 추가 사항#

  • 프롬프트 초기에 "부드러운 비, 천 소리, 보컬 없음"과 같은 짧고 구체적인 큐로 오디오를 작성하여 모델이 분위기와 행동을 균형 있게 조정하도록 하세요.
  • 초상화를 위해, 첫 프레임에서 눈을 중심에 두고 배경 혼잡을 피하세요; 이는 시간적 안정성을 향상시키고 주제에 대한 주의를 유지합니다.
  • 브랜드나 플랫폼 요구에 맞추려면 먼저 화면 비율을 선택한 다음 지속 시간과 프롬프트를 세부 조정하세요; MiniMax H3 이미지에서 비디오로 ComfyUI는 반복할 때 사진과 사운드를 동기화 상태로 유지합니다.
  • 나중에 두 개의 키프레임 전환을 원한다면, 두 번째 이미지를 서브그래프의 last_frame 입력에 연결하고 같은 프롬프트에서 컷이나 움직임을 설명하세요.
  • 공식 ComfyUI MiniMax H3 I2V 템플릿은 고급 사용자 정의를 위한 유용한 참조입니다. 템플릿 보기

감사의 말씀#

이 워크플로우는 다음 작업 및 리소스를 구현하고 기반으로 합니다. 우리는 MiniMaxAI의 MiniMax H3 모델 컬렉션, 공식 ComfyUI MiniMax H3 I2V 템플릿을 위한 Comfy-Org, MiniMax H3 튜토리얼 및 워크플로우 소스를 위한 Comfy.org 및 RunningHub의 기여와 유지보수에 감사를 표합니다. 권위 있는 세부 사항은 아래 링크된 원본 문서 및 저장소를 참조하십시오.

리소스#

참고: 참조된 모델, 데이터세트 및 코드의 사용은 저자 및 유지 관리자가 제공한 해당 라이선스 및 조건에 따릅니다.

RunComfy
저작권 2026 RunComfy. All Rights Reserved.

RunComfy는 최고의 ComfyUI 플랫폼으로서 ComfyUI 온라인 환경과 서비스를 제공하며 ComfyUI 워크플로우 멋진 비주얼을 제공합니다. RunComfy는 또한 제공합니다 AI Models, 예술가들이 최신 AI 도구를 활용하여 놀라운 예술을 창조할 수 있도록 지원합니다.