이미지 한 장으로 역동적인 AI 영상을 만들어내는 혁신적인 도구
Minimax H3 Reference to Video는 텍스트 프롬프트와 첨부한 참조 미디어를 바탕으로 2K 영상을 생성합니다. 참조 이미지나 동영상을 하나 이상 입력하고 원하는 장면을 설명하면, 모델이 참조 대상을 화면에서 어떻게 표현하고 움직일지 구성합니다.
역할은 명확합니다. 이미지는 대상의 외형을 고정하고, 동영상은 움직임을 지정합니다. Minimax H3 Reference to Video는 어느 한쪽도 고정된 템플릿처럼 복사하지 않고, 프롬프트의 내용과 함께 두 자료를 해석합니다.
이 페이지에서 설정할 수 있는 Minimax H3 Reference to Video 입력 항목입니다.
| 매개변수 | 필수 | 유형 | 기본값 | 범위 / 옵션 | 설명 |
|---|---|---|---|---|---|
| prompt * | 예 (*) | string | 예시 지시문 | 1~4000자 | 장면, 움직임, 카메라 연출, 영상 스타일. |
| reference_images * | 예 (*) | array(URL) | 예시 참조 이미지 | 최대 9장 | 피사체, 스타일, 구도를 지정하는 이미지. |
| reference_videos | 아니요 | array(URL) | 없음 | 최대 3개 | 움직임, 속도감, 상호작용을 지정하는 영상. |
| reference_audios | 아니요 | array(URL) | 없음 | 최대 3개 | 오디오를 참조하며, 이미지나 동영상도 함께 입력해야 합니다. |
| aspect_ratio * | 예 (*) | string | 16:9 | 21:9, 16:9, 4:3, 1:1, 3:4, 9:16 | 출력 화면 비율. |
| duration * | 예 (*) | integer | 5 | 5~15 | 1초 단위의 영상 길이. |
| resolution * | 예 (*) | string | 2k | 2k | 출력 해상도 등급. |
참조 이미지나 참조 동영상을 하나 이상 입력해야 합니다.
Minimax H3 Reference to Video의 요금은 초당 $0.13입니다. 과금 시간은 완성된 영상 길이에 첨부된 모든 참조 동영상의 총 길이를 더해 계산합니다. 참조 이미지와 오디오는 길이에 따라 과금되지 않습니다.
| 출력 영상 | 참조 동영상 | 과금 시간 | 요금 |
|---|---|---|---|
| 5초 | 없음 | 5 | $0.65 |
| 10초 | 없음 | 10 | $1.30 |
| 15초 | 없음 | 15 | $1.95 |
| 10초 | 5초 | 15 | $1.95 |
참조 동영상 길이는 작업이 실행된 뒤 측정되므로 제출 전에 표시되는 금액은 예상치입니다. 최종 요금은 실제 과금 시간에 따라 결정됩니다.
1) 참조 자료 첨부하기 — 피사체의 외형을 지정할 이미지를 추가하고, 움직임이 중요하다면 이를 지정할 동영상도 추가합니다. Minimax H3 Reference to Video에는 둘 중 하나 이상이 필요합니다.
2) 지시문 작성하기 — 동작, 카메라 연출, 조명, 분위기를 설명합니다.
3) 참조 자료의 역할 밝히기 — 어떤 자료가 피사체를 정하고 어떤 자료가 움직임을 정하는지 명시합니다. Minimax H3 Reference to Video는 암시된 관계보다 분명하게 설명된 관계를 더 정확하게 반영합니다.
4) 참조 오디오 추가하기(선택 사항) — Minimax H3 Reference to Video에서는 이미지나 동영상 참조와 함께 입력해야 합니다.
5) 화면 비율 선택하기 — 16:9는 와이드, 9:16은 세로형, 1:1은 정사각형, 21:9는 시네마틱 와이드 화면에 적합합니다.
6) 영상 길이 설정하기 — 테스트할 때는 짧게 시작하고, Minimax H3 Reference to Video의 움직임이 의도대로 나오면 필요에 따라 15초까지 늘립니다.
7) 생성하고 다듬기 — Minimax H3 Reference to Video 결과에서 무엇이 차이를 만들었는지 파악할 수 있도록 참조 자료나 문구를 한 번에 하나씩 바꿉니다.
이미지 한 장으로 역동적인 AI 영상을 만들어내는 혁신적인 도구
인물 사진 1장과 오디오 트랙 1개로 말하는 아바타 영상을 만들고, 선택적 프롬프트로 움직임과 말투를 안내합니다.
영화급 숏폼 영상 제작용 AI 모델, 사실적 표정과 400가지 동작 지원
Kling V3.0 제품군에서 가장 높은 시각적 완성도와 사실적인 움직임을 제공하는 프리미엄 이미지 영상 모델입니다.
필수 시작 이미지와 종료 이미지 사이를 잇는 5초 또는 10초 동영상을 생성합니다. 프롬프트에서 @Image1과 @Image2로 두 이미지를 참조하세요.
Sora 2 Pro로 텍스트 프롬프트에서 동영상을 만들고 출력 크기와 길이를 선택합니다.
RunComfy는 최고의 ComfyUI 플랫폼으로서 ComfyUI 온라인 환경과 서비스를 제공하며 ComfyUI 워크플로우 멋진 비주얼을 제공합니다. RunComfy는 또한 제공합니다 AI Models, 예술가들이 최신 AI 도구를 활용하여 놀라운 예술을 창조할 수 있도록 지원합니다.





