한 장의 이미지에 원하는 Pikaffect를 적용해 영상으로 변환합니다.
이 모델은 한 장의 사진과 서면 방향을 찍은 다음 이미지에 사운드가 포함된 영화 같은 짧은 영상으로 애니메이션을 적용합니다. 이는 텍스트-동영상, 동영상 편집 및 동영상 참조를 포괄하는 Google의 Gemini Omni Flash 제품군에 속합니다. 이 RunComfy 페이지는 이미지-동영상 작업을 실행합니다.
모델은 실제 세계가 어떻게 작동하는지 추론하기 때문에 샷이 진행되는 동안 움직임이 표류하거나 뒤틀리는 대신 첫 번째 프레임부터 일관성을 유지합니다.
입력은 이미지-동영상 작업에 대한 RunComfy OpenAPI Input 스키마와 일치합니다.
| 매개변수 | 필수 | 유형 | 기본값 | 범위 / 옵션 | 설명 |
|---|---|---|---|---|---|
| prompt* | 예 (*) | string | — | 설명 텍스트 | 입력 이미지가 어떻게 움직이거나 변할지 설명 |
| image_url* | 예 (*) | string(이미지 URI) | — | jpg, jpeg, png, webp | 애니메이션으로 만들 정지 이미지 |
| aspect_ratio | 아니요 | string | 16:9 | 16:9, 9:16 | 생성된 동영상의 화면 비율 |
| duration | 아니요 | integer | 8 | 3~10초 | 생성된 동영상의 길이(1초 단위) |
청구는 생성된 클립의 길이를 기준으로 합니다.
한 장의 이미지에 원하는 Pikaffect를 적용해 영상으로 변환합니다.
기존 영상을 프롬프트에 따라 7초 연장하고 720p로 출력하며 오디오 생성 여부도 선택할 수 있습니다.
필수 프롬프트를 바탕으로 5초 또는 8초 동영상을 생성합니다. 선택형 네거티브 프롬프트, 네 가지 출력 크기와 시드를 설정할 수 있습니다.
HappyHorse 1.0 Reference to Video는 최대 9개의 참조 이미지와 프롬프트를 안정적인 정체성을 지닌 일관된 다중 문자 클립으로 융합합니다.
Alibaba의 HappyHorse 1.0 Video Edit는 스타일 전송, 로컬 교체 및 복장 교체를 위한 텍스트 지침과 참조 이미지로 입력 비디오를 편집합니다.
텍스트 지시에 따라 소스 동영상을 편집하면서 장면의 일관성을 유지합니다.
Gemini Omni Flash Image to Video는 단일 스틸 이미지와 텍스트 프롬프트를 가져온 다음 해당 사진을 동기화된 오디오와 함께 짧은 클립으로 애니메이션화합니다. 피사체와 장면의 자연스러운 움직임을 추론하므로 별도의 애니메이션이나 오디오 단계 없이 하나의 프레임을 소리가 포함된 움직이는 장면으로 전환할 수 있습니다.
스틸 사진을 짧은 소셜 클립으로 변환하고, 참조 이미지에서 카메라 움직임과 속도를 테스트하고, 시청각 컨셉을 신속하게 프로토타입화하는 데 적합합니다. 제작자, 마케팅 담당자, 영화 또는 게임 팀은 전체 제작 과정을 진행하기 전에 Gemini Omni Flash Image to Video를 사용하여 동작과 분위기를 탐색하는 경우가 많습니다.
모델은 애니메이션 화면에 맞춰 대사, 주변 음향, 필요에 따른 음악을 생성합니다. Gemini Omni Flash Image to Video 프롬프트에서 원하는 대사의 분위기나 배경음을 지정할 수 있으며, 조용한 클립이 필요하면 “대사 없음”이라고 요청할 수 있습니다.
업로드된 이미지에서 시작하면 텍스트 프롬프트보다 첫 장면의 구도와 피사체의 정체성을 더욱 엄격하게 제어할 수 있습니다. Gemini Omni Flash Image to Video를 사용하면 정지 이미지가 화면의 외형을 고정하고 프롬프트가 장면의 이동 방식을 지시하므로 이미 특정 프레임을 염두에 두고 있을 때 유용합니다.
Gemini Omni Flash Image to Video는 16:9 가로 및 9:16 세로 프레임을 지원하며 클립 길이는 3~10초입니다. 사용 가능한 설정은 시간이 지남에 따라 변경될 수 있으므로 정확한 옵션을 보려면 현재 RunComfy 파라미터 화면을 확인하세요.
하나의 입력 이미지와 모션을 설명하는 텍스트 프롬프트를 제공합니다. 지원되는 이미지 형식에는 jpg, jpeg, png 및 webp가 포함됩니다. 패널에 나열되지 않은 제한 사항에 대해서는 RunComfy 매개변수 필드를 검토하세요. 일부 제한 사항은 공급자 설정에 따라 다를 수 있기 때문입니다.
예. RunComfy AI 모델 UI에서 Gemini Omni Flash Image to Video의 프로토타입을 만든 다음 자동화 및 생산을 위해 동일한 매개변수를 사용하여 RunComfy HTTP API를 통해 동일한 모델을 호출할 수 있습니다. 이를 통해 모델을 직접 호스팅하거나 확장하지 않고도 테스트에서 통합으로 이동할 수 있습니다.
Gemini Omni Flash Image to Video 요금은 생성된 동영상 길이를 기준으로 초당 $0.14입니다. 비용은 RunComfy 계정의 USD 잔액 또는 크레딧에서 차감됩니다. 신규 사용자에게는 일반적으로 체험 크레딧이 제공되며, 최신 요금은 이 페이지의 생성 영역에서 확인할 수 있습니다.
RunComfy는 최고의 ComfyUI 플랫폼으로서 ComfyUI 온라인 환경과 서비스를 제공하며 ComfyUI 워크플로우 멋진 비주얼을 제공합니다. RunComfy는 또한 제공합니다 AI Models, 예술가들이 최신 AI 도구를 활용하여 놀라운 예술을 창조할 수 있도록 지원합니다.





