logo
RunComfy
  • ComfyUI
  • 트레이너신규
  • 모델
  • API
  • 가격
discord logo
모델
탐색
모든 모델
라이브러리
생성 기록
모델 API
API 문서
API 키
계정
사용량

Gemini Omni Flash Image to Video: 정지 이미지를 동기화 오디오 영상으로 변환 | RunComfy

google/gemini-omni-flash/image-to-video

Gemini Omni Flash Image to Video는 업로드한 이미지를 네이티브 동기화 오디오가 포함된 짧은 클립으로 만듭니다. 프롬프트로 움직임을 제어하며 16:9 또는 9:16, 3~10초를 지원합니다.

입력 이미지가 어떻게 움직이거나 변할지 설명합니다. 프롬프트에서 카메라 움직임, 속도, 오디오를 지정할 수 있습니다(예: “천천히 카메라를 당겨 촬영”, “부드러운 바람과 새소리”, “대사 없음”). “텍스트 표시 안 함”과 같은 제외 지시도 추가할 수 있습니다.
애니메이션을 적용할 입력 이미지입니다. 지원되는 형식에는 jpg, jpeg, png, webp가 포함됩니다.
생성된 동영상의 화면 비율입니다.
생성된 동영상의 영상 길이(초)입니다.
Idle
The rate is $0.14 per second of generated video.

Gemini Omni Flash Image to Video 소개

Google의 Gemini Omni Flash Image to Video는 한 장의 정지 이미지를 움직임과 오디오가 동기화된 3~10초 클립으로 확장합니다. Gemini의 현실 세계에 대한 이해를 바탕으로 자연스럽고 일관된 움직임을 만듭니다. 애니메이션, 키프레임, 사운드 디자인을 따로 작업하는 대신 한 번의 프롬프트 기반 생성으로 완성할 수 있어 마케팅, 영상 제작, 게임, 소셜 콘텐츠에 적합합니다. RunComfy에서는 브라우저와 HTTP API로 사용할 수 있으며 모델을 직접 호스팅하거나 확장할 필요가 없습니다.
추천 용도: 정지 이미지 기반 소셜 클립 | 시청각 콘셉트 테스트 | 참조 이미지 기반 시네마틱 샷

Google / Gemini Omni Flash Image to Video#


이 모델은 한 장의 사진과 서면 방향을 찍은 다음 이미지에 사운드가 포함된 영화 같은 짧은 영상으로 애니메이션을 적용합니다. 이는 텍스트-동영상, 동영상 편집 및 동영상 참조를 포괄하는 Google의 Gemini Omni Flash 제품군에 속합니다. 이 RunComfy 페이지는 이미지-동영상 작업을 실행합니다.


모델은 실제 세계가 어떻게 작동하는지 추론하기 때문에 샷이 진행되는 동안 움직임이 표류하거나 뒤틀리는 대신 첫 번째 프레임부터 일관성을 유지합니다.


하이라이트#


  • 단일 이미지 애니메이션: 하나의 스틸에서 시작하여 모델이 피사체와 장면에 대해 자연스럽고 물리학을 인식하는 모션을 추론하도록 합니다.
  • 기본 동기화 오디오: 음성, 주변 소리, 음악이 사진에 맞춰 생성되므로 별도의 오디오 패스 없이 클립을 공유할 수 있습니다.
  • 프롬프트 기반 모션: 카메라 움직임, 속도, 분위기를 일반 언어로 설명하여 프레임이 어떻게 살아나는지 형성합니다.
  • 실제 지식 기반: Gemini의 실제 이해에 기반한 출력을 제공하여 애니메이션 장면이 믿을 수 있고 주제에 부합하도록 돕습니다.
  • 유연한 프레이밍: 16:9 가로 또는 9:16 세로를 선택하세요. 전체 길이는 3~10초입니다.
  • 제품군에 속함: Gemini Omni Flash 라인업은 여러 동영상 작업을 포괄합니다. 이 페이지에서는 이미지를 모션으로 바꾸는 데 중점을 둡니다.

매개변수#


입력은 이미지-동영상 작업에 대한 RunComfy OpenAPI Input 스키마와 일치합니다.


매개변수필수유형기본값범위 / 옵션설명
prompt*예 (*)string—설명 텍스트입력 이미지가 어떻게 움직이거나 변할지 설명
image_url*예 (*)string(이미지 URI)—jpg, jpeg, png, webp애니메이션으로 만들 정지 이미지
aspect_ratio아니요string16:916:9, 9:16생성된 동영상의 화면 비율
duration아니요integer83~10초생성된 동영상의 길이(1초 단위)

가격#


청구는 생성된 클립의 길이를 기준으로 합니다.


  • 동영상: 생성된 동영상의 초당 $0.14입니다.

관련 모델

pikaffects

한 장의 이미지에 원하는 Pikaffect를 적용해 영상으로 변환합니다.

veo-3-1/fast/extend-video

기존 영상을 프롬프트에 따라 7초 연장하고 720p로 출력하며 오디오 생성 여부도 선택할 수 있습니다.

hunyuan-video-v1.5/text-to-video

필수 프롬프트를 바탕으로 5초 또는 8초 동영상을 생성합니다. 선택형 네거티브 프롬프트, 네 가지 출력 크기와 시드를 설정할 수 있습니다.

happyhorse-1.0/reference-to-video

HappyHorse 1.0 Reference to Video는 최대 9개의 참조 이미지와 프롬프트를 안정적인 정체성을 지닌 일관된 다중 문자 클립으로 융합합니다.

happyhorse-1.0/video-edit

Alibaba의 HappyHorse 1.0 Video Edit는 스타일 전송, 로컬 교체 및 복장 교체를 위한 텍스트 지침과 참조 이미지로 입력 비디오를 편집합니다.

gemini-omni-flash/video-edit

텍스트 지시에 따라 소스 동영상을 편집하면서 장면의 일관성을 유지합니다.

자주 묻는 질문

Gemini Omni Flash Image to Video는 무엇을 합니까?

Gemini Omni Flash Image to Video는 단일 스틸 이미지와 텍스트 프롬프트를 가져온 다음 해당 사진을 동기화된 오디오와 함께 짧은 클립으로 애니메이션화합니다. 피사체와 장면의 자연스러운 움직임을 추론하므로 별도의 애니메이션이나 오디오 단계 없이 하나의 프레임을 소리가 포함된 움직이는 장면으로 전환할 수 있습니다.

Gemini Omni Flash Image to Video는 어떤 용도에 적합한가요?

스틸 사진을 짧은 소셜 클립으로 변환하고, 참조 이미지에서 카메라 움직임과 속도를 테스트하고, 시청각 컨셉을 신속하게 프로토타입화하는 데 적합합니다. 제작자, 마케팅 담당자, 영화 또는 게임 팀은 전체 제작 과정을 진행하기 전에 Gemini Omni Flash Image to Video를 사용하여 동작과 분위기를 탐색하는 경우가 많습니다.

Gemini Omni Flash Image to Video는 오디오를 어떻게 처리합니까?

모델은 애니메이션 화면에 맞춰 대사, 주변 음향, 필요에 따른 음악을 생성합니다. Gemini Omni Flash Image to Video 프롬프트에서 원하는 대사의 분위기나 배경음을 지정할 수 있으며, 조용한 클립이 필요하면 “대사 없음”이라고 요청할 수 있습니다.

Gemini Omni Flash Image to Video는 텍스트-동영상 생성과 어떻게 다릅니까?

업로드된 이미지에서 시작하면 텍스트 프롬프트보다 첫 장면의 구도와 피사체의 정체성을 더욱 엄격하게 제어할 수 있습니다. Gemini Omni Flash Image to Video를 사용하면 정지 이미지가 화면의 외형을 고정하고 프롬프트가 장면의 이동 방식을 지시하므로 이미 특정 프레임을 염두에 두고 있을 때 유용합니다.

Gemini Omni Flash Image to Video는 어떤 화면 비율와 영상 길이를 지원하나요?

Gemini Omni Flash Image to Video는 16:9 가로 및 9:16 세로 프레임을 지원하며 클립 길이는 3~10초입니다. 사용 가능한 설정은 시간이 지남에 따라 변경될 수 있으므로 정확한 옵션을 보려면 현재 RunComfy 파라미터 화면을 확인하세요.

Gemini Omni Flash Image to Video를 사용하기 전에 어떤 입력 제한을 확인해야 하나요?

하나의 입력 이미지와 모션을 설명하는 텍스트 프롬프트를 제공합니다. 지원되는 이미지 형식에는 jpg, jpeg, png 및 webp가 포함됩니다. 패널에 나열되지 않은 제한 사항에 대해서는 RunComfy 매개변수 필드를 검토하세요. 일부 제한 사항은 공급자 설정에 따라 다를 수 있기 때문입니다.

개발자가 RunComfy API를 통해 Gemini Omni Flash Image to Video를 사용할 수 있나요?

예. RunComfy AI 모델 UI에서 Gemini Omni Flash Image to Video의 프로토타입을 만든 다음 자동화 및 생산을 위해 동일한 매개변수를 사용하여 RunComfy HTTP API를 통해 동일한 모델을 호출할 수 있습니다. 이를 통해 모델을 직접 호스팅하거나 확장하지 않고도 테스트에서 통합으로 이동할 수 있습니다.

RunComfy에서 Gemini Omni Flash Image to Video로 생성하는 데 비용이 얼마나 드나요?

Gemini Omni Flash Image to Video 요금은 생성된 동영상 길이를 기준으로 초당 $0.14입니다. 비용은 RunComfy 계정의 USD 잔액 또는 크레딧에서 차감됩니다. 신규 사용자에게는 일반적으로 체험 크레딧이 제공되며, 최신 요금은 이 페이지의 생성 영역에서 확인할 수 있습니다.

팔로우하기
  • 링크드인
  • 페이스북
  • Instagram
  • 트위터
지원
  • 디스코드
  • 이메일
  • 시스템 상태
  • 제휴사
비디오 모델
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 모든 모델 보기 →
이미지 모델
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 모든 모델 보기 →
법적 고지
  • 서비스 약관
  • 개인정보 보호정책
  • 쿠키 정책
RunComfy
저작권 2026 RunComfy. All Rights Reserved.

RunComfy는 최고의 ComfyUI 플랫폼으로서 ComfyUI 온라인 환경과 서비스를 제공하며 ComfyUI 워크플로우 멋진 비주얼을 제공합니다. RunComfy는 또한 제공합니다 AI Models, 예술가들이 최신 AI 도구를 활용하여 놀라운 예술을 창조할 수 있도록 지원합니다.

Gemini Omni Flash Image to Video 사용 예

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...