logo
RunComfy
  • ComfyUI
  • 트레이너신규
  • 모델
  • API
  • 가격
discord logo
모델
탐색
모든 모델
라이브러리
생성 기록
모델 API
API 문서
API 키
계정
사용량

Gemini Omni Flash: 동기화 오디오를 지원하는 텍스트 투 동영상 | RunComfy

google/gemini-omni-flash/text-to-video

Gemini Omni Flash는 텍스트 프롬프트에서 네이티브 동기화 오디오가 포함된 짧은 시네마틱 영상을 생성하며 16:9와 9:16, 3~10초 길이를 지원합니다.

생성할 동영상을 설명합니다. 프롬프트에서 ‘하나의 연속된 숏’, ‘잔잔한 배경 음악’, ‘대사 없음’처럼 속도와 오디오를 직접 지정하고 ‘화면에 텍스트를 표시하지 않기’ 같은 제외 지시도 추가할 수 있습니다.
생성할 동영상의 화면 비율입니다.
생성할 동영상의 길이를 초 단위로 지정합니다.
Idle
The rate is $0.13 per second of generated video.

Gemini Omni Flash 소개

Google의 Gemini Omni Flash는 하나의 텍스트 프롬프트를 동기화 오디오가 포함된 3~10초 시네마틱 영상으로 변환합니다. Gemini의 실제 세계 지식을 활용해 동작과 물체 상호 작용을 일관되고 물리적으로 자연스럽게 표현합니다. 동영상 편집, 사운드 디자인, 여러 도구 연결을 따로 수행하는 대신 마케팅, 영상 제작, 게임 개발, 소셜 콘텐츠 팀이 하나의 프롬프트로 영상과 오디오를 함께 지시할 수 있습니다. RunComfy에서는 브라우저 또는 HTTP API로 이용할 수 있어 모델을 직접 호스팅하거나 확장할 필요가 없습니다.
추천 용도: 짧은 소셜 광고 | 시네마틱 스토리 장면 | 빠른 프리비즈

Google / Gemini Omni Flash#


Gemini Omni Flash는 Google의 멀티모달 동영상 생성 제품군으로, Gemini의 실제 지식과 물리학에 대한 강력한 이해를 바탕으로 더욱 사실적인 모션과 상호 작용을 구현합니다. 더 넓은 제품군은 텍스트-동영상, 이미지-동영상, 동영상 편집 및 동영상 참조의 네 가지 관련 작업에 걸쳐 있습니다. 이 RunComfy 페이지는 텍스트-동영상 작업을 실행하여 서면 프롬프트를 오디오가 동기화된 영화 같은 짧은 영상으로 전환합니다.


모델은 세계가 실제로 어떻게 작동하는지 추론하기 때문에 프레임별로 이동하는 대신 개체, 조명 및 움직임을 샷 전체에서 일관되게 유지합니다.


하이라이트#


  • 기본 동기화 오디오: 동작에 맞춰 음성, 음향 효과, 음악을 생성하므로 별도의 오디오 패스 없이 클립을 공유할 수 있습니다.
  • 물리 인식 모션: 향상된 물리적 이해를 통해 더욱 안정적이고 자연스러운 움직임과 개체 상호 작용이 가능합니다.
  • 실제 지식 기반: 출력은 Gemini의 실제 지식을 활용하여 장면이 그럴듯하고 주제에 맞게 느껴지도록 도와줍니다.
  • 프롬프트 수준 제어: 프롬프트에서 직접 속도와 사운드를 직접 전달합니다(예: 단일 연속 촬영, 차분한 배경 음악 또는 대화 없음).
  • 4가지 작업 제품군: Gemini Omni Flash 라인업에는 텍스트-동영상, 이미지-동영상, 동영상 편집 및 동영상 참조가 포함됩니다. 이 페이지에는 텍스트-동영상 작업만 표시됩니다.
  • 유연한 프레이밍: 3~10초 길이의 16:9 가로 및 9:16 세로를 지원합니다.

매개변수#


입력은 텍스트-동영상 작업에 대한 RunComfy OpenAPI Input 스키마와 일치합니다.


매개변수필수유형기본값범위 / 옵션설명
prompt*예 (*)string—설명 텍스트생성할 동영상의 텍스트 프롬프트
aspect_ratio아니요string16:916:9, 9:16동영상 화면 비율
duration아니요integer83~10(초)동영상 길이(정수 초)

가격#


청구는 생성된 클립의 길이를 기준으로 합니다.


  • 동영상: 생성된 동영상의 초당 $0.13입니다.

사용 방법#


  1. 설명 프롬프트 작성 — 피사체, 동작, 설정, 분위기, 조명 및 카메라를 설명합니다. 자세한 프롬프트를 통해 모델에 가장 많은 작업을 수행할 수 있습니다.
  2. 단어로 속도 설정 — 프롬프트에서 직접 단일 연속 샷이나 특정 리듬을 요청하세요.
  3. 오디오 지시 — 대화, 주변 소리 또는 배경 음악을 요청하거나 조용하게 하고 싶을 때 대화를 말하지 마세요.
  4. 부정적 지침 추가 — 프롬프트 자체에 텍스트 표시 안 함과 같은 제외 사항을 입력합니다.
  5. 가로세로 비율 선택 — 가로 방향의 경우 16:9, 세로 방향의 모바일 우선 전송의 경우 9:16을 선택하세요.
  6. 기간 설정 — 3~10초 사이의 정수를 선택합니다.
  7. 생성 및 개선 — 클립을 검토한 다음 문구, 비율 또는 영상 길이를 조정하고 다시 실행합니다.

프롬프트 및 참조 팁#


  • 원하는 카메라와 모션(예: 느린 푸시인, 핸드헬드 또는 잠금 해제)으로 리드하세요.
  • 장면이 의도한 대로 읽힐 수 있도록 분위기와 조명의 이름을 지정하세요.
  • 클립당 하나의 명확한 작업을 유지합니다. 짧은 시간 동안 보상에 초점을 맞춘 메시지를 제공합니다.
  • 모델이 동기화된 오디오를 생성할 수 있으므로 오디오가 중요한 경우 사운드스케이프를 자세히 설명하세요.
  • 모호한 힌트보다는 단순하고 부정적인 문구(예: 화면에 텍스트가 표시되지 않음)를 사용하세요.
  • 결과가 바쁜 것 같으면 메시지를 단순화하고 상충되는 스타일 단서를 제거하세요.

Gemini Omni Flash를 다른 모델과 비교하는 방법#


  • 이전 텍스트-동영상 모델과 비교: 물리적 인식 모션과 기본 동기화 오디오를 한 단계로 강조합니다. 공개적으로 이용 가능한 정보를 바탕으로 자신의 프롬프트에 따라 비교하십시오.
  • 무성 동영상 생성기와 비교: 오디오 생성을 번들로 제공하므로 별도의 채점 또는 사운드 디자인 단계를 건너뜁니다.
  • 자체 제품군 내에서: 텍스트-동영상은 이 제품군의 네 가지 작업 중 하나입니다. 텍스트만 사용하는 것이 아닌 기존 미디어에서 시작하는 이미지-동영상, 동영상 편집, 동영상 참조 대상 워크플로우.

더 많은 모델을 사용해 보세요#


  • Veo 3 Fast — 빠른 초안을 위한 오디오가 포함된 빠른 텍스트-동영상.
  • Seedance 2.5 — 참조 지원이 포함된 시네마틱 멀티모달 동영상.
  • Kling Video — 모션 중심의 동영상 생성.
  • Wan 2.5 — 범용 텍스트-동영상 대안.

공식 리소스#


  • Google DeepMind: https://deepmind.google/

관련 모델

kling-2-5/turbo/text-to-video

Kling 2.5 Turbo로 프롬프트에 따라 동영상을 생성하고 길이, 화면비, 네거티브 프롬프트를 설정합니다.

hunyuan/text-to-video

Tencent Hunyuan Video로 텍스트 프롬프트에서 고품질 영상을 생성합니다.

ltx-2/retake-video

기존 동영상의 지정 구간을 프롬프트에 따라 리테이크하고 오디오, 영상 또는 둘 다를 교체합니다.

seed-audio-1.0/text-to-audio

텍스트, 레퍼런스 오디오, 이미지에서 자연스러운 음성과 오디오를 생성합니다.

pikadditions

Pikadditions로 이미지 속 인물이나 사물을 기존 동영상에 추가합니다.

seedance-2.0-mini/text-to-video

네이티브 오디오와 레퍼런스를 지원하는 빠르고 경제적인 멀티쇼트 AI 영상 모델입니다.

자주 묻는 질문

Gemini Omni Flash는 어떤 용도로 사용되나요?

Gemini Omni Flash는 텍스트 프롬프트를 오디오가 동기화된 영화 같은 짧은 영상으로 바꾸는 Google의 멀티모달 동영상 모델입니다. 이 RunComfy 페이지에서는 텍스트-동영상 작업을 실행하여 모션과 사운드가 모두 중요한 소셜 광고, 스토리 비트 및 빠른 사전 시각화에 적합합니다.

Gemini Omni Flash 제품군은 어떤 작업을 다루나요?

Gemini Omni Flash 제품군은 텍스트-동영상, 이미지-동영상, 동영상 편집 및 동영상 참조의 네 가지 관련 작업을 포괄합니다. 이 RunComfy 페이지는 서면 메시지만으로 동영상을 생성하는 텍스트-동영상 작업을 표시하고 다른 작업은 기존 이미지나 영상에서 시작합니다.

Gemini Omni Flash는 동영상과 함께 오디오를 생성합니까?

예. Gemini Omni Flash는 생성된 동작에 맞춰 음성, 음향 효과, 음악과 같은 동기화된 오디오를 생성합니다. 예를 들어 조용한 배경 음악을 요청하거나 대화 없음을 지정하여 프롬프트에서 사운드를 조정할 수 있습니다.

Gemini Omni Flash의 모션이 더 자연스럽게 보이는 이유는 무엇입니까?

Gemini Omni Flash는 Gemini의 실제 지식을 기반으로 하며 물리학에 대한 향상된 이해를 바탕으로 샷 전체에서 모션, 조명 및 개체 상호 작용을 일관되게 유지하는 데 도움이 됩니다. 이는 기존 텍스트-동영상 모델에서 흔히 발생하는 프레임 간 드리프트를 줄입니다.

Gemini Omni Flash를 사용하기 전에 어떤 입력 제한을 확인해야 하나요?

텍스트-동영상 작업은 필수 프롬프트, 화면비 16:9 또는 9:16, 영상 길이 3~10초를 사용합니다. 생성하기 전에 현재 RunComfy 파라미터 화면에서 정확한 기본값과 공급자 측 제한을 확인하세요.

Gemini Omni Flash에 대한 프롬프트는 어떻게 작성해야 합니까?

피사체, 동작, 카메라, 분위기, 조명에 대해 설명하고 프롬프트에서 직접 속도를 제어하세요(예: 단일 연속 촬영). Gemini Omni Flash는 프롬프트에서 부정적인 지침을 읽기 때문에 프롬프트 자체에 "텍스트 표시 안 함"과 같은 제외 사항을 입력합니다.

개발자가 RunComfy API를 통해 Gemini Omni Flash를 사용할 수 있습니까?

예. RunComfy 모델 UI에서 Gemini Omni Flash의 프로토타입을 만든 다음 동일한 매개변수를 사용하여 RunComfy API를 통해 동일한 모델을 호출할 수 있습니다. 이를 통해 모델을 직접 호스팅하거나 확장하지 않고도 브라우저 테스트에서 자동화된 생성으로 이동할 수 있습니다.

RunComfy에서 Gemini Omni Flash로 생성하는 데 비용이 얼마나 드나요?

Gemini Omni Flash를 사용하는 생성 작업에는 생성된 동영상의 초당 0.13달러가 청구되며 RunComfy USD 또는 크레딧 잔액이 줄어듭니다. 신규 사용자는 일반적으로 무료 평가판 금액으로 시작합니다. 현재 세부정보는 이 페이지의 생성 영역을 참조하세요.

팔로우하기
  • 링크드인
  • 페이스북
  • Instagram
  • 트위터
지원
  • 디스코드
  • 이메일
  • 시스템 상태
  • 제휴사
비디오 모델
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 모든 모델 보기 →
이미지 모델
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 모든 모델 보기 →
법적 고지
  • 서비스 약관
  • 개인정보 보호정책
  • 쿠키 정책
RunComfy
저작권 2026 RunComfy. All Rights Reserved.

RunComfy는 최고의 ComfyUI 플랫폼으로서 ComfyUI 온라인 환경과 서비스를 제공하며 ComfyUI 워크플로우 멋진 비주얼을 제공합니다. RunComfy는 또한 제공합니다 AI Models, 예술가들이 최신 AI 도구를 활용하여 놀라운 예술을 창조할 수 있도록 지원합니다.

Gemini Omni Flash 예시

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...