logo
RunComfy
  • ComfyUI
  • 訓練器新
  • 模型
  • API
  • 定價
discord logo
模型
探索
所有模型
資源庫
生成記錄
模型 API
API 文檔
API 金鑰
帳戶
使用情況

Gemini Omni Flash Image to Video:將靜態影像生成含同步音訊的影片 | RunComfy

google/gemini-omni-flash/image-to-video

Gemini Omni Flash Image to Video 可將上傳的影像生成含原生同步音訊的短片,並透過提示詞控制 3–10 秒影片中的動態;支援 16:9 和 9:16。

描述希望輸入影像如何移動或變化。可在提示詞中指定鏡頭運動、節奏和音訊(如「緩慢推進」「輕風與鳥鳴」「無對白」),也可加入「不要顯示文字」等負面要求。
要製作成動畫的輸入影像。支援 jpg、jpeg、png 和 webp 格式。
生成影片的長寬比。
生成影片的時長,以秒為單位。
Idle
The rate is $0.14 per second of generated video.

Gemini Omni Flash Image to Video 簡介

Google 的 Gemini Omni Flash Image to Video 可讓一張靜態影像動起來,將單幀畫面延伸為 3–10 秒、動作與音訊同步的短片。模型運用 Gemini 對現實世界的理解,讓動態更符合場景邏輯。它把動畫、關鍵影格和聲音設計整合到一次提示詞驅動的生成中,適合行銷人員、影視創作者、遊戲團隊和社群內容創作者。開發者既可在 RunComfy 瀏覽器頁面中使用,也可透過 HTTP API 呼叫,無需自行託管或擴展模型。
適合:靜態圖轉社群短片 | 視聽概念測試 | 參考圖驅動的電影感鏡頭

Google / Gemini Omni Flash Image to Video#


輸入一張圖片和文字指令,模型即可將靜態畫面生成含聲音的電影感短片。它屬於 Google Gemini Omni Flash 系列;該系列還支援文字轉影片、影片編輯和參考圖轉影片,本頁面對應圖像轉影片任務。


模型會結合對現實世界和物理規律的理解來推斷動態,因此從第一幀開始,主體與場景的變化更連貫,不易在播放過程中出現漂移或變形。


核心亮點#


  • 單圖動畫: 從一張靜態圖出發,為主體和場景生成自然、符合物理邏輯的動態。
  • 原生同步音訊: 同步生成對白、環境音和音樂,無需再另外製作音軌。
  • 提示詞控制動態: 直接描述鏡頭運動、節奏和氛圍,決定畫面如何動起來。
  • 現實知識支撐: 運用 Gemini 對現實世界的理解,讓生成內容更可信、更貼合主題。
  • 彈性畫幅: 支援 16:9 橫向和 9:16 直向,時長可按整秒設定為 3–10 秒。
  • 多任務系列: Gemini Omni Flash 涵蓋多種影片任務;本頁面專注於將影像轉化為動態影片。

參數#


輸入參數與 RunComfy OpenAPI 中圖像轉影片任務的 Input 架構一致。


參數必填類型預設值範圍 / 選項說明
prompt*是 (*)string—描述性文字描述輸入影像應如何移動或變化
image_url*是 (*)string(影像 URI)—jpg, jpeg, png, webp要製作動畫的靜態影像
aspect_ratio否string16:916:9, 9:16生成影片的長寬比
duration否integer83–10(秒)生成影片的時長,以整秒設定

價格#


依生成影片的時長計費:


  • 影片: 每生成 1 秒收費 $0.14。

相關模型

sync/lipsync/v2

根據必填影片 URL 和音訊 URL 建立口型同步影片。可選擇 `lipsync-2` 或 `lipsync-2-pro`;相同時長下,Pro 費用約為基礎版的 1.67 倍。另有五種時長不一致處理模式。

wan-3.0-prime/text-to-video

Wan 3.0 Prime Text To Video 讓提示剪輯變得快速

dreamina-3-0/pro/text-to-video

以Dreamina 3.0將文字轉化為動態影像,精準呈現電影級創意場景。

omnihuman/v1.5

根據一張必填人物圖片和一段 35 秒以內的必填音訊生成影片。可使用六種支援語言填寫選填生成指引,並設定預設值為 -1 的隨機種子。

pikascenes

使用 1–6 張圖像組合場景,並透過 Pikascenes 將其製作成動態影片。

pixverse/v5.5/text-to-video

根據必填文字提示詞生成影片,並精確控制長寬比、解析度、片長、風格、隨機種子、音訊、多片段和提示詞最佳化。

常見問題

Gemini Omni Flash Image to Video 是做什麼的?

Gemini Omni Flash Image to Video 接收一張靜態影像和一段文字提示詞,將畫面生成含同步音訊的短片。模型會推斷主體與場景的自然動態,因此無需分別製作動畫和音軌,就能把單幀畫面變成有動作、有聲音的鏡頭。

Gemini Omni Flash Image to Video 的最佳用例是什麼?

它適合把靜態照片製作成社群媒體短片、根據參考圖測試鏡頭運動與節奏,以及快速驗證視聽概念。創作者、行銷人員、影視和遊戲團隊常用 Gemini Omni Flash Image to Video 先探索動作與氛圍,再投入完整製作。

Gemini Omni Flash Image to Video 如何處理音訊?

模型會生成與畫面同步的對白、環境音效和音樂。你可以在 Gemini Omni Flash Image to Video 的提示詞中說明對白語氣或所需背景聲;如果需要安靜的短片,也可以明確要求「無對白」。

Gemini Omni Flash Image to Video 與文字到影片生成有何不同?

以上傳影像作為起點,相較於只使用文字提示詞,更容易固定開場構圖和主體形象。在 Gemini Omni Flash Image to Video 中,靜態圖決定畫面外觀,提示詞控制場景如何運動,因此特別適合已經有明確起始畫面的情況。

Gemini Omni Flash Image to Video 支援哪些寬高比和持續時間?

Gemini Omni Flash Image to Video 支援 16:9 橫向和 9:16 直向,影片時長可按整秒設定為 3–10 秒。可用設定可能會調整,請以目前 RunComfy 參數面板為準。

在使用 Gemini Omni Flash Image to Video 之前我應該了解哪些輸入限制?

你需要提供一張輸入影像,以及描述運動方式的文字提示詞。支援的影像格式包括 jpg、jpeg、png 和 webp。部分限制可能會隨服務供應商的設定變化,未在此處列出的要求請以 RunComfy 參數面板為準。

開發人員可以透過 RunComfy API 使用 Gemini Omni Flash Image to Video 嗎?

可以。你可以先在 RunComfy 模型頁面中測試 Gemini Omni Flash Image to Video,再使用相同參數透過 RunComfy HTTP API 呼叫模型,用於自動化和正式環境。這樣無需自行託管或擴展模型,即可從測試順利過渡到整合。

在 RunComfy 上使用 Gemini Omni Flash Image to Video 產生需要多少錢?

Gemini Omni Flash Image to Video 依生成影片的時長計費,每秒 $0.14,費用從 RunComfy 帳戶的美元餘額或點數中扣除。新用戶通常可獲得試用額度,目前價格請查看本頁面的生成區域。

關注我們
  • 領英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 電子郵件
  • 系統狀態
  • 附屬
視頻模型
  • Wan 3.0 Prime Reference To Video
  • Wan 3.0 Prime
  • Wan 3.0 Prime Text To Video
  • Wan 2.6 Flash
  • MiniMax H3 Open Image to Video
  • MiniMax H3 Open
  • 查看所有模型 →
影像模型
  • Seedream 5.0 Pro Image Edit
  • Qwen Image 3.0 Pro Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2 Image Edit
  • 查看所有模型 →
法律
  • 服務條款
  • 隱私政策
  • Cookie 政策
RunComfy
版權 2026 RunComfy. 保留所有權利。

RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。

Gemini Omni Flash Image to Video 範例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...