logo
RunComfy
  • ComfyUI
  • 訓練器新
  • 模型
  • API
  • 定價
discord logo
模型
探索
所有模型
資源庫
生成記錄
模型 API
API 文檔
API 金鑰
帳戶
使用情況

Gemini Omni Flash Image to Video:將靜態影像生成含同步音訊的影片 | RunComfy

google/gemini-omni-flash/image-to-video

Gemini Omni Flash Image to Video 可將上傳的影像生成含原生同步音訊的短片,並透過提示詞控制 3–10 秒影片中的動態;支援 16:9 和 9:16。

描述希望輸入影像如何移動或變化。可在提示詞中指定鏡頭運動、節奏和音訊(如「緩慢推進」「輕風與鳥鳴」「無對白」),也可加入「不要顯示文字」等負面要求。
要製作成動畫的輸入影像。支援 jpg、jpeg、png 和 webp 格式。
生成影片的長寬比。
生成影片的時長,以秒為單位。
Idle
The rate is $0.14 per second of generated video.

Gemini Omni Flash Image to Video 簡介

Google 的 Gemini Omni Flash Image to Video 可讓一張靜態影像動起來,將單幀畫面延伸為 3–10 秒、動作與音訊同步的短片。模型運用 Gemini 對現實世界的理解,讓動態更符合場景邏輯。它把動畫、關鍵影格和聲音設計整合到一次提示詞驅動的生成中,適合行銷人員、影視創作者、遊戲團隊和社群內容創作者。開發者既可在 RunComfy 瀏覽器頁面中使用,也可透過 HTTP API 呼叫,無需自行託管或擴展模型。
適合:靜態圖轉社群短片 | 視聽概念測試 | 參考圖驅動的電影感鏡頭

Google / Gemini Omni Flash Image to Video#


輸入一張圖片和文字指令,模型即可將靜態畫面生成含聲音的電影感短片。它屬於 Google Gemini Omni Flash 系列;該系列還支援文字轉影片、影片編輯和參考圖轉影片,本頁面對應圖像轉影片任務。


模型會結合對現實世界和物理規律的理解來推斷動態,因此從第一幀開始,主體與場景的變化更連貫,不易在播放過程中出現漂移或變形。


核心亮點#


  • 單圖動畫: 從一張靜態圖出發,為主體和場景生成自然、符合物理邏輯的動態。
  • 原生同步音訊: 同步生成對白、環境音和音樂,無需再另外製作音軌。
  • 提示詞控制動態: 直接描述鏡頭運動、節奏和氛圍,決定畫面如何動起來。
  • 現實知識支撐: 運用 Gemini 對現實世界的理解,讓生成內容更可信、更貼合主題。
  • 彈性畫幅: 支援 16:9 橫向和 9:16 直向,時長可按整秒設定為 3–10 秒。
  • 多任務系列: Gemini Omni Flash 涵蓋多種影片任務;本頁面專注於將影像轉化為動態影片。

參數#


輸入參數與 RunComfy OpenAPI 中圖像轉影片任務的 Input 架構一致。


參數必填類型預設值範圍 / 選項說明
prompt*是 (*)string—描述性文字描述輸入影像應如何移動或變化
image_url*是 (*)string(影像 URI)—jpg, jpeg, png, webp要製作動畫的靜態影像
aspect_ratio否string16:916:9, 9:16生成影片的長寬比
duration否integer83–10(秒)生成影片的時長,以整秒設定

價格#


依生成影片的時長計費:


  • 影片: 每生成 1 秒收費 $0.14。

相關模型

veo-3/fast/text-to-video

從文字提示快速生成具對話和音效的動態短片

veo-3-1/fast/extend-video

依照提示詞將現有影片延長 7 秒,以 720p 輸出,並可選擇是否產生音訊。

sync/lipsync/v2/pro

根據必填影片 URL 和音訊 URL 建立口型同步影片,並可從五種模式中選擇音影片時長不一致的處理方式。

minimax-h3/image-to-video

將第一幀圖像動畫化為 768p 或 2K 視頻,最長 15 秒

flux-3/extend-video/draft

FLUX 3 Draft Extend: 720p 的快速低成本剪輯延續草稿

ltx-2/retake-video

根據提示詞重做現有影片中的指定片段,並可選擇替換音訊、畫面或同時替換兩者。

常見問題

Gemini Omni Flash Image to Video 是做什麼的?

Gemini Omni Flash Image to Video 接收一張靜態影像和一段文字提示詞,將畫面生成含同步音訊的短片。模型會推斷主體與場景的自然動態,因此無需分別製作動畫和音軌,就能把單幀畫面變成有動作、有聲音的鏡頭。

Gemini Omni Flash Image to Video 的最佳用例是什麼?

它適合把靜態照片製作成社群媒體短片、根據參考圖測試鏡頭運動與節奏,以及快速驗證視聽概念。創作者、行銷人員、影視和遊戲團隊常用 Gemini Omni Flash Image to Video 先探索動作與氛圍,再投入完整製作。

Gemini Omni Flash Image to Video 如何處理音訊?

模型會生成與畫面同步的對白、環境音效和音樂。你可以在 Gemini Omni Flash Image to Video 的提示詞中說明對白語氣或所需背景聲;如果需要安靜的短片,也可以明確要求「無對白」。

Gemini Omni Flash Image to Video 與文字到影片生成有何不同?

以上傳影像作為起點,相較於只使用文字提示詞,更容易固定開場構圖和主體形象。在 Gemini Omni Flash Image to Video 中,靜態圖決定畫面外觀,提示詞控制場景如何運動,因此特別適合已經有明確起始畫面的情況。

Gemini Omni Flash Image to Video 支援哪些寬高比和持續時間?

Gemini Omni Flash Image to Video 支援 16:9 橫向和 9:16 直向,影片時長可按整秒設定為 3–10 秒。可用設定可能會調整,請以目前 RunComfy 參數面板為準。

在使用 Gemini Omni Flash Image to Video 之前我應該了解哪些輸入限制?

你需要提供一張輸入影像,以及描述運動方式的文字提示詞。支援的影像格式包括 jpg、jpeg、png 和 webp。部分限制可能會隨服務供應商的設定變化,未在此處列出的要求請以 RunComfy 參數面板為準。

開發人員可以透過 RunComfy API 使用 Gemini Omni Flash Image to Video 嗎?

可以。你可以先在 RunComfy 模型頁面中測試 Gemini Omni Flash Image to Video,再使用相同參數透過 RunComfy HTTP API 呼叫模型,用於自動化和正式環境。這樣無需自行託管或擴展模型,即可從測試順利過渡到整合。

在 RunComfy 上使用 Gemini Omni Flash Image to Video 產生需要多少錢?

Gemini Omni Flash Image to Video 依生成影片的時長計費,每秒 $0.14,費用從 RunComfy 帳戶的美元餘額或點數中扣除。新用戶通常可獲得試用額度,目前價格請查看本頁面的生成區域。

關注我們
  • 領英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 電子郵件
  • 系統狀態
  • 附屬
視頻模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
影像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服務條款
  • 隱私政策
  • Cookie 政策
RunComfy
版權 2026 RunComfy. 保留所有權利。

RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。

Gemini Omni Flash Image to Video 範例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...