以 Wan 2.5 將靜態圖片快速轉為流暢動態影片,讓創作更具臨場感。
Gemini Omni Flash 是 Google 的多模態影片生成模型系列,結合 Gemini 對現實世界的理解和更強的物理規律推理,讓動作與物體互動更可信。該系列涵蓋文字生成影片、圖片生成影片、影片編輯和參考素材生成影片四類任務;本 RunComfy 頁面提供的是文字生成影片任務,可根據一條文字提示詞產生帶同步音訊的電影級短片。
模型能理解現實世界中的運動方式,因此更容易在同一鏡頭內維持物體、光線和動作連貫,減少逐格漂移。
輸入項目與文字生成影片任務的 RunComfy OpenAPI Input schema 保持一致。
| 參數 | 必填 | 類型 | 預設值 | 範圍 / 選項 | 說明 |
|---|---|---|---|---|---|
| prompt* | 是 (*) | string | — | 描述性文字 | 要產生影片的文字提示詞 |
| aspect_ratio | 否 | string | 16:9 | 16:9, 9:16 | 產生影片的寬高比 |
| duration | 否 | integer | 8 | 3–10(秒) | 產生影片的整數秒時長 |
依生成影片的時長計費:
以 Wan 2.5 將靜態圖片快速轉為流暢動態影片,讓創作更具臨場感。
透過多組參考素材和影格控制生成 1080p 影片。
將來源影片放大至所選目標解析度與影格率。
將靜態圖片轉化為細膩動態影片,享受真實音畫同步的創作體驗。
依提示詞生成圖像,並設定 LoRA、圖像尺寸、格式、推論步數、負面提示詞與隨機種子。
透過多模態參考、口型同步與鏡頭控制,更快生成具有電影感的短片。
Gemini Omni Flash 是 Google 的多模態影片模型,可將文字提示詞轉化為帶同步音訊的電影級短片。本 RunComfy 頁面提供文字生成影片任務,適合同時重視畫面動作和聲音的社群廣告、故事片段與快速影視預演。
該系列涵蓋文字生成影片、圖片生成影片、影片編輯和參考素材生成影片四類任務。本頁面提供的是僅根據文字提示詞產生影片的任務,其他任務則從既有圖片或影片素材開始。
會。模型可產生與畫面動作同步的語音、音效和音樂。你可以直接在提示詞中控制聲音,例如要求舒緩背景音樂或指定「無對白」。
Gemini Omni Flash 結合了 Gemini 對現實世界的理解與更強的物理規律推理,有助於在同一鏡頭中維持動作、光線和物體互動連貫,減少早期文字生成影片模型常見的逐格漂移。
文字生成影片任務必須提供 prompt,寬高比可選16:9或9:16,時長範圍為3–10秒。生成前請查看 RunComfy 目前參數面板,確認預設值和服務商端的最新限制。
請清楚描述主體、動作、鏡頭、氛圍和光線,並在提示詞中直接控制節奏,例如要求單一連續鏡頭。不希望出現的內容也應明確寫出,例如「不顯示文字」。
可以。你可以先在 RunComfy 模型介面中測試,再透過 RunComfy API 使用相同參數呼叫模型,從瀏覽器原型快速轉向自動化生成,無須自行託管或擴縮模型。
Gemini Omni Flash 依生成影片時長收費,價格為 $0.13/秒,並從 RunComfy 帳戶餘額中扣除。新使用者通常會獲得試用額度;最新資訊請以本頁面生成區域為準。
RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。





