電影感 4K 文字轉影片,輸出每秒 $0.42。
Gemini Omni Flash 是 Google 的多模態影片生成模型系列,結合 Gemini 對現實世界的理解和更強的物理規律推理,讓動作與物體互動更可信。該系列涵蓋文字生成影片、圖片生成影片、影片編輯和參考素材生成影片四類任務;本 RunComfy 頁面提供的是文字生成影片任務,可根據一條文字提示詞產生帶同步音訊的電影級短片。
模型能理解現實世界中的運動方式,因此更容易在同一鏡頭內維持物體、光線和動作連貫,減少逐格漂移。
輸入項目與文字生成影片任務的 RunComfy OpenAPI Input schema 保持一致。
| 參數 | 必填 | 類型 | 預設值 | 範圍 / 選項 | 說明 |
|---|---|---|---|---|---|
| prompt* | 是 (*) | string | — | 描述性文字 | 要產生影片的文字提示詞 |
| aspect_ratio | 否 | string | 16:9 | 16:9, 9:16 | 產生影片的寬高比 |
| duration | 否 | integer | 8 | 3–10(秒) | 產生影片的整數秒時長 |
依生成影片的時長計費:
電影感 4K 文字轉影片,輸出每秒 $0.42。
將驅動影片中的動作遷移到參考角色圖片,並可調整提示詞、解析度、推理步數、圖片引導與姿態引導。
將靜態影像變成動作自然、對白同步且創作可控的逼真影片場景。
根據風格標籤和歌詞生成最長 4 分鐘、帶人聲的歌曲。
以每秒 $0.084,將圖片製作成 3–15 秒影片。
根據必填文字提示詞產生影片。可選擇六種長寬比、`540p`/`720p`/`1080p`、`5` 秒/`9` 秒,以及是否循環播放。
Gemini Omni Flash 是 Google 的多模態影片模型,可將文字提示詞轉化為帶同步音訊的電影級短片。本 RunComfy 頁面提供文字生成影片任務,適合同時重視畫面動作和聲音的社群廣告、故事片段與快速影視預演。
該系列涵蓋文字生成影片、圖片生成影片、影片編輯和參考素材生成影片四類任務。本頁面提供的是僅根據文字提示詞產生影片的任務,其他任務則從既有圖片或影片素材開始。
會。模型可產生與畫面動作同步的語音、音效和音樂。你可以直接在提示詞中控制聲音,例如要求舒緩背景音樂或指定「無對白」。
Gemini Omni Flash 結合了 Gemini 對現實世界的理解與更強的物理規律推理,有助於在同一鏡頭中維持動作、光線和物體互動連貫,減少早期文字生成影片模型常見的逐格漂移。
文字生成影片任務必須提供 prompt,寬高比可選16:9或9:16,時長範圍為3–10秒。生成前請查看 RunComfy 目前參數面板,確認預設值和服務商端的最新限制。
請清楚描述主體、動作、鏡頭、氛圍和光線,並在提示詞中直接控制節奏,例如要求單一連續鏡頭。不希望出現的內容也應明確寫出,例如「不顯示文字」。
可以。你可以先在 RunComfy 模型介面中測試,再透過 RunComfy API 使用相同參數呼叫模型,從瀏覽器原型快速轉向自動化生成,無須自行託管或擴縮模型。
Gemini Omni Flash 依生成影片時長收費,價格為 $0.13/秒,並從 RunComfy 帳戶餘額中扣除。新使用者通常會獲得試用額度;最新資訊請以本頁面生成區域為準。
RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。





