使用提示詞編輯參考影片,可加入元素與圖片參考,並可選擇保留原始音軌。
本頁介紹 MiniMax H3 系列中的開放權重影像到視訊路徑。上傳第一幀,描述動作和配樂,並可選擇添加最後一幀以鎖定結局;該模型返回具有 480p 或 768p 的原生立體聲音頻的 MP4。
輸出畫布遵循輸入影像的寬高比,因此從清晰、光線充足的靜態影像開始。在 5 秒內迭代 MiniMax H3 Open Image to Video,然後在身份和相機感覺合適後進行擴展。有關不同解析度等級的官方 MiniMax H3 影像轉視訊端點,請參閱 RunComfy 上的相關 MiniMax H3 型號。
使用提示詞編輯參考影片,可加入元素與圖片參考,並可選擇保留原始音軌。
依文字生成語音並與影片同步,可選擇音色、語言與語速。
支援33種表情與400+動作,輕鬆創作具質感的人像短片
依提示詞讓起始圖像動起來,並設定 LoRA、影格數、FPS、解析度、長寬比、推論步數與隨機種子。
透過場景一致的運動將現有剪輯延長到最終畫面之外
根據文字生成 3–15 秒電影感影片,並可選擇同步音訊。
MiniMax H3 Open Image to Video 將第一幀靜止影像動畫化為具有原生立體聲音訊的短片,可選擇由最後一幀影像引導。它適合產品展示、角色時刻和仍在剪輯的廣告,此時身份應保持鎖定到上傳。
MiniMax H3 Open Image to Video 是具有 480p 和 768p 輸出的開放權重路徑。 RunComfy 上的官方 MiniMax H3 影像到視訊模型使用不同的解析度階梯(例如 768p 和 2K)。選擇 MiniMax H3 Open Image to Video 作為此頁面上的開放權重路線和定價層。
MiniMax H3 Open Image to Video 需要第一個影像和描述動作、相機和聲音的提示。可選的last_image可以鎖定結束姿勢。解析度為480p或768p;持續時間為 5-15 秒。輸出幀遵循輸入影像的長寬比。
MiniMax H3 Open Image to Video 將外觀錨定到第一幀影像。在提示中寫下動作動詞和鏡頭移動,並說明哪些內容不能改變(臉部、服裝、背景)。清晰、光線充足的上傳內容比柔和或大量裁剪的靜態圖片提供更穩定的身份。
是的。 MiniMax H3 Open Image to Video 產生帶有圖片的原生立體聲音訊。新增音訊:具有氛圍、對話或效果入口提示的線路;否則,模型會提供適合場景的配樂。
是的。在 RunComfy 模型 UI 中進行原型設計,然後透過 RunComfy API 使用相同的參數呼叫相同的 MiniMax H3 Open Image to Video 模板。幾代人在兩條路徑上消耗美元/積分。
MiniMax H3 Open Image to Video 按產生影片的每秒計費:480p 每秒 0.05 美元,768p 每秒 0.09 美元。 5 秒 480p 剪輯的成本約為 0.25 美元;成本與持續時間和解析度成正比。
當您需要受控的結局(例如微笑、產品保持或姿勢變化)同時保持第一個畫面的開頭外觀時,請在 MiniMax H3 Open Image to Video 上新增last_image。當您只想從單一靜止影像中進行自由運動時,請將其留空。
RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。





