以必填的起始圖片和結束圖片生成轉場影片,並可控制提示詞、長寬比、解析度、片長、風格、音訊和提示詞最佳化。
本頁介紹 MiniMax H3 系列中的開放權重影像到視訊路徑。上傳第一幀,描述動作和配樂,並可選擇添加最後一幀以鎖定結局;該模型返回具有 480p 或 768p 的原生立體聲音頻的 MP4。
輸出畫布遵循輸入影像的寬高比,因此從清晰、光線充足的靜態影像開始。在 5 秒內迭代 MiniMax H3 Open Image to Video,然後在身份和相機感覺合適後進行擴展。有關不同解析度等級的官方 MiniMax H3 影像轉視訊端點,請參閱 RunComfy 上的相關 MiniMax H3 型號。
MiniMax H3 Open Image to Video 按產生影片的每秒計費。
| 解析度 | 單價 |
|---|---|
| 480p | $0.039/s |
| 768p | $0.079/s |
5 秒 480p 剪輯約為 $0.195;5 秒 768p 剪輯約為 $0.395。費用隨時長與解析度增加。
以必填的起始圖片和結束圖片生成轉場影片,並可控制提示詞、長寬比、解析度、片長、風格、音訊和提示詞最佳化。
移除影片背景,並依後製流程調整輸出編碼與溢色抑制強度。
使用兩段音訊與一張圖片生成影片,並設定兩位人物的發言順序。
專業級電影感文字轉影片,輸出每秒 $0.112。
根據參考素材生成 3–15 秒影片,起價為每秒 $0.084。
透過文字指令編輯現有影片,可加入最多 10 張參考圖片,並選擇是否保留原音。
MiniMax H3 Open Image to Video 將第一幀靜止影像動畫化為具有原生立體聲音訊的短片,可選擇由最後一幀影像引導。它適合產品展示、角色時刻和仍在剪輯的廣告,此時身份應保持鎖定到上傳。
MiniMax H3 Open Image to Video 是具有 480p 和 768p 輸出的開放權重路徑。 RunComfy 上的官方 MiniMax H3 影像到視訊模型使用不同的解析度階梯(例如 768p 和 2K)。選擇 MiniMax H3 Open Image to Video 作為此頁面上的開放權重路線和定價層。
MiniMax H3 Open Image to Video 需要第一個影像和描述動作、相機和聲音的提示。可選的last_image可以鎖定結束姿勢。解析度為480p或768p;持續時間為 5-15 秒。輸出幀遵循輸入影像的長寬比。
MiniMax H3 Open Image to Video 將外觀錨定到第一幀影像。在提示中寫下動作動詞和鏡頭移動,並說明哪些內容不能改變(臉部、服裝、背景)。清晰、光線充足的上傳內容比柔和或大量裁剪的靜態圖片提供更穩定的身份。
是的。 MiniMax H3 Open Image to Video 產生帶有圖片的原生立體聲音訊。新增音訊:具有氛圍、對話或效果入口提示的線路;否則,模型會提供適合場景的配樂。
是的。在 RunComfy 模型 UI 中進行原型設計,然後透過 RunComfy API 使用相同的參數呼叫相同的 MiniMax H3 Open Image to Video 模板。幾代人在兩條路徑上消耗美元/積分。
MiniMax H3 Open Image to Video 按產生影片的每秒計費:480p 每秒 0.039 美元,768p 每秒 0.079 美元。 5 秒 480p 剪輯的成本約為 0.195 美元;成本與持續時間和解析度成正比。
當您需要受控的結局(例如微笑、產品保持或姿勢變化)同時保持第一個畫面的開頭外觀時,請在 MiniMax H3 Open Image to Video 上新增last_image。當您只想從單一靜止影像中進行自由運動時,請將其留空。
RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。





