MiniMax H3 ComfyUI 圖片轉影片 4步驟渦輪#
MiniMax H3 ComfyUI 圖片轉影片 4步驟渦輪是一種RunComfy準備好的工作流程,直接在ComfyUI中將單張靜態圖像轉換為帶有原生立體音效的短影片。它運行MiniMax H3 (Hailuo) 圖片到影片管道並應用渦輪LoRA,讓您能夠在比默認計劃少得多的取樣步驟中預覽運動和對話。
此圖表是為希望在不離開ComfyUI畫布的情況下快速獲得I2V草稿的創作者而構建的:講話的角色、快速的產品旋轉或與同步聲音的環境場景。提供一個開始幀和運動/對話提示;工作流程生成影片幀和立體音效,然後將它們合併為可下載的完成影片。
Comfyui MiniMax H3 ComfyUI 圖片轉影片 4步驟渦輪工作流程中的關鍵模型#
- MiniMaxAI/MiniMax-H3多模態影片模型。官方H3模型生成帶有同步立體音效的影片,並支持第一幀I2V;此工作流程使用Comfy-Org重新包裝以適用於ComfyUI。 MiniMaxAI/MiniMax-H3 和 Comfy-Org/MiniMax-H3
- MiniMax H3 影片VAE。編碼/解碼H3擴散骨幹使用的影片潛變量。包含在Comfy-Org重新包裝中。 Comfy-Org/MiniMax-H3
- MiniMax H3 音效VAE。將模型的音效潛變量解碼為與幀對齊的原生立體波形。包含在Comfy-Org重新包裝中。 Comfy-Org/MiniMax-H3
- Qwen3‑VL 32B 文本編碼器 (MiniMax H3 變體)。將您的運動和對話提示解析為H3的調節。隨Comfy-Org發佈包裝在text_encoders下。 Comfy-Org/MiniMax-H3
- MiniMax‑H3 渦輪LoRA (4步驟)。一個加速H3取樣的LoRA,使得在非常低的步驟計數下能夠實現清晰的預覽。 larryvrh/MiniMax-H3-Turbo-Lora 和LoRA概念論文 LoRA: Low‑Rank Adaptation
如何使用Comfyui MiniMax H3 ComfyUI 圖片轉影片 4步驟渦輪工作流程#
整體流程。圖表將您上傳的圖像縮放,將您的時長轉換為有效的H3幀計數,然後將開始幀和提示輸入H3並應用渦輪LoRA。取樣器生成聯合影片和音效潛變量,這些潛變量被解碼後合併為可下載的影片。
上傳圖像。使用LoadImage (#114) 提供您想要動畫化的第一幀。圖像由LayerUtility: ImageScaleByAspectRatio V2 (#167) 自動縮放到目標長邊,同時保留縱橫比;派生的width/height輸入核心H3節點。當需要避免變形時使用信箱格式。這樣可以在匹配H3偏好的網格時保持您的構圖完整。
參數和提示。使用Duration控制(標籤"Duration (sec)")設置影片長度,這會輸入一個小數學節點,ComfyMathExpression (#134),該節點將秒數轉換為影片速率的幀數,並對齊到H3的有效網格。在綠色easy positive提示節點(#152)中輸入您的運動和對話;您可以撰寫自然句子和引用的對話。提示由Qwen3‑VL文本編碼器通過CLIPLoader (#130) 編碼,為模型準備調節。
核心生成。UNETLoader (#129) 加載MiniMax H3擴散骨幹和VAELoader (#121, #122) 加載影片和音效VAE。渦輪LoRA在運行時由LoraLoaderModelOnly (#171)合併,一個內存高效的注意力補丁 (MiniMaxH3MemoryEfficientSageAttentionPatch (#170))有助於減少VRAM。主要節點,MiniMaxH3ImageToVideo (#133),接收您的開始幀、提示和計算出的寬度/高度/長度,然後產生同步的影片和音效潛變量。
取樣和解碼。一個緊湊的取樣器堆疊 (KSamplerSelect (#125), BasicScheduler (#126), BasicGuider (#128), SamplerCustomAdvanced (#127), RandomNoise (#131)) 在渦輪LoRA的幫助下進行非常少次迭代的去噪。VAEDecode (#124) 將影片潛變量轉換為幀,VAEDecodeAudio (#123) 生成與這些幀對齊的立體音效。您不需要調整解碼設置;它們已配置為乾淨的預覽。
輸出。CreateVideo (#132) 將幀和音效合併到單個影片中,並以工作幀速率寫入SaveVideo (#92),以便您可以立即從RunComfy下載。結果是一個短的,同步的影片,反映您的開始幀、運動提示和對話。
Comfyui MiniMax H3 ComfyUI 圖片轉影片 4步驟渦輪工作流程中的關鍵節點#
MiniMaxH3ImageToVideo (#133)。圖表的核心:它消耗開始幀、編碼的提示和您的目標大小/長度,並生成聯合影片和音效潛變量。僅調整此工作流程中暴露給您的少數輸入:提供強而有描述性的提示(包括引用的對話)並設置現實的持續時間;節點使用Comfy-Org重新包裝的H3模型和VAE處理其餘部分。 Comfy-Org/MiniMax-H3
LoraLoaderModelOnly (#171)。注入MiniMax‑H3渦輪LoRA,以便取樣器可以在非常少的步驟中達到高銳度。如果您需要在速度和效果之間進行權衡,可以稍微降低LoRA強度;如果您看到運動模糊,可以稍微提高。LoRA被設計為可以在常見H3基礎變體中運行,包括修剪和量化的重新包裝。 larryvrh/MiniMax-H3-Turbo-Lora
BasicScheduler (#126) 和 SamplerCustomAdvanced (#127)。它們共同控制去噪計劃和步進行為。由於渦輪LoRA的存在,您可以在非常低的步驟計數下運行以快速預覽;如果您能夠承受時間,增加步驟會適度提高穩定性。除非您有特定的外觀要求,否則保持計劃器和取樣器選擇常規。
LayerUtility: ImageScaleByAspectRatio V2 (#167)。確保上傳的靜態圖像在保留縱橫比的情況下調整為乾淨的、對模型友好的分辨率。當切換源圖像時使用此功能以避免意外的裁剪或變形;該節點輸出核心H3節點消耗的確切width/height。 ComfyUI_LayerStyle
ComfyMathExpression (#134)。將秒數轉換為幀數並將計數對齊到H3的有效幀網格,以便音效保持相位鎖定到影片。您可以將其視為一個“安全保護”,避免H3不支持的幀計數,在合併階段防止微妙的不同步。輸入是您在畫布頂部設置的普通英語持續時間。
MiniMaxH3MemoryEfficientSageAttentionPatch (#170)。應用一個實驗性的注意力優化,降低H3取樣期間的峰值VRAM。當在較大尺寸或內存有限的GPU上工作時開啟它;它在提高適應性的同時保留創意意圖。 ComfyUI‑KJNodes
可選擴展#
- 嘴型同步提示:用引號寫下實際台詞(例如,“Dinner’s up — try this carbonara.”)並用簡單語言描述氛圍和鏡頭運動。
- 構圖優先:選擇一個已經將您的主題框在預期距離的開始幀;動畫將尊重該構圖。
- 速度與精緻:MiniMax H3 ComfyUI 圖片轉影片 4步驟渦輪設置調整為快速預覽;如果一個鏡頭很重要,添加幾個步驟或稍微減少LoRA強度以控制過於銳利的顆粒。
- 運行時空間:如果您達到VRAM限制,嘗試較小的最大圖像邊長,縮短持續時間,或啟用內存高效的注意力補丁。
- 探索基礎:工作流程與Comfy‑Org H3重新包裝變體(bf16,int8 convrot,修剪)兼容。如果您更改基礎,請保持渦輪LoRA連接在模型加載器和取樣器之間以保持相同的加速效果。 Comfy-Org/MiniMax-H3
致謝#
此工作流程實現並基於以下作品和資源。 我們誠摯感謝MiniMax提供MiniMax H3模型,Comfy.org提供MiniMax H3 ComfyUI工作流程教程,Comfy-Org提供MiniMax-H3模型權重,以及larryvrh提供MiniMax-H3 Turbo LoRA的貢獻和維護。 有關權威的詳細信息,請參閱下面鏈接的原始文檔和存儲庫。
資源#
- MiniMax/MiniMax H3 官方公告
- 文檔 / 發佈說明:MiniMax H3 官方公告
- Comfy.org/MiniMax H3 教程
- GitHub: Comfy-Org/docs
- 文檔 / 發佈說明:MiniMax H3 教程
- Comfy-Org/MiniMax-H3 模型權重
- Hugging Face: Comfy-Org/MiniMax-H3
- larryvrh/MiniMax-H3 Turbo LoRA
- GitHub: Larryvrh/ComfyUI-MiniMax-H3-Turbo
- Hugging Face: larryvrh/MiniMax-H3-Turbo-Lora
注意:使用參考的模型、數據集和代碼需遵循其作者和維護者提供的各自許可和條款。

