ComfyUI>工作流程>Minimax H3 I2V 雙時鐘 8 步驟| 超高速高品質影片

Minimax H3 I2V 雙時鐘 8 步驟| 超高速高品質影片

Workflow Name: RunComfy/Minimax-H3-I2V-Dual-Clock
Workflow ID: 0000...1496
將一張圖片轉換為短音視頻場景。您可以使用簡單的提示來引導運動和聲音。雙時鐘保持影像和立體聲音頻同步。8 步驟 Turbo 設置縮短渲染時間。動畫化角色、產品、交通工具或風景。以更少的設置獲得電影級運動。

ComfyUI Minimax H3 I2V Dual Clock 8-Step High-Quality Ultra-Fast Workflow

Minimax H3 I2V ComfyUI | 8-Step Dual Clock Audio Video
Want to run this workflow?
  • Fully operational workflows
  • No missing nodes or models
  • No manual setups required
  • Features stunning visuals

ComfyUI Minimax H3 I2V Dual Clock 8-Step High-Quality Ultra-Fast Examples

Minimax H3 I2V 雙時鐘 8 步驟高品質超高速#

這個適用於 RunComfy 的 ComfyUI 工作流程將單一參考圖像和結合運動與音頻提示轉換為短的同步影片,具有原生立體聲。基於 MiniMax H3 Ref2VA 條件和 8 步驟雙時鐘採樣器構建,提供快速的圖像動畫和緊密結合的聲音而不犧牲視覺連貫性。

使用 Minimax H3 I2V 雙時鐘 8 步驟高品質超高速工作流程進行電影級圖像動畫、角色表演、交通工具、產品鏡頭和從同步運動和生成音頻中受益的氛圍場景。該圖整合 SageAttention 用於記憶體高效推理和 MiniMax-H3 Turbo LoRA 用於加速生成,同時保持用戶友好的 I2V 體驗簡單。

Comfyui Minimax H3 I2V 雙時鐘 8 步驟高品質超高速工作流程中的關鍵模型#

  • MiniMax-H3 AV Foundation Model。核心視聽變壓器,提供參考圖像條件、運動生成和原生音頻合成。請參閱 Hugging Face 上的官方模型卡:MiniMaxAI/MiniMax-H3
  • MiniMax-H3 Turbo LoRA V4 step600。輕量級適配器,加速並穩定 MiniMax-H3 用於 8 步驟採樣,同時保持保真度。模型卡:larryvrh/MiniMax-H3-Turbo-Lora
  • MiniMax-H3 Video VAE 和 Audio VAE。配對解碼器,將視聽潛在變量轉換為 RGB 幀和立體聲波形。它們確保在採樣期間的高效潛在傳輸和高品質解碼。

如何使用 Comfyui Minimax H3 I2V 雙時鐘 8 步驟高品質超高速工作流程#

此工作流程從左到右運行,分為三個分組階段:模型和資產設置、雙時鐘採樣和解碼加 MP4 多工。您提供一張參考圖像和一個包含視覺方向和一個"Audio:"部分描述所需聲音的單一提示。

H3 加載器 + Turbo LoRA (EMA)#

此組準備 MiniMax-H3 堆疊並應用 Turbo LoRA 以提升速度。將您的參考圖像加載到 LoadImage,然後在 CR Prompt Text 中撰寫結尾為 "Audio: …" 子句的描述性運動提示。使用 ResolutionSelector 選擇您的輸出大小,保持尺寸與 32 的倍數對齊以確保視頻穩定性。使用 Float (duration) 控制設置您的目標持續時間(以秒為單位);圖的內部數學將其轉換為與模型計時對齊的幀數,以便採樣器順利運行。對模型應用 SageAttention 補丁,以在不改變最終外觀的情況下減少 VRAM 使用並提高吞吐量。

STABLE: video 4 / audio 4#

這組使用 8 步驟 MiniMax H3 雙時鐘採樣器進行生成的核心。條件模塊使用 Ref2VA 將您的參考圖像和文本提示融合成 AV 潛在變量,這錨定了身份、構圖和高級聲音線索。雙時鐘採樣器使用單獨但同步的時鐘推進視頻和音頻,因此運動和聲音感覺自然鎖定。如果您需要修正感知的提前或滯後,請調整視頻和音頻時鐘偏移,以推進或回退其中一個流,直到表現進入同步。基本的 CFG 風格引導器在對提示的忠誠度和模型學習的先驗知識之間平衡,實現乾淨的電影級運動。

Decode + synchronized MP4#

解碼器使用專用的 MiniMax-H3 VAE 將最終 AV 潛在變量轉換為幀序列和立體聲音軌。VHS_VideoCombine 階段將幀和音頻打包成單一 H.264 MP4,使用您選擇的幀率,保存準備共享的視頻。如果您稍後帶來自己的音頻,可以修剪到音頻長度或僅導出圖像以供外部編輯。結果是一個緊湊的同步剪輯,在為參考圖像增添生動運動和聲音的同時保持其外觀。

Comfyui Minimax H3 I2V 雙時鐘 8 步驟高品質超高速工作流程中的關鍵節點#

MiniMaxH3AudioConditioningT8 (#6)#

此節點實現 Ref2VA 條件,採用您的提示、參考圖像、目標寬度、高度和長度來創建視聽潛在變量和正面條件。使用它設置創意意圖:描述運動、攝像機行為和場景連續性,然後添加 "Audio:" 部分指定樂器、音色、氛圍和動態。保持寬度和高度與您的參考圖像的長寬比一致,以獲得最連貫的布局。長度控制將您的持續時間映射到與採樣器的內部計時對齊的幀,這有助於保持平滑運動和穩定音頻。由 ComfyUI MiniMax H3 Turbo 項目提供:Larryvrh/ComfyUI-MiniMax-H3-Turbo

MiniMaxH3DualClockSamplerT8 (#7)#

專為 MiniMax-H3 AV 生成設計的 8 步驟採樣器,使用單獨的視頻和音頻時鐘。通過協調兩個時間線並尊重您的 Ref2VA 約束,它產生快速、高品質的結果。如果視覺效果相對於節拍或動作感覺略早或晚,請小幅調整視頻和音頻時鐘偏移以重新居中同步。將步數保持在 8 以達到預期的高品質超高速平衡。在相同的插件中實現:Larryvrh/ComfyUI-MiniMax-H3-Turbo

LoraLoaderBypassModelOnly (#2)#

將 MiniMax-H3 Turbo LoRA 注入基礎模型,以加速收斂並在低步驟下改善穩定性。如果您注意到某些圖像上過度銳化或身份漂移,請稍微減少 LoRA 強度以恢復中立性。若要獲得更強的細節或更強的時間鎖定,請適度增加強度。LoRA 參考:larryvrh/MiniMax-H3-Turbo-Lora

MiniMaxH3MemoryEfficientSageAttentionPatch (#17)#

將內存高效的注意力實現應用於 MiniMax-H3 模型,以提高典型 GPU 上的吞吐量。按原樣使用它,以減少較大分辨率和較長持續時間的 VRAM 壓力。該補丁是 KJNodes 套件的一部分,適用於 ComfyUI:kijai/ComfyUI-KJNodes

MiniMaxH3AVDecodeT8 (#11)#

使用配對的 MiniMax-H3 VAE 將視聽潛在變量解碼為 RGB 幀和立體聲音頻。這是實現最終保真度的地方,因此保持分辨率選擇對您的 GPU 實際,以避免解碼瓶頸。該節點輸出與採樣器時鐘時間對齊的幀和音頻信號,準備多工。由 MiniMax H3 Turbo 插件提供:Larryvrh/ComfyUI-MiniMax-H3-Turbo

VHS_VideoCombine (#12)#

使用視頻助手套件將解碼幀和立體聲音頻合併為單一 MP4。設置您偏好的幀率,並在以後替換自定義音頻時啟用修剪。此節點完成交付,以便您可以快速預覽和導出。項目參考:Kosinkadink/ComfyUI-VideoHelperSuite

可選附加功能#

  • 提示效果最佳時,請分開視覺方向和聲音設計。先撰寫場景,然後添加 "Audio:",包括樂器、風格、房間類型和強度。
  • 開始時選擇與圖像比例匹配的適中大小。一旦您喜歡運動和計時,再進行擴大。
  • 如果同步感覺不對,請調整視頻或音頻時鐘偏移,而不是改變持續時間。微小的調整可以將表演鎖定到節拍上。
  • 對於角色鏡頭,選擇具有清晰主體分離和一致照明的圖像,以在運動中保持身份。
  • 重新播種以探索措辭和時間的微小變化,同時保持相同設置。

致謝#

此工作流程實現並建立在以下工作和資源之上。我們感謝 RunningHub 提供的 Source 工作流程模板,MiniMaxAI 提供的 MiniMax-H3 模型權重,以及 Larryvrh 提供的 MiniMax-H3 Turbo LoRA 和 ComfyUI MiniMax H3 Turbo 項目的貢獻和維護。欲了解詳細信息,請參閱以下連結的原始文檔和存儲庫。

資源#

注意: 使用所引用的模型、數據集和代碼需遵循其作者和維護者提供的相應許可和條款。

RunComfy
版權 2026 RunComfy. 保留所有權利。

RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。