MiniMax H3 角色替換 ComfyUI#
MiniMax H3 角色替換 ComfyUI 是一個以參考為指導的視頻編輯工作流程,用於在源片段中替換人物或角色,同時保持原始動作、相機時間和場景佈局不變。它將 SAM3 主題檢測和掩碼與 MiniMax H3 Ref2VA 結合,以便替換身份在各幀間保持一致,而無需手動修補。
專為需要可靠角色替換、身份替換、服裝變化或在 ComfyUI 內進行參考驅動編輯的創作者而設計,此工作流程接受源視頻、一個或多個參考圖像和可選的參考音頻。結果是一個保留動作的替換,感覺本土於鏡頭,由 MiniMax H3 角色替換 ComfyUI 邏輯從頭到尾驅動。
Comfyui MiniMax H3 角色替換 ComfyUI 工作流程中的關鍵模型#
- MiniMax H3 Ref2VA 擴散骨幹。提供參考到音頻視頻生成,轉移身份和外觀,同時尊重動作和時間。請參閱官方模型卡 here 了解功能和提示指南,並獲取適用於工作流程的 Comfy-ready 權重和 VAE here。
- MiniMax H3 Video VAE 和 Audio VAE。編碼和解碼視頻和音頻潛在變量以實現高效取樣和忠實重建。包括在上述 Comfy-Org MiniMax H3 套件中。
- Qwen3-VL 32B 文本編碼器。作為 MiniMax H3 用於解釋提示和參考的多模態文本編碼器。
- SAM 3.1 Multiplex。用於檢測和掩碼屏幕上主題的高質量分割模型,以便工作流程可以隔離運動線索並準備更清晰的參考以進行角色替換。由 Comfy-Org here 托管的檢查點。
如何使用 Comfyui MiniMax H3 角色替換 ComfyUI 工作流程#
工作流程從掩碼和參考準備到 H3 條件設置、取樣和最終渲染。組按順序運行,以產生一個僅替換表演者的保留動作的替換。
掩碼#
此組加載您的源片段,可選地修剪它,並準備每幀掩碼。LoadVideo (#459) 將 Video Slice (#483) 餵給您設置開始時間和持續時間。使用 GetVideoComponents (#460, #505) 解包幀和音頻。SAM3_Detect (#503) 使用來自 CLIPTextEncode (#502) 的短類別文本,如“person”,來查找主題並輸出掩碼。掩碼通過 MaskToImage (#491) 預覽,然後 ImageCompositeMasked (#454) 和 ImageScaleToTotalPixels (#456) 準備一個輕量級運動參考,突顯 MiniMax H3 的表演者。
模型#
此組加載推理時使用的核心 MiniMax H3 資產。UNETLoader (#463) 初始化 H3 Ref2VA 擴散權重,CLIPLoader (#465) 設置 Qwen3-VL 文本編碼器,VAELoader (#470, #474) 引入視頻和音頻 VAE。它們共同定義了採樣器用於身份轉移和解碼的模型上下文。
條件設置#
此組將您的參考和提示轉換為 H3 條件設置和起始潛在變量。MiniMaxH3ReferenceToVideo (#464) 接受一個替換身份圖像、來自掩碼組的準備好的運動參考,以及來自源的可選參考音頻。寬度和高度來自 ResolutionSelector (#501);幀長由 ComfyMathExpression (#481) 自動計算,從 Float (Duration) (#480) 設置的人類友好持續時間中獲取,並調整為模型友好的幀數。由 DapaoH3VideoPromptNode (#517) 生成的結構化提示通過 easy showAnything (#515) 傳遞,或者您可以根據官方 MiniMax H3 參考視頻指南 here 編寫自己的提示。
取樣#
此組使用您選擇的採樣器和計劃進行去噪。RandomNoise (#467) 為可重現性播種過程。BasicScheduler (#473) 和 KSamplerSelect (#468) 定義步驟計劃和算法,而 BasicGuider (#466) 將模型與 H3 節點的正面條件相融合。SamplerCustomAdvanced (#469) 運行迭代細化,以產生最終視頻潛在變量。
解碼並創建視頻#
此組將潛在變量轉換為可播放的結果。VAEDecode (#472) 重建幀,並在 CreateVideo (#476) 中與您的片段音頻結合,以保留時間和氛圍。SaveVideo (#482) 寫入一個輸出文件,使用選擇的格式和編解碼器,這樣您的 MiniMax H3 角色替換 ComfyUI 渲染就可以準備好審核或發布。
使用這些設置進行測試#
此幫助區域包含提示說明和編寫期間使用的示例元數據。它不是操作所必需的,但可以激發您自己的提示結構和時間選擇。
Comfyui MiniMax H3 角色替換 ComfyUI 工作流程中的關鍵節點#
MiniMaxH3ReferenceToVideo (#464)#
身份轉移的核心。它接受一個替換圖像、一個保留運動的視頻參考和可選的參考音頻,然後發出正面條件和初始潛在變量。需要考慮的重要參數是 prompt、width、height 和 length。如果您提供多個參考,請保持它們在視覺上保持一致,以避免身份漂移。
SAM3_Detect (#503)#
查找並分割將被替換的屏幕上主題。通過 CLIPTextEncode (#502) 的短類別提示引導檢測。僅在默認選擇未檢測到主題或包含背景時調整掩碼質量選項;更乾淨的掩碼通常會產生更穩定的替換。
ImageCompositeMasked (#454)#
從切片幀和 SAM3 掩碼構建一個以表演者為重點的參考。僅在需要對齊疊加或調整幀縮放時使用 x、y 和 resize_source,然後將圖像發送到 H3 參考輸入。目標是隔離演員的運動線索,同時保持場景幾何不變。
ResolutionSelector (#501)#
通過幾次點擊控制目標渲染大小。選擇適合您的硬件或周轉需求的長寬比和百萬像素預算。從適中開始,確認身份穩定性,然後增加分辨率以進行最終處理。
SamplerCustomAdvanced (#469)#
使用調度器、採樣器、引導器、噪聲和起始潛在變量執行去噪。為更快的外觀開發,嘗試較輕的計劃或針對速度調整的採樣器,然後在身份和時間看起來正確後切換到您偏好的質量設置。
可選附加項#
- 參考選擇
- 使用 1 到 3 張清晰、光線良好的圖像,清晰顯示目標面部和服裝。避免混合身份或極端姿勢。
- 保持參考主題的年齡、髮型和服裝一致,以最大限度地減少長時間運動期間的漂移。
- 掩碼提示
- 如果 SAM3 包含背景,請完善您的類別文本或使用不同的閾值重新運行。乾淨的掩碼可以減少光暈並保持場景照明穩定。
- 提示
- 僅描述替換中的身份和服裝,同時告訴 H3 保留原始動作和場景。官方指南中有簡潔的示例 here。
- 模板
- 如果您想要一個最小的起點,請將您的圖與官方 ComfyUI MiniMax H3 R2V 模板進行比較 here。
- 權利與安全
- 只使用您有權轉換的肖像、表演和音頻。MiniMax H3 角色替換 ComfyUI 功能強大,因此請負責任地應用它。
致謝#
此工作流程實現並建立在以下工作和資源之上。我們誠摯感謝 MiniMaxAI 提供的 MiniMax-H3 模型和參考視頻提示指南,Comfy-Org 提供的官方 ComfyUI MiniMax H3 R2V 模板,以及 RunningHub.ai 提供的工作流程源和參考,感謝他們的貢獻和維護。有關權威詳細信息,請參閱以下鏈接的原始文檔和存儲庫。
資源#
- RunningHub.ai/Workflow source and reference
- Docs / Release Notes: Workflow source and reference
- MiniMaxAI/MiniMax H3 official model
- GitHub: MiniMax-AI/MiniMax-H3
- Hugging Face: MiniMaxAI/MiniMax-H3
- MiniMaxAI/MiniMax H3 reference-video prompt guide
- GitHub: MiniMax-AI/MiniMax-H3
- Hugging Face: MiniMaxAI/MiniMax-H3
- Docs / Release Notes: MiniMax H3 reference-video prompt guide
- Comfy-Org/Official ComfyUI MiniMax H3 R2V template
- GitHub: Comfy-Org/workflow_templates (video_minimax_h3_r2v.json)
- Hugging Face: Comfy-Org/MiniMax-H3
Note: Use of the referenced models, datasets, and code is subject to the respective licenses and terms provided by their authors and maintainers.

