FastH3 4步驟 ComfyUI 工作流程#
這個適用於 RunComfy 的圖形提供了快速的 MiniMax H3 文字到影片和首幀圖片到影片的同步音頻。FastH3 4步驟 ComfyUI 工作流程遵循 FastVideo VSA-DataFree 的4步驟路徑,同時在 ComfyUI 中保留8步驟調度器以實現實用的視覺穩定性。它非常適合於電影場景、以角色為主的時刻、產品拍攝以及氛圍豐富的片段,在快速迭代中至關重要。
該工作流程自動將幀和音頻多路復用到 MP4 並支持可選的首幀 I2V 分支。連接起始圖像以進行連續性敏感的拍攝,或保持空白以純粹生成 T2V。提示可以是長形式和結構化的,允許您在片段間保持視覺和聲音的連續性。
Comfyui FastH3 4步驟 ComfyUI 工作流程中的關鍵模型#
- MiniMax H3 擴散模型 (FL2VA)。通過統一的潛在設計驅動跨模態影片和音頻生成。模型系列參考:MiniMaxAI/MiniMax-H3。
- FastVideo FastH3 4步驟 VSA-DataFree 權重。使這裡使用的超短4步驟路徑成為可能,以速度為先的草稿。權重參考:FastVideo/FastVideo-FastH3-4-step-Preview-v1-VSA-DataFree。
- MiniMax H3 的 Qwen3-VL 32B AWQ 文本編碼器。提供高容量的提示理解,用於風格、構圖和音頻提示。與 Comfy-Org MiniMax H3 資產一起分發:Comfy-Org/MiniMax-H3。
- MiniMax H3 影片 VAE (FP16)。將潛在影片解碼為 RGB 幀,使用 H3 的本地編解碼器。資產參考:Comfy-Org/MiniMax-H3。
- MiniMax H3 音頻 VAE (FP32)。解碼與生成幀對齊的潛在音頻軌道。資產參考:Comfy-Org/MiniMax-H3。
如何使用 Comfyui FastH3 4步驟 ComfyUI 工作流程#
在高層次上,用戶輸入定義分辨率、持續時間和提示。圖形準備 MiniMax H3 組件,為 T2V 或 I2V 構建條件,然後運行一個針對 FastH3 4步驟路徑調整的簡潔採樣過程。最後,它解碼影片和音頻並將它們合併到一個可分享的 MP4 中。
用戶輸入#
在用戶輸入組中設置目標外觀和時間。使用 ResolutionSelector (#115) 選擇比例和像素預算;分辨率量化為32的倍數以兼容解碼器。通過 (input:FPS) PrimitiveFloat (#5986) 選擇每秒幀數,通過 (input:Duration) Seconds (#221) 選擇以秒為單位的片長。ComfyMathExpression (#220) 中的表達式將持續時間轉換為幀數,並將其調整為適合步幅的倍數,提供穩定的調度和一致的片長。在 (input:prompt) Text Prompt PrimitiveStringMultiline (#6005) 中添加您的長形式提示;一個輔助的 StringConcatenate (#6115) 讓您保持可重用的風格或連續性錨點。
模型#
模型組加載 H3 的核心組件和可選的注意力微調。UNETLoader (#215) 選擇使4步驟路徑在速度上可行的 FastVideo VSA-DataFree FL2VA 權重,同時在8步驟調度器下保持一致性。CLIPLoader (#216) 引入 Qwen3-VL 32B AWQ 文本編碼器,以豐富的語言基礎。兩個 VAELoader 節點處理影片和音頻分支,以便在最後進行準確解碼。PathchSageAttentionKJ (#223) 在調度前應用輕量級的注意力修改,可以在非常短的調度中改善細節保留。
調節#
調節由 MiniMaxH3ImageToVideo (#219) 組裝,這也是 T2V 或首幀 I2V 的入口點。如果您連接了一個圖像到 first_frame,該節點將從該幀調節運動;否則,它將從您的提示中純粹運行文字到影片。寬度、高度和長度來自用戶輸入組,因此您可以快速縮放而無需觸及下游節點。Get_duration (#6067) 和 Get_strPrompt (#6069) 乾淨地管理共享值,因此提示和時間一致應用。輸出提供正面調節和準備好的潛在值,供採樣器進一步完善。
採樣#
採樣是緊湊且針對 FastH3 進行調整的。RandomNoise (#217) 為軌跡播種,BasicGuider (#214) 從您的調節中構建指導,並且 KSamplerSelect (#211) 選擇一個針對短路徑優化的多步採樣器。MiniMaxH3SigmaShift (#6007) 調整 H3 的噪聲時間表以適應 FL2VA 權重,而 BasicScheduler (#212) 保持保存的工作流程在8步驟,以實現速度和保真度之間的實際平衡。然後 SamplerCustomAdvanced (#213) 驅動去噪,生成包含影片和音頻內容的單一潛在流。
解碼和創建影片#
一旦採樣完成,VAEDecode (#210) 將潛在影片轉換為幀,VAEDecodeAudio (#209) 重新構建同步的音頻。來自 Video Helper Suite 的 VHS_VideoCombine (#6104) 將序列多路復用為 MP4,並具有項目的幀速率。您可以預覽輸出,該節點將寫入單個文件到輸出目錄,準備審查。由於寬度、高度和幀數已在上游驗證,這一階段是免操作且快速的。如果您提供了首幀,運動將從中流動;否則,片段將完全從提示生成。
Comfyui FastH3 4步驟 ComfyUI 工作流程中的關鍵節點#
MiniMaxH3ImageToVideo (#219)#
T2V 和首幀 I2V 的中央調節中心。提供您的提示和時間輸入,並可選地連接 first_frame 以進行連續性敏感的拍攝。調整寬度和高度以適應比例和方面,同時保持它們為32的倍數。長度來自持續時間到幀數的邏輯,因此您很少需要手動設置。
MiniMaxH3SigmaShift (#6007)#
應用針對 MiniMax H3 的 FL2VA 時間表量身定制的 sigma 移位,使短路徑採樣器保持穩定。為 FastH3 路線配置時保持不變;主要是一種兼容性和質量保護措施。僅在您更換 H3 權重或調度器時考慮更改。
BasicScheduler (#212)#
提供與4步驟權重路徑相配的8步驟時間表,以實現實際的質量基線。您可以減少步驟以更快地草稿,或略微提高以獲得更多的穩定性,注意細節與速度之間的權衡。步驟數與 sigma 移位和採樣器選擇相互影響,因此要謹慎更改。
SamplerCustomAdvanced (#213) 與 KSamplerSelect (#211)#
運行 FastH3 使用的短去噪軌跡。所選擇的採樣器針對多步效率和一致性進行調整,並且更新很少。除非您正在實驗替代採樣器,否則請保持此配對。
ResolutionSelector (#115)#
高級控制比例和像素預算。使用它來縮放外觀而不觸及模型內部,並偏好翻譯為約0.7-1.0百萬像素的分辨率,以便非常快速的草稿,然後在鎖定最終拍攝時放大。輸出經過量化以保持解碼器效率。
VHS_VideoCombine (#6104)#
將解碼的幀和音頻合併為單個 MP4。質量和大小可以通過其壓縮和幀速率控制來平衡。它是 Video Helper Suite 的一部分,您可以在這裡探索:Kosinkadink/ComfyUI-VideoHelperSuite。
可選額外功能#
- 首幀 I2V:將圖像連接到
MiniMaxH3ImageToVideo(#219) 的first_frame以從設計板、照片或先前拍攝中獲得連續性。 - 提示:在
StringConcatenate(#6115) 中保留可重用的風格指南,僅在主提示中放置場景特定的指示,以保持片段間的一致性。 - 時間調整:僅調整秒數;圖形將幀數調整為適合步幅的倍數以避免卡頓,並自動保持音頻對齊。
- 速度與質量:在
ResolutionSelector(#115) 中以較低的百萬像素進行草稿,然後在BasicScheduler(#212) 中提高分辨率,必要時提高步數以完成。 - 參考:探索此工作流程使用的權重和資產:MiniMaxAI/MiniMax-H3、FastVideo/FastVideo-FastH3-4-step-Preview-v1-VSA-DataFree,以及 Comfy 的改編:barelymining/ComfyUI-MiniMax-H3-FastVideo。
致謝#
此工作流程實現並建立在以下作品和資源的基礎上。我們感謝 MiniMaxAI 提供的 MiniMax-H3、FastVideo 提供的 FastH3 4步驟 VSA-DataFree 權重,以及 barelymining 提供的 ComfyUI-MiniMax-H3-FastVideo 的貢獻和維護。詳細信息請參閱下列鏈接的原始文檔和存儲庫。
資源#
- AI Future Tech/Workflow source and reference
- Docs / Release Notes: Patreon post
- barelymining/ComfyUI-MiniMax-H3-FastVideo
- Hugging Face: barelymining/ComfyUI-MiniMax-H3-FastVideo
- FastVideo/FastVideo-FastH3-4-step-Preview-v1-VSA-DataFree
- MiniMaxAI/MiniMax-H3
- Hugging Face: MiniMaxAI/MiniMax-H3
- Comfy.org/MiniMax H3 tutorial
- Docs / Release Notes: Comfy.org tutorial
注意:使用參考的模型、數據集和代碼需遵循其作者和維護者提供的相應許可和條款。

