MiniMax H3 角色替换 ComfyUI#
MiniMax H3 角色替换 ComfyUI 是一种参考引导的视频编辑工作流程,可以在源片段中交换一个人或角色,同时保持原始运动、镜头时间和场景布局不变。它将 SAM3 主体检测和蒙版与 MiniMax H3 Ref2VA 配对,以便替换的身份在帧间保持一致,无需手动修复。
专为需要可靠角色替换、身份替换、服装变化或在 ComfyUI 内进行参考驱动编辑的创作者而设计,此工作流程接受源视频、一张或多张参考图像以及可选的参考音频。结果是一个保留运动的替换,感觉像是镜头的原生,由 MiniMax H3 角色替换 ComfyUI 逻辑从头到尾提供动力。
Comfyui MiniMax H3 角色替换 ComfyUI 工作流程中的关键模型#
- MiniMax H3 Ref2VA 扩散主干。提供参考到音视频生成,在尊重运动和时间的同时转移身份和外观。在 此处 查看官方模型卡以了解功能和提示指南,并在 此处 获取为工作流程打包的 Comfy 准备权重和 VAE。
- MiniMax H3 视频 VAE 和音频 VAE。对视频和音频潜变量进行编码和解码,以实现高效采样和忠实重建。包含在上面的 Comfy-Org MiniMax H3 捆绑包中。
- Qwen3-VL 32B 文本编码器。作为 MiniMax H3 使用的多模态文本编码器,用于解释提示和参考以实现连贯的身份转移。
- SAM 3.1 Multiplex。用于检测和蒙版屏幕上的主体的高质量分割模型,使工作流程能够隔离运动线索并为角色替换准备更干净的参考。在 此处 由 Comfy-Org 托管的检查点。
如何使用 Comfyui MiniMax H3 角色替换 ComfyUI 工作流程#
工作流程从蒙版和参考准备开始,然后进行 H3 调整、采样和最终渲染。组按顺序运行,以生成仅替换表演者的保留运动交换。
蒙版#
此组加载您的源片段,可选地修剪并准备每帧蒙版。LoadVideo (#459) 供给 Video Slice (#483),以便您可以设置开始时间和持续时间。帧和音频通过 GetVideoComponents (#460, #505) 解包。SAM3_Detect (#503) 使用来自 CLIPTextEncode (#502) 的短类别文本(例如“person”)来查找主体并输出蒙版。通过 MaskToImage (#491) 预览蒙版,然后 ImageCompositeMasked (#454) 和 ImageScaleToTotalPixels (#456) 准备一个轻量的运动参考,以突出 MiniMax H3 的表演者。
模型#
此组加载推理中使用的核心 MiniMax H3 资源。UNETLoader (#463) 初始化 H3 Ref2VA 扩散权重,CLIPLoader (#465) 设置 Qwen3-VL 文本编码器,VAELoader (#470, #474) 引入视频和音频 VAE。它们共同定义了采样器将用于身份转移和解码的模型上下文。
调整#
此组将您的参考和提示转换为 H3 调整和起始潜变量。MiniMaxH3ReferenceToVideo (#464) 接受替换身份图像、来自蒙版组的准备运动参考以及源中的可选参考音频。宽度和高度来自 ResolutionSelector (#501);帧长度由 ComfyMathExpression (#481) 根据 Float (Duration) (#480) 设置的人性化持续时间自动计算,自动对齐到模型友好的帧数。结构化提示由 DapaoH3VideoPromptNode (#517) 生成,并通过 easy showAnything (#515) 传递,或者您可以根据官方 MiniMax H3 参考视频指南 此处 撰写您自己的提示。
采样#
此组使用您选择的采样器和计划执行去噪。RandomNoise (#467) 为可重现性播种。BasicScheduler (#473) 和 KSamplerSelect (#468) 定义步骤计划和算法,而 BasicGuider (#466) 将模型与来自 H3 节点的正向调整结合。SamplerCustomAdvanced (#469) 运行迭代精炼以生成最终的视频潜变量。
解码和创建视频#
此组将潜变量转换为可播放结果。VAEDecode (#472) 重建帧,这些帧与您的片段音频在 CreateVideo (#476) 中结合,以保留时间和氛围。SaveVideo (#482) 以所选格式和编解码器写入输出文件,以便您的 MiniMax H3 角色替换 ComfyUI 渲染准备好审阅或发布。
使用这些设置测试#
此帮助区域包含提示笔记和在创作期间使用的示例元数据。它不是操作所必需的,但可以为您的提示结构和时间选择提供灵感。
Comfyui MiniMax H3 角色替换 ComfyUI 工作流程中的关键节点#
MiniMaxH3ReferenceToVideo (#464)#
身份转移的核心。它接受替换图像、保留运动的视频参考和可选的参考音频,然后发出正向调整和初始潜变量。需要考虑的有用参数包括 prompt、width、height 和 length。如果您提供多个参考,请保持它们在视觉上一致,以避免身份漂移。
SAM3_Detect (#503)#
查找并分割将被替换的屏幕上主体。通过 CLIPTextEncode (#502) 提供的简短类别提示指导检测。仅在默认选择错过主体或包含背景时调整蒙版质量选项;更干净的蒙版通常会产生更稳定的替换。
ImageCompositeMasked (#454)#
从切片帧和 SAM3 蒙版构建以表演者为中心的参考。仅在需要对齐叠加或在将图像发送到 H3 参考输入之前调整帧缩放时使用 x、y 和 resize_source。目标是隔离演员的运动线索,同时保持场景几何不变。
ResolutionSelector (#501)#
通过几次点击控制目标渲染大小。选择适合您的硬件或周转需求的宽高比和百万像素预算。先从谦虚的开始,确认身份稳定性,然后为最终通过增加分辨率。
SamplerCustomAdvanced (#469)#
使用调度器、采样器、引导器、噪声和起始潜变量执行去噪。为了更快的外观开发,尝试较轻的时间表或调优速度的采样器,然后一旦身份和时间看起来正确,切换到您首选的质量设置。
可选附加功能#
- 参考选择
- 使用 1 到 3 张清晰、光线良好的图像,清晰显示目标面部和服装。避免混合身份或极端姿势。
- 保持参考主体的年龄、发型和服装一致,以最大限度地减少长时间运动期间的漂移。
- 蒙版提示
- 如果 SAM3 包括背景,请完善您的类别文本或使用不同的阈值重新运行。干净的蒙版可以减少光晕并保持场景照明稳定。
- 提示
- 在替换中仅描述身份和服装,同时告诉 H3 保留原始运动和场景。官方指南在 此处 提供了简明的示例。
- 模板
- 如果您想要一个最小的起点,请将您的图表与官方 ComfyUI MiniMax H3 R2V 模板 此处 进行比较。
- 权利和安全
- 仅使用您有权转换的肖像、表演和音频。MiniMax H3 角色替换 ComfyUI 功能强大,因此请负责任地应用它。
鸣谢#
此工作流程实现并构建在以下作品和资源之上。我们感谢 MiniMaxAI 提供 MiniMax-H3 模型和参考视频提示指南,Comfy-Org 提供官方 ComfyUI MiniMax H3 R2V 模板,以及 RunningHub.ai 提供工作流程来源和参考的贡献和维护。有关权威详细信息,请参考下面链接的原始文档和存储库。
资源#
- RunningHub.ai/Workflow source and reference
- Docs / Release Notes: Workflow source and reference
- MiniMaxAI/MiniMax H3 official model
- GitHub: MiniMax-AI/MiniMax-H3
- Hugging Face: MiniMaxAI/MiniMax-H3
- MiniMaxAI/MiniMax H3 reference-video prompt guide
- GitHub: MiniMax-AI/MiniMax-H3
- Hugging Face: MiniMaxAI/MiniMax-H3
- Docs / Release Notes: MiniMax H3 reference-video prompt guide
- Comfy-Org/Official ComfyUI MiniMax H3 R2V template
- GitHub: Comfy-Org/workflow_templates (video_minimax_h3_r2v.json)
- Hugging Face: Comfy-Org/MiniMax-H3
注意:使用引用的模型、数据集和代码需遵循其作者和维护者提供的各自许可和条款。

