ComfyUI>工作流>MiniMax H3 角色替换 ComfyUI | AI 角色替换

MiniMax H3 角色替换 ComfyUI | AI 角色替换

Workflow Name: RunComfy/MiniMax-H3-Character
Workflow ID: 0000...1500
在您的视频中替换一个人或角色。使用参考图像引导新身份。保留原始运动和镜头时间。使用 SAM3 蒙版进行精确的主体控制。MiniMax H3 在帧间保持外观一致。更快地创建干净的替换和服装变化。

MiniMax H3 Character Replacement ComfyUI Workflow

MiniMax H3 Character Replacement ComfyUI | SAM3 Ref2VA
Want to run this workflow?
  • Fully operational workflows
  • No missing nodes or models
  • No manual setups required
  • Features stunning visuals

MiniMax H3 Character Replacement ComfyUI Examples

MiniMax H3 角色替换 ComfyUI#

MiniMax H3 角色替换 ComfyUI 是一种参考引导的视频编辑工作流程,可以在源片段中交换一个人或角色,同时保持原始运动、镜头时间和场景布局不变。它将 SAM3 主体检测和蒙版与 MiniMax H3 Ref2VA 配对,以便替换的身份在帧间保持一致,无需手动修复。

专为需要可靠角色替换、身份替换、服装变化或在 ComfyUI 内进行参考驱动编辑的创作者而设计,此工作流程接受源视频、一张或多张参考图像以及可选的参考音频。结果是一个保留运动的替换,感觉像是镜头的原生,由 MiniMax H3 角色替换 ComfyUI 逻辑从头到尾提供动力。

Comfyui MiniMax H3 角色替换 ComfyUI 工作流程中的关键模型#

  • MiniMax H3 Ref2VA 扩散主干。提供参考到音视频生成,在尊重运动和时间的同时转移身份和外观。在 此处 查看官方模型卡以了解功能和提示指南,并在 此处 获取为工作流程打包的 Comfy 准备权重和 VAE。
  • MiniMax H3 视频 VAE 和音频 VAE。对视频和音频潜变量进行编码和解码,以实现高效采样和忠实重建。包含在上面的 Comfy-Org MiniMax H3 捆绑包中。
  • Qwen3-VL 32B 文本编码器。作为 MiniMax H3 使用的多模态文本编码器,用于解释提示和参考以实现连贯的身份转移。
  • SAM 3.1 Multiplex。用于检测和蒙版屏幕上的主体的高质量分割模型,使工作流程能够隔离运动线索并为角色替换准备更干净的参考。在 此处 由 Comfy-Org 托管的检查点。

如何使用 Comfyui MiniMax H3 角色替换 ComfyUI 工作流程#

工作流程从蒙版和参考准备开始,然后进行 H3 调整、采样和最终渲染。组按顺序运行,以生成仅替换表演者的保留运动交换。

蒙版#

此组加载您的源片段,可选地修剪并准备每帧蒙版。LoadVideo (#459) 供给 Video Slice (#483),以便您可以设置开始时间和持续时间。帧和音频通过 GetVideoComponents (#460, #505) 解包。SAM3_Detect (#503) 使用来自 CLIPTextEncode (#502) 的短类别文本(例如“person”)来查找主体并输出蒙版。通过 MaskToImage (#491) 预览蒙版,然后 ImageCompositeMasked (#454) 和 ImageScaleToTotalPixels (#456) 准备一个轻量的运动参考,以突出 MiniMax H3 的表演者。

模型#

此组加载推理中使用的核心 MiniMax H3 资源。UNETLoader (#463) 初始化 H3 Ref2VA 扩散权重,CLIPLoader (#465) 设置 Qwen3-VL 文本编码器,VAELoader (#470, #474) 引入视频和音频 VAE。它们共同定义了采样器将用于身份转移和解码的模型上下文。

调整#

此组将您的参考和提示转换为 H3 调整和起始潜变量。MiniMaxH3ReferenceToVideo (#464) 接受替换身份图像、来自蒙版组的准备运动参考以及源中的可选参考音频。宽度和高度来自 ResolutionSelector (#501);帧长度由 ComfyMathExpression (#481) 根据 Float (Duration) (#480) 设置的人性化持续时间自动计算,自动对齐到模型友好的帧数。结构化提示由 DapaoH3VideoPromptNode (#517) 生成,并通过 easy showAnything (#515) 传递,或者您可以根据官方 MiniMax H3 参考视频指南 此处 撰写您自己的提示。

采样#

此组使用您选择的采样器和计划执行去噪。RandomNoise (#467) 为可重现性播种。BasicScheduler (#473) 和 KSamplerSelect (#468) 定义步骤计划和算法,而 BasicGuider (#466) 将模型与来自 H3 节点的正向调整结合。SamplerCustomAdvanced (#469) 运行迭代精炼以生成最终的视频潜变量。

解码和创建视频#

此组将潜变量转换为可播放结果。VAEDecode (#472) 重建帧,这些帧与您的片段音频在 CreateVideo (#476) 中结合,以保留时间和氛围。SaveVideo (#482) 以所选格式和编解码器写入输出文件,以便您的 MiniMax H3 角色替换 ComfyUI 渲染准备好审阅或发布。

使用这些设置测试#

此帮助区域包含提示笔记和在创作期间使用的示例元数据。它不是操作所必需的,但可以为您的提示结构和时间选择提供灵感。

Comfyui MiniMax H3 角色替换 ComfyUI 工作流程中的关键节点#

MiniMaxH3ReferenceToVideo (#464)#

身份转移的核心。它接受替换图像、保留运动的视频参考和可选的参考音频,然后发出正向调整和初始潜变量。需要考虑的有用参数包括 promptwidthheightlength。如果您提供多个参考,请保持它们在视觉上一致,以避免身份漂移。

SAM3_Detect (#503)#

查找并分割将被替换的屏幕上主体。通过 CLIPTextEncode (#502) 提供的简短类别提示指导检测。仅在默认选择错过主体或包含背景时调整蒙版质量选项;更干净的蒙版通常会产生更稳定的替换。

ImageCompositeMasked (#454)#

从切片帧和 SAM3 蒙版构建以表演者为中心的参考。仅在需要对齐叠加或在将图像发送到 H3 参考输入之前调整帧缩放时使用 xyresize_source。目标是隔离演员的运动线索,同时保持场景几何不变。

ResolutionSelector (#501)#

通过几次点击控制目标渲染大小。选择适合您的硬件或周转需求的宽高比和百万像素预算。先从谦虚的开始,确认身份稳定性,然后为最终通过增加分辨率。

SamplerCustomAdvanced (#469)#

使用调度器、采样器、引导器、噪声和起始潜变量执行去噪。为了更快的外观开发,尝试较轻的时间表或调优速度的采样器,然后一旦身份和时间看起来正确,切换到您首选的质量设置。

可选附加功能#

  • 参考选择
    • 使用 1 到 3 张清晰、光线良好的图像,清晰显示目标面部和服装。避免混合身份或极端姿势。
    • 保持参考主体的年龄、发型和服装一致,以最大限度地减少长时间运动期间的漂移。
  • 蒙版提示
    • 如果 SAM3 包括背景,请完善您的类别文本或使用不同的阈值重新运行。干净的蒙版可以减少光晕并保持场景照明稳定。
  • 提示
    • 在替换中仅描述身份和服装,同时告诉 H3 保留原始运动和场景。官方指南在 此处 提供了简明的示例。
  • 模板
    • 如果您想要一个最小的起点,请将您的图表与官方 ComfyUI MiniMax H3 R2V 模板 此处 进行比较。
  • 权利和安全
    • 仅使用您有权转换的肖像、表演和音频。MiniMax H3 角色替换 ComfyUI 功能强大,因此请负责任地应用它。

鸣谢#

此工作流程实现并构建在以下作品和资源之上。我们感谢 MiniMaxAI 提供 MiniMax-H3 模型和参考视频提示指南,Comfy-Org 提供官方 ComfyUI MiniMax H3 R2V 模板,以及 RunningHub.ai 提供工作流程来源和参考的贡献和维护。有关权威详细信息,请参考下面链接的原始文档和存储库。

资源#

注意:使用引用的模型、数据集和代码需遵循其作者和维护者提供的各自许可和条款。

RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。