Qwen Image 2.1 脸部替换 ComfyUI 工作流程:通过提示引导的身份转移进行自然头部替换#
此 Qwen Image 2.1 脸部替换 ComfyUI 工作流程使用单独的身份参考在现有场景中替换主体的头部和面部。由 Qwen‑Image‑2.1 图像编辑和轻量级提示生成阶段提供支持,它在保留原始场景的姿势、服装和背景的同时转移面部特征、发型和面部毛发。
专为角色重铸、编辑肖像和创意头部替换场景而设计,工作流程易于驱动:提供您的原始场景,添加身份肖像,运行提示生成,并采样最终合成。清晰、光线充足的参考肖像帮助 Qwen Image 2.1 脸部替换 ComfyUI 工作流程产生无缝、逼真的混合效果。
Comfyui Qwen Image 2.1 脸部替换 ComfyUI 工作流程中的关键模型#
- Qwen‑Image‑2.1。核心图像编辑扩散模型,执行头部替换,同时尊重文本和视觉条件。请参阅 Hugging Face 上的官方模型卡:Qwen/Qwen-Image-2.1。
- Qwen‑Image‑2.1 VAE。用于解码最终潜变量为 RGB 并保留颜色保真度的变分自编码器。打包的权重可在 Comfy‑Org 发行版中获得:Comfy‑Org/Qwen‑Image‑2.1 • vae。
- Qwen‑Image‑2.1 文本编码器 (Qwen‑VL 家族, 8B)。将生成的指令和参考图像转换为扩散过程条件的跨模态编码器。请参阅 Comfy‑Org 存储库中的文本编码器资产:Comfy‑Org/Qwen‑Image‑2.1 • text_encoders。
如何使用 Comfyui Qwen Image 2.1 脸部替换 ComfyUI 工作流程#
图表组织为一个名为“Qwen Image 2.1 Face Swap”的单组,协调输入、提示生成、多模态条件、采样和保存。在高层次上,您加载两张图像,让提示块生成简洁的编辑指令,为 Qwen‑Image‑2.1 编码所有内容,选择从空画布还是从图像引导的潜变量开始,然后进行采样和解码。
输入:原始场景和身份肖像#
- 将您的场景或目标角色加载到
Original character(#470)。此图像提供身体、姿势、服装和环境,在脸部替换后应保留。 - 将要转移的面部加载到
new face(#510)。使用清晰、正面或三分之一肖像,光线一致;如果您希望发型保留,请包括发际线。 - 工作流程还将这两个输入批处理,以便提示生成器可以“看到”这两张图像,以便更好地制作指令。
提示生成:将您的意图转化为精确的编辑提示#
- 通过
aijuxi文本节点JjkText(#516) 提供简短指令,并在TextGenerateLTX2Prompt(#502) 中与批处理图像结合。 - 生成器生成一个紧凑的、以编辑为中心的指令(例如,“将图像 1 中的人的头部替换为图像 2 中的人,保持姿势、服装和背景”)。
- 这种自动生成的指令减少了提示工程的工作量,并帮助 Qwen Image 2.1 脸部替换 ComfyUI 工作流程在多次运行中保持一致性。
条件:Qwen‑Image‑2.1 的多模态指导#
TextEncodeQwenImage21(#485) 将指令与两张图像一起摄入,以生成描述要替换和保留内容的正负条件。- 编码器还准备了一个受您参考影响的潜变量蓝图。此设置使模型能够在保留原始场景的同时转移身份特征。
分辨率和潜变量路由:选择构图和控制强度#
- 在
ResolutionSelector(#13) 中设置您所需的纵横比和像素预算。分辨率输入一个EmptyLatentImage,定义合成的画布大小。 ComfySwitchNode(#483) 选择起始潜变量:- 开:从空潜变量开始,以获得最大的创意自由和更强的身份转移。
- 关:从编码器的潜变量开始,以进行更贴近原始构图的图像引导替换。
- 此开关允许您在不更改其他设置的情况下调整替换的“强度”。
采样、解码和保存#
- UNet 权重加载一次并缓存(
UNETLoader到QwenImage21Cache),然后KSampler(#482) 使用您的条件和选择的潜变量来源运行扩散过程。 VAEDecode将采样的潜变量转换为 RGB 图像,SaveImage(#518) 使用带时间戳的文件名写入结果。- Qwen Image 2.1 脸部替换 ComfyUI 工作流程对于每个种子都是确定性的,因此您可以通过保持相同的种子和配置来重现喜欢的外观。
Comfyui Qwen Image 2.1 脸部替换 ComfyUI 工作流程中的关键节点#
TextEncodeQwenImage21 (#485)#
这是替换的核心:它将生成的指令与两张图像融合在一起,生成 Qwen‑Image‑2.1 遵循的指导。为了更严格地保留场景,请将您的指令集中在仅替换头部而保留姿势、服装和背景。如果您需要更温和的编辑,请使用图像引导模式(请参阅下面的开关),并保持负面语言简洁,以避免过度限制模型。
TextGenerateLTX2Prompt (#502)#
此节点将您的意图和两张图像提炼为简洁的编辑指令。当您想要一致的措辞和减少手动提示时使用它。如果您更喜欢自己的措辞,可以通过提供自定义指令并保持其简短、具体和场景保留来绕过生成器。
ComfySwitchNode (#483)#
此开关路由起始潜变量。使用空潜变量路径以获得更强的身份转移和风格化,或者在您希望构图和光照更紧密贴合原始场景时使用编码器潜变量路径。当您看到漂移过多(转向图像引导)或身份转移不足(转向空潜变量)时切换此开关。
KSampler (#482)#
控制采样策略和编辑的强度。在图像引导模式下,较低的去噪因子将保留更多的原始头部结构;较高的值将推动更强的替换。选择一个您信任的人像采样器和调度器,并在比较变化时固定种子。
ResolutionSelector (#13)#
设置生成的纵横比和像素预算。匹配原始场景的构图以减少变形,或如果您计划裁剪,尝试稍大一点的画布。更高的分辨率能更好地捕捉发丝细节,但会增加运行时间。
可选附加项#
- 使用干净、无遮挡的身份肖像;如果您希望眼睛和眉毛忠实转移,请避免戴太阳镜和严重遮挡。
- 匹配头部规模:如果原始主体靠近相机,请裁剪身份参考以获得相似的头部大小。
- 保持图像间光照一致,以获得更自然的混合效果;如果光照不同,请优先选择图像引导的潜变量,以便更好地遵循场景。
- 对于批量探索,锁定种子并仅更改身份肖像;这将隔离新面孔的效果。
- 如果结果看起来“过度编辑”,请使用图像引导的潜变量并减少整体编辑强度;如果身份无法保持,请从空潜变量开始,并加强提示指令。
- 此工作流程使用的模型资产可从 Hugging Face 获得:Qwen/Qwen‑Image‑2.1 和 Comfy‑Org/Qwen‑Image‑2.1。
致谢#
此工作流程实现并构建在以下作品和资源之上。我们感谢 aijuxi 提供的 Original workflow,感谢 Qwen 提供的 Qwen-Image-2.1 (official model),以及感谢 Qwen 提供的 Qwen-Image-2.1 official announcement 对他们的贡献和维护。有关权威详细信息,请参阅下面链接的原始文档和存储库。
资源#
- aijuxi/Original workflow
- 文档 / 发行说明:Original workflow by aijuxi
- Qwen/Qwen-Image-2.1
- Hugging Face: Qwen/Qwen-Image-2.1
- Qwen/Qwen-Image-2.1 official announcement
- 文档 / 发行说明:Qwen-Image-2.1 official announcement
注意:所引用的模型、数据集和代码的使用受其作者和维护者提供的各自许可和条款的约束。







