Qwen Image 2.1 用于ComfyUI中参考引导的组合的多图像编辑#
这个工作流程将多个参考图像组装成一个连贯的场景,使用英语编辑指令。它在保留可识别的设计特征、材料和照明的同时融合主体、物体和环境。参考感知的提示增强阶段在生成前扩展您的指令,因此Qwen Image 2.1可以准确地放置每个元素并保持身份完整。
Qwen Image 2.1 多图像编辑非常适合室内设计、协调服装可视化和从单独照片创建的群体肖像。您描述每个参考应该如何出现和互动,工作流程将您的指令重写为明确的编辑提示,模型生成单个真实感或风格化的图像,感觉自然组成。
Comfyui Qwen Image 2.1 多图像编辑工作流程中的关键模型#
- Qwen-Image-2.1。用于生成的核心文本和图像条件扩散模型。它支持参考感知编辑和多视觉输入的强大放置。参见模型卡和项目概述的功能和变体:Hugging Face, GitHub。
- Qwen-Image-2.1-PE-I2I。此处使用的指令调优组件,用于参考感知提示增强。它将您的英语指令重写为简洁、生成就绪的编辑提示,基于提供的图像:Hugging Face。
- Qwen-Image-2.1 VAE。变分自编码器将潜在变量解码回RGB,同时保持色彩保真度和精细细节:与Qwen-Image-2.1版本一起打包在Hugging Face。
如何使用Comfyui Qwen Image 2.1 多图像编辑工作流程#
工作流程分为三个阶段:您提供参考和简单的英语指令,提示被重写为图像基础,然后生成器从增强的提示和您的参考中组成最终图像。
用户输入#
使用四个LoadImage节点为您的基础场景和参考元素:图像1 - 阅读室 (#470), 图像2 - 智慧扶手椅 (#510), 图像3 - 边桌和茶 (#503), 和 图像4 - 宇宙花 (#511)。如果您需要更多来源,还有标记为“未使用参考”的附加LoadImage节点;当您希望参考影响结果时连接它们。在编辑指令 - 英语 (#516)中编写您的指令,清楚地说明每个图像的角色、要保留的特征、放置物体的位置以及要避免的内容。在ResolutionSelector (#13)中设置输出的长宽比和大小,然后工作流程将在该分辨率下创建一个EmptyLatentImage (#480)进行生成,除非您选择下面描述的替代路径。
提示重写#
所有选定的图像由ZNGB_ImageBatchMulti (#531)整理并通过TextGenerateLTX2Prompt (#502)传递给English Prompt Enhancement。在English Output Instruction (#517)中附加一行简短的辅助行以仅返回最终提示。增强步骤使用Qwen Image 2.1 PE模型扩展角色、放置、照明和一致性规则为一个明确的编辑指令。在生成自动进行之前,您可以在Enhanced Prompt Preview (#501)中预览此精炼文本。
模型#
Models组加载生成组件:用于Qwen-Image-2.1的UNETLoader (#477),用于其文本视觉编码器的CLIPLoader (#533),以及用于解码的VAELoader (#479)。TextEncodeQwenImage21 (#519)然后合并增强的提示、您的可选负面提示以及最多十个参考图像进入适合多图像编辑的条件。它还可以在需要时产生一个可选的参考潜在变量以更紧密地指导结构。
采样和输出#
QwenImage21Cache (#484)与KSampler (#482)共享模型以进行高效的迭代采样。默认情况下,ComfySwitchNode (#483)从EmptyLatentImage (#480)路由一个空白潜在变量以进行自由组合;当您希望更强的参考几何结构或布局时,切换它以使用TextEncodeQwenImage21潜在变量。调整KSampler以平衡提示遵循和变化,然后VAEDecode (#481)和SaveImage (#534)根据所选的文件名前缀生成最终图像。
Comfyui Qwen Image 2.1 多图像编辑工作流程中的关键节点#
TextGenerateLTX2Prompt (#502)#
此节点使用Qwen Image 2.1 PE模型执行参考感知提示增强。提供您的指令和组装的图像批次以获得一个明确的编辑提示,基于参考。需要保留许多对象属性时增加允许长度,并调整采样选项以偏向创造性改写或严格的字面重写。预览节点显示生成器将遵循的内容。
TextEncodeQwenImage21 (#519)#
将增强的提示和最多十个参考图像编码为Qwen-Image-2.1的条件。使用negative_prompt禁止不需要的重复、拼贴效果或多余人物。resolution输入设置特征提取的工作比例;匹配您的输出以保持稳定的细节保留。此节点还可以发出一个初始潜在变量,当通过开关选择时可以更紧密地锁定组合。
ComfySwitchNode (#483)#
切换KSampler的启动策略。保持默认的空白潜在变量以进行更自由的组合,同时通过条件仍然尊重参考身份。当您希望更强的结构指导时,切换到来自TextEncodeQwenImage21的参考潜在变量;将其与更低的去噪结合以强调参考。
KSampler (#482)#
推动Qwen-Image-2.1的去噪过程。使用seed重现特定安排或探索变化。调整cfg以确定模型遵循增强提示的严格程度,以及steps以进行质量与速度的权衡。sampler_name和scheduler的选择可以微妙地改变纹理和清晰度;在外观迭代时选择一致的组合。
ResolutionSelector (#13)#
提供对输出宽度和高度的快速控制。选择一个舒适地框住所有参考元素的纵横比。较大的分辨率揭示更多参考纹理,但需要更多计算,因此在您的组合稳定时逐渐增加。
可选附加功能#
- 编写指令时,列举每个图像的角色和要保留的确切特征:材料、颜色、图案、轮廓和比例。
- 保持参考间的相机角度、时间和照明方向一致,以获得更自然的合成。
- 对于室内设计,选择一个基础房间作为环境,并将家具或装饰视为要放置的对象;对于服装,使用一个人体模型或模特作为基础,并提供服装作为对象参考。
- 如果看到重复或拼贴伪影,加强
negative_prompt,使用“无重复,无拼贴”等词,并明确说明对象数量。 - 对于两种模式使用潜在开关:空白潜在用于探索性布局,参考潜在用于精确放置。
- 使用固定的
seed锁定一个有希望的外观,然后通过仅更改指令或一次交换一个参考来创建变化。 - 使用
SaveImage文件名前缀按场景组织结果,以便迭代结果易于比较。
有关此Qwen Image 2.1 多图像编辑工作流程中使用的模型家族和权重的背景,请参阅官方资源:Qwen-Image-2.1 on Hugging Face, Qwen-Image-2.1-PE-I2I, 和项目库在GitHub。
致谢#
此工作流程实现并基于以下工作和资源。我们感谢RunningHub提供的工作流程来源,QwenLM (Qwen) 提供的Qwen-Image-2.1,以及Qwen提供的Qwen-Image-2.1-PE-I2I参考感知提示增强的贡献和维护。如需权威的详细信息,请参阅下方链接的原始文档和存储库。
资源#
- RunningHub/Workflow source
- 文档 / 发布说明: Workflow source
- Qwen/Qwen-Image-2.1
- Hugging Face: Qwen/Qwen-Image-2.1
- GitHub: QwenLM/Qwen-Image-2.1
- QwenLM/Qwen-Image-2.1
- GitHub: QwenLM/Qwen-Image-2.1
- Hugging Face: Qwen/Qwen-Image-2.1
- Qwen/Qwen-Image-2.1-PE-I2I
- Hugging Face: Qwen/Qwen-Image-2.1-PE-I2I
注意:使用引用的模型、数据集和代码需遵循其作者和维护者提供的各自许可证和条款。




