Qwen Image 2.1 Edit ComfyUI 工作流程:从文本进行精确、参考引导的图像编辑#
此 Qwen Image 2.1 Edit ComfyUI 工作流程将自然语言指令和一个或多个视觉参考转化为忠实的图像编辑。它设计用于产品放置、照明和天气变化、风格转换、图像内文本替换和角色故事板。工作流程在应用请求的更改时保持原始场景构图,因此您的框架、透视和背景保持不变。
围绕统一的 Qwen-Image-2.1 模型构建,管道接受基准图像作为画布,以及可在提示中调用的可选参考图像。典型示例包括在房间中添加产品,将晴天照片转换为雨天,替换标签为新文本,或在面板间一致地携带角色。结果导出为准备共享的图像。
Comfyui Qwen Image 2.1 Edit ComfyUI 工作流程中的关键模型#
- Qwen-Image-2.1 扩散模型(UNet)。核心图像编辑器,根据您的指令和参考合成一致的更改。此工作流程使用为 ComfyUI 打包的 UNet 权重,可在官方权重库 Comfy-Org/Qwen-Image-2.1 中找到。
- Qwen3-VL 8B 文本图像编码器。将指令提示和链接的参考图像编码为驱动编辑的条件信号。编码器权重在相同的库下,位于 Comfy-Org/Qwen-Image-2.1 的 text_encoders 中提供。
- Qwen-Image-2.1 VAE。将图像压缩和解码为扩散模型使用的潜在空间,以确保高保真重建和稳定编辑。VAE 权重包含在 Comfy-Org/Qwen-Image-2.1 中。
如何使用 Comfyui Qwen Image 2.1 Edit ComfyUI 工作流程#
整体逻辑很简单:加载模型,设置画布大小,编码您的文本和参考,采样编辑并保存结果。以下组镜像图形组织,展示各部分如何组合在一起。
模型组#
此组加载为 Qwen Image 2.1 Edit ComfyUI 工作流程提供动力的 UNet、多模态编码器和 VAE。UNet 提供编辑能力,编码器将您的提示和参考图像转化为引导,而 VAE 在像素和潜在空间之间移动。这些加载器预填充为推荐的 Qwen-Image-2.1 权重,因此您可以开箱即用。高级用户可以交换同一系列的权重以提高速度或精度。应用缓存,因此重复运行同一模型时避免重新加载开销。
图像尺寸组#
此组确定编辑将针对的潜在画布。默认情况下,画布遵循基准图像的纵横比,以帮助保留构图和相机几何。如果启用自定义画布,工作流程将切换为用户指定的宽度和高度,用于正方形缩略图或垂直故事板等任务。为了获得最忠实的编辑,请设置接近模型使用的调整大小基准图像的自定义尺寸。大偏差可能会使编辑偏离原始框架。
条件组#
在这里,工作流程将文本指令与视觉上下文融合。将您的基准场景连接到 image_1,并将任何参考连接到额外的图像槽,然后在提示中使用 <image1>、<image2> 等标记引用它们。编码器构建正面和负面条件加上由基准图像告知的初始潜在,锚定编辑到您的构图。清晰、具体的提示效果最佳:描述要更改的内容、要保留的内容以及如何匹配透视、照明或材料。您可以包括诸如“无额外对象”或“无文本”之类的约束,以抑制不需要的伪影。
采样组#
此组从条件生成实际编辑。采样器解释步骤、引导强度和采样器或调度器选择,以平衡忠实度和创造性。低引导值倾向于保留输入,而高引导值推动更强烈的更改;中等步数通常足以获得干净的结果。采样后,VAE 将潜在解码为图像并保存输出。如果您需要严格的可重复性,请保持固定种子;如果您想要多样性,请随机化它。
Comfyui Qwen Image 2.1 Edit ComfyUI 工作流程中的关键节点#
Image Edit (Qwen Image 2.1) (#459) 这是将工作流程绑定在一起的前面板。它公开了指令字段、采样器控件、自定义尺寸切换以及基准场景和参考的图像输入。在提示中使用 <image1>、<image2> 等来明确地将指令绑定到连接的图像。将负面提示集中在您不想要的事物上(例如,“标志、水印、额外对象”)。结构镜像 Qwen-Image-2.1 的官方编辑模板,因此大多数任务无需更改图形即可工作 reference。
TextEncodeQwenImage21 (#474) 使用 Qwen3-VL 8B 编码器对文本和图像进行编码,并准备由基准图像引导的条件和初始潜在。这是工作流程学习需要保留和修改的元素的地方。保持参考在透视、材料和照明方面与目标结果视觉上接近。提供多个参考时,在提示中指出它们的角色以避免歧义。该节点使用 Comfy-Org/Qwen-Image-2.1 中捆绑的官方 Qwen-Image-2.1 编码器。
ResolutionSelector (#13) 提供方便的预设加上自定义画布的手动宽度和高度。当项目需要特定纵横比或像素大小时使用它,如市场方形或高故事板框架。为最大忠实于基准图像,请保持自定义尺寸接近模型对基准图像的内部调整大小。Qwen-Image-2.1 还支持直接 2K 输出;当您需要更高细节而无需后期上采样时,请使用此功能,如 Comfy-Org 权重页面中所述 reference。
ComfySwitchNode (#468) 控制采样器是接收来自基准图像的潜在还是由选择器调整的空画布的潜在。打开它以严格的自定义尺寸或关闭它以自动遵循基准图像几何。如果选择自定义画布,请避免与基准图像的调整大小尺寸有极端的偏离,否则编辑可能会漂移。此简单开关是移动在保留构图编辑和故意重新构图之间的关键。
KSampler (#458) 运行生成编辑的扩散过程。调整 steps 以获得细节和稳定性,调整 cfg 以确定提示对结果的指导强度;较低的引导通常更能保留输入,而较高的引导则实施更大更改。sampler_name 和 scheduler 影响纹理和收敛;提供的组合是 Qwen-Image-2.1 的实用默认值。固定 seed 以重现结果,或随机化以获得新变体。当更改几乎正确但不完美时,请在重写提示之前尝试小步数或引导微调。
SaveImageAdvanced (#461) 处理文件名前缀、格式和色彩空间,以便输出井井有条并准备共享。每个任务或镜头使用清晰、语义的前缀,以保持多次运行实验的整洁。迭代时,请考虑在前缀中嵌入关键运行信息,如场景或主题,以便稍后快速过滤。PNG 是安全的存档选择;仅在文件大小至关重要时切换到 JPEG。
可选附加功能#
- 产品放置的提示模式:“使用 <image1> 作为基准场景。将 <image2> 的 [object] 放在 [surface] 上。匹配 [lighting] 和 [perspective]。添加柔和的接触阴影。无额外对象,无文本。”
- 对于照明或天气变化,说明要保留的内容:“保留 <image1> 的构图和相机框架。转换为金色时间阳光 / 轻雨 / 阴天,同时匹配现有阴影。”
- 对于风格转换,要求材料或渲染变化,同时保持结构:“保留 <image1> 的布局。转换为水彩插画 / 电影级别 / 霓虹赛博朋克色彩调色板。”
- 对于图像内文本替换,要明确:“将 <image1> 上的标签替换为‘NEW TEXT’,相同的字体粗细和颜色,保留边缘和反射。”
- 对于角色故事板,提供多个面部或服装参考跨越 <image2>..<imageN>,并请求从面板到面板的一致身份。
此 Qwen Image 2.1 Edit ComfyUI 工作流程为您提供一个高效、构图感知的编辑器,响应精确的语言和具体的视觉提示。以清晰的提示、良好的参考和尊重基准图像的尺寸选择开始,然后通过小的采样器调整进行迭代以获得生产就绪的结果。
致谢#
此工作流程实现并基于以下作品和资源进行构建。我们感谢 Comfy-Org 提供 ComfyUI 工作流程源和官方图像编辑模板,感谢 Qwen 提供 Qwen-Image-2.1 模型和公告,以及感谢 Comfy-Org 托管 ComfyUI 模型权重的贡献和维护。有关权威详细信息,请参阅下面链接的原始文档和存储库。
资源#
- Comfy-Org/Workflow source
- 文档 / 发布说明:Workflow source
- Qwen/Qwen Image 2.1 announcement
- 文档 / 发布说明:Qwen Image 2.1 announcement
- Comfy-Org/ComfyUI model weights
- Hugging Face: Comfy-Org/Qwen-Image-2.1
- Comfy-Org/Official image editing template
- GitHub: Comfy-Org/workflow_templates
注:使用参考的模型、数据集和代码需遵循其作者和维护者提供的相应许可证和条款。








