Qwen Image 2.1 文本到图像 ComfyUI 工作流#
使用官方的 Qwen-Image-2.1 开放权重包将文本提示转换为详细的高分辨率图像,适用于 ComfyUI。此 Qwen Image 2.1 文本到图像 ComfyUI 工作流专为希望获得可重现结果和清晰输出的创作者设计,支持 INT8 推理以实现高效的 VRAM 使用,并保存干净的 RGBA PNG,非常适合时尚人像、电影静帧和精致的产品概念。
围绕简单的生成–解码–保存路径构建,工作流可以让您直接控制提示文本、种子和分辨率。保持固定种子以进行版本迭代,通过提示短语切换风格,并导出透明背景的资产以便设计流水线使用。
Comfyui Qwen Image 2.1 文本到图像 ComfyUI 工作流中的关键模型#
- Qwen-Image-2.1 (Comfy-Org): 核心开放权重文本到图像模型,解释您的提示并在潜在空间中合成图像。它使用优化的 MMDiT 风格生成器,能够实现高保真细节和排版感知的构图。 Comfy-Org/Qwen-Image-2.1
- Qwen-Image-2.1 VAE: 解码生成的潜在图像为像素的自动编码器。它在高分辨率下保持细节和色调一致性。与上述相同的模型包一起分发。
- 官方模板(参考):可供您比较或根据需要调整的权威文本到图像图表。 image_qwen_image_2_1_t2i.json
如何使用 Comfyui Qwen Image 2.1 文本到图像 ComfyUI 工作流#
整体流程:提示和种子条件模型,采样器在潜在空间中生成图像,VAE 解码为像素,输出保存为 RGBA PNG。组从左到右运行,因此您可以快速预览和迭代。
提示和风格
- 使用正向提示表达意图和艺术方向,使用负向提示避免伪影。对于时尚人像,参考灯光、相机角度、镜头和材质;对于电影画面,引导氛围和色彩分级;对于产品拍摄,指定表面、摄影棚灯光和反射。希望在提示调整中保持严格的可重现性时,保持稳定的种子。
分辨率和种子
- 在采样前在分辨率节点中设置目标大小。工作流在 2048×2048 上使用 INT8 权重和批量大小 1 进行了验证,以便在现代 GPU 上实现可靠性。如果需要更快的预览,请降至 1024 或 1536,然后返回到 2048 进行最终渲染。种子是用户可见的,因此您可以锁定变化或随机探索。
模型加载
- 模型组加载 Qwen-Image-2.1 INT8 权重和伴随的 VAE。除了选择正确的检查点外,不需要手动连接。提示被编码并传递给生成器,因此采样器拥有所需的文本条件和潜在画布。
采样
KSampler阶段处理扩散轨迹。步骤和 CFG 是可见的,因此您可以在速度和对提示的遵从性之间取得平衡。包含采样器和调度器选择以进行风格控制和稳定性;从默认值开始,然后仅在需要不同外观或更严格的提示遵循时进行调整。
解码和保存
- VAE 将最终潜在图像解码为图像,保存组将其写为 RGBA PNG。如果您的构图假设透明度(徽标、UI 叠加、产品剪裁),导出器会保留 alpha 通道,以便资产可以直接进入设计工具而无需额外的遮罩。
Comfyui Qwen Image 2.1 文本到图像 ComfyUI 工作流中的关键节点#
UNETLoader加载实际执行生成的 Qwen-Image-2.1 INT8 扩散主干。在会话间保持指向 2.1 权重的一致性;仅在基准测试变体时切换。CLIPLoader或特定于模型的文本编码器加载器 初始化提示编码器,以便您的文本正确嵌入生成器。如果更改编码器,请稍微调整 CFG 并重新检查提示短语以保持相同的视觉意图。EmptySD3LatentImage定义潜在画布大小和批量。在此处将宽度和高度设置为 2048 × 2048 以进行最终渲染,然后向下调整以更快地草拟。在本机分辨率下保持批量大小 1 以避免 VRAM 压力。KSampler驱动扩散过程。使用步骤在速度和细节之间进行权衡,并调整cfg以紧缩或放松提示的遵从性。如果切换采样器或调度器,请进行小幅增量更改,并在固定种子上比较结果。SaveImage将解码的图像导出为 RGBA PNG,并使用您选择的命名模式。这样可以保留透明度以便合成,并确保在与固定种子和提示组合时的准确可重现性。
可选附加项#
- 有效的提示模式:“35mm 时尚肖像,柔和边缘光,编辑风格,面料纹理细节,中性背景” 或 “电影宽幅拍摄,窗帘透过的体积光,青橙分级,高对比度” 或 “摄影棚产品渲染,光滑的陶瓷杯,三点光源,柔和的阴影在无缝纸上。”
- 可重现性:在每次导出时记录提示、负向提示、种子和分辨率。使用固定种子进行小幅编辑是调整外观而不失去构图的最快方法。
- 性能:INT8 权重减少 VRAM 使用,使 2048×2048 成为可能。对于内存较低的硬件,先在 1024 预览,然后在满意时放大或重新渲染到全尺寸。
- 参考构建:如果您想比较节点结构或恢复默认设置,请从官方模板开始,并迁移您的提示和保存节点。 image_qwen_image_2_1_t2i.json
- 模型包:使用维护的 Comfy-Org 分发以确保跨环境的一致行为。 Comfy-Org/Qwen-Image-2.1
致谢#
此工作流实施并基于以下作品和资源。我们对 Comfy.org 的 ComfyUI 发布文章,Comfy-Org 的 Qwen-Image-2.1 开放权重,以及 Comfy-Org 的官方文本到图像工作流模板的贡献和维护表示感谢。有关权威详情,请参阅下面链接的原始文档和存储库。
资源#
- Comfy.org/ComfyUI 发布文章
- 文档 / 发布说明:Comfy.org 博客文章
- Comfy-Org/官方 Comfy-Org Qwen-Image-2.1 权重
- Hugging Face: Comfy-Org/Qwen-Image-2.1
- Comfy-Org/官方文本到图像模板
- GitHub: Comfy-Org/workflow_templates
注意:引用模型、数据集和代码的使用需遵守其作者和维护者提供的各自许可和条款。








