ComfyUI>工作流>Qwen Image 2.1 ComfyUI 工作流:文本到图像

Qwen Image 2.1 ComfyUI 工作流:文本到图像

Workflow Name: RunComfy/Qwen-Image-2.1-text-to-image
Workflow ID: 0000...1519
使用 Qwen Image 2.1 将您的提示转换为详细的 2048x2048 图像。您可以塑造时尚人像、电影场景和产品概念。可以轻松调整提示和分辨率。重用种子以获得一致的结果。运行 INT8 以实现高效生成。将完成的艺术作品导出为 RGBA PNG 文件。

Qwen Image 2.1 Text To Image ComfyUI Workflow Workflow

Qwen Image 2.1 in ComfyUI | 2K INT8 Text-to-Image
Want to run this workflow?
  • Fully operational workflows
  • No missing nodes or models
  • No manual setups required
  • Features stunning visuals

Qwen Image 2.1 Text To Image ComfyUI Workflow Examples

qwen-image-2-1-in-comfyui-2k-int8-text-to-image-1519-example_01.webp
qwen-image-2-1-in-comfyui-2k-int8-text-to-image-1519-example_02.webp
qwen-image-2-1-in-comfyui-2k-int8-text-to-image-1519-example_03.webp
qwen-image-2-1-in-comfyui-2k-int8-text-to-image-1519-example_04.webp
qwen-image-2-1-in-comfyui-2k-int8-text-to-image-1519-example_05.webp
qwen-image-2-1-in-comfyui-2k-int8-text-to-image-1519-example_06.webp

Qwen Image 2.1 文本到图像 ComfyUI 工作流#

使用官方的 Qwen-Image-2.1 开放权重包将文本提示转换为详细的高分辨率图像,适用于 ComfyUI。此 Qwen Image 2.1 文本到图像 ComfyUI 工作流专为希望获得可重现结果和清晰输出的创作者设计,支持 INT8 推理以实现高效的 VRAM 使用,并保存干净的 RGBA PNG,非常适合时尚人像、电影静帧和精致的产品概念。

围绕简单的生成–解码–保存路径构建,工作流可以让您直接控制提示文本、种子和分辨率。保持固定种子以进行版本迭代,通过提示短语切换风格,并导出透明背景的资产以便设计流水线使用。

Comfyui Qwen Image 2.1 文本到图像 ComfyUI 工作流中的关键模型#

  • Qwen-Image-2.1 (Comfy-Org): 核心开放权重文本到图像模型,解释您的提示并在潜在空间中合成图像。它使用优化的 MMDiT 风格生成器,能够实现高保真细节和排版感知的构图。 Comfy-Org/Qwen-Image-2.1
  • Qwen-Image-2.1 VAE: 解码生成的潜在图像为像素的自动编码器。它在高分辨率下保持细节和色调一致性。与上述相同的模型包一起分发。
  • 官方模板(参考):可供您比较或根据需要调整的权威文本到图像图表。 image_qwen_image_2_1_t2i.json

如何使用 Comfyui Qwen Image 2.1 文本到图像 ComfyUI 工作流#

整体流程:提示和种子条件模型,采样器在潜在空间中生成图像,VAE 解码为像素,输出保存为 RGBA PNG。组从左到右运行,因此您可以快速预览和迭代。

提示和风格

  • 使用正向提示表达意图和艺术方向,使用负向提示避免伪影。对于时尚人像,参考灯光、相机角度、镜头和材质;对于电影画面,引导氛围和色彩分级;对于产品拍摄,指定表面、摄影棚灯光和反射。希望在提示调整中保持严格的可重现性时,保持稳定的种子。

分辨率和种子

  • 在采样前在分辨率节点中设置目标大小。工作流在 2048×2048 上使用 INT8 权重和批量大小 1 进行了验证,以便在现代 GPU 上实现可靠性。如果需要更快的预览,请降至 1024 或 1536,然后返回到 2048 进行最终渲染。种子是用户可见的,因此您可以锁定变化或随机探索。

模型加载

  • 模型组加载 Qwen-Image-2.1 INT8 权重和伴随的 VAE。除了选择正确的检查点外,不需要手动连接。提示被编码并传递给生成器,因此采样器拥有所需的文本条件和潜在画布。

采样

  • KSampler 阶段处理扩散轨迹。步骤和 CFG 是可见的,因此您可以在速度和对提示的遵从性之间取得平衡。包含采样器和调度器选择以进行风格控制和稳定性;从默认值开始,然后仅在需要不同外观或更严格的提示遵循时进行调整。

解码和保存

  • VAE 将最终潜在图像解码为图像,保存组将其写为 RGBA PNG。如果您的构图假设透明度(徽标、UI 叠加、产品剪裁),导出器会保留 alpha 通道,以便资产可以直接进入设计工具而无需额外的遮罩。

Comfyui Qwen Image 2.1 文本到图像 ComfyUI 工作流中的关键节点#

  • UNETLoader 加载实际执行生成的 Qwen-Image-2.1 INT8 扩散主干。在会话间保持指向 2.1 权重的一致性;仅在基准测试变体时切换。
  • CLIPLoader 或特定于模型的文本编码器加载器 初始化提示编码器,以便您的文本正确嵌入生成器。如果更改编码器,请稍微调整 CFG 并重新检查提示短语以保持相同的视觉意图。
  • EmptySD3LatentImage 定义潜在画布大小和批量。在此处将宽度和高度设置为 2048 × 2048 以进行最终渲染,然后向下调整以更快地草拟。在本机分辨率下保持批量大小 1 以避免 VRAM 压力。
  • KSampler 驱动扩散过程。使用步骤在速度和细节之间进行权衡,并调整 cfg 以紧缩或放松提示的遵从性。如果切换采样器或调度器,请进行小幅增量更改,并在固定种子上比较结果。
  • SaveImage 将解码的图像导出为 RGBA PNG,并使用您选择的命名模式。这样可以保留透明度以便合成,并确保在与固定种子和提示组合时的准确可重现性。

可选附加项#

  • 有效的提示模式:“35mm 时尚肖像,柔和边缘光,编辑风格,面料纹理细节,中性背景” 或 “电影宽幅拍摄,窗帘透过的体积光,青橙分级,高对比度” 或 “摄影棚产品渲染,光滑的陶瓷杯,三点光源,柔和的阴影在无缝纸上。”
  • 可重现性:在每次导出时记录提示、负向提示、种子和分辨率。使用固定种子进行小幅编辑是调整外观而不失去构图的最快方法。
  • 性能:INT8 权重减少 VRAM 使用,使 2048×2048 成为可能。对于内存较低的硬件,先在 1024 预览,然后在满意时放大或重新渲染到全尺寸。
  • 参考构建:如果您想比较节点结构或恢复默认设置,请从官方模板开始,并迁移您的提示和保存节点。 image_qwen_image_2_1_t2i.json
  • 模型包:使用维护的 Comfy-Org 分发以确保跨环境的一致行为。 Comfy-Org/Qwen-Image-2.1

致谢#

此工作流实施并基于以下作品和资源。我们对 Comfy.org 的 ComfyUI 发布文章,Comfy-Org 的 Qwen-Image-2.1 开放权重,以及 Comfy-Org 的官方文本到图像工作流模板的贡献和维护表示感谢。有关权威详情,请参阅下面链接的原始文档和存储库。

资源#

注意:引用模型、数据集和代码的使用需遵守其作者和维护者提供的各自许可和条款。

RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。