根据文字生成图片,并调整尺寸、提示词扩展、引导强度、步数、随机种子和格式。
这款紧凑型的稳定模型既可以根据文本生成新的图片,也可以修改已有的照片。一套 Qwen Image 2.1 权重涵盖从文本到图像和从图像到图像的功能,在 1K 或 2K,并可选择原生透明度。
仅提示生成无需上传。编辑则需要添加一到十张参考图片以及一条指令。本页面运行 Qwen Image 2.1 参考工作流程;一个兄弟页面运行仅提示生成。
Wider 的工作还可以与 Qwen Image 2.1 一起使用:将自拍照扩展为全景,将产品照片转换为信息图,或从三视图角色表创建故事板。
在此页面,Qwen Image 2.1 运行图像到图像。文本到图像使用相同的分辨率、比例、背景、格式、提示重写和种子选择,不使用参考图像或遮罩。
| 参数 | 必填 | 类型 | 默认值 | 范围 / 选项 | 描述 |
|---|---|---|---|---|---|
image_urls* | 是 (*) | 数组 | 示例图片 | 1–10 张图片 | 按提示顺序参考的图片。JPEG、PNG 或 WebP;每个文件最大 30MB 和 25MP。身份必须保持清晰时,请保持在四张或以下。 |
prompt* | 是 (*) | 字符串 | 示例指令 | 最多 5,000 个字符 | 描述新的静态图像或编辑内容。引用任何图片上的文字。带蒙版时,描述白色区域应显示的内容。 |
mask_url | 否 | 字符串(图片) | — | 可选 | 黑白本地编辑蒙版。白色表示修改,黑色表示保持。仅可使用一个参考图像。忽略纵横比和提示重写。不能与透明背景同时使用。 |
aspect_ratio | 否 | 字符串 | auto | auto, 1:1, 4:3, 3:4, 3:2, 2:3, 16:9, 9:16, 21:9, 9:21 | auto 会自动对齐到第一个参考。蒙版模式下忽略。文本生成图像默认 1:1。 |
resolution | 否 | 字符串 | 1K | 1K, 2K | 1K 更快;2K 像素大约是四倍,处理时间更长,尤其是有参考时。 |
background | 否 | 字符串 | opaque | opaque, transparent | transparent 会为新的静态图片或剪辑生成真实的 alpha 通道。只描述主体。不能与 JPEG 配合使用。 |
output_format | 否 | 字符串 | png | png, webp, jpeg | PNG 和 WebP 可以包含 alpha。JPEG 不行。 |
enhance_prompt | 否 | 布尔 | true | true, false | 在生成或编辑前重写简短提示。当提示已经精确时关闭。在蒙版模式下忽略。 |
seed | 否 | 整数 | -1 | -1 或 0–2147483647 | 固定种子以重现结果;使用 -1 生成新的变化。 |
在此图像到图像页面上,Qwen Image 2.1 是每张 1K 图像 $0.029,每张 2K 图像 $0.119。文本到图像在其单独页面上每张 1K 图像 $0.020,每张 2K 图像 $0.079。额外的参考资料不会增加标注的附加费。对于批量处理,将所选等级的费率乘以输出数量。
Qwen Image 2.1 接受中英文混合的提示词。简短、具体的名词比冗长的情绪板效果更好。
如果Qwen Image 2.1不是正确的起点,请在RunComfy上比较这些模型:
根据文字生成图片,并调整尺寸、提示词扩展、引导强度、步数、随机种子和格式。
通过精准的风格与连贯控制,构建自然衔接的创意视觉序列。
根据文字生成图片,提供 6 个精确尺寸预设,并可设置推理步数、引导强度、随机种子以及 JPEG、PNG 或 WebP 输出。
Qwen Image 3.0:详细的文本到图像,排版清晰
根据文字提示词生成图片,每次可输出 1–10 张。
使用 6 种风格和 11 种宽高比,生成包含文字设计的视觉图片。
Qwen Image 2.1 根据书面说明修改照片,同时保持身份、产品形状和布局。典型工作包括更换背景、虚拟试穿、群体拼接、本地图像修补以及透明产品裁剪。
您可以上传一到十张参考图像。Qwen Image 2.1 会按数组顺序读取它们,因此提示中的“第一张图像”和“第二张图像”对应该列表。当需要保持面部或标志清晰时,请将数量保持在四张或以下。
是的。将背景设置为透明,这样 Qwen Image 2.1 会写入真正的 alpha 通道,或者让它将一个普通 RGB 照片中的主体提取到一个透明图层上。使用 PNG 或 WebP;JPEG 无法携带 alpha,并且蒙版不能与透明背景结合。
Qwen Image 2.1 可以跟随圆圈、绘制标记或单独的黑白蒙版(白色变化,黑色保持)。蒙版模式需要恰好一个参考图像,遵循该图像的比例,并忽略纵横比及提示重写。在白色区域描述应该出现的内容。
Qwen Image 2.1 提供 1K 或 2K 输出和包括自动、1:1、4:3、3:4、3:2、2:3、16:9、9:16、21:9 和 9:21 的纵横比。自动会对齐到第一个参考。请查看当前 RunComfy 参数面板以获取具体选项。
是的。相同的 Qwen Image 2.1 权重处理文本到图像和图像到图像。此页面是编辑/参考工作流程;一个单独的文本到图像页面可以从提示生成,而无需上传照片。
是的。在 RunComfy 模型界面中原型化一个编辑,然后通过 RunComfy HTTP API 调用相同的 Qwen Image 2.1 模型,使用相同的参数。您不需要自己托管或扩展模型。
代数会消耗美元或积分。Qwen Image 2.1 的费用是每 1K 输出图像 $0.029,每 2K 输出图像 $0.119。额外的参考资料不会在此页面增加列出的附加费;新用户通常会获得一笔免费试用额度进行测试。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。





