logo
RunComfy
  • ComfyUI
  • 训练器新
  • 模型
  • API
  • 定价
discord logo
模型
探索
所有模型
资源库
生成记录
模型 API
API 文档
API 密钥
账户
使用情况

Qwen Image 2.1:在 Models and API 上进行文字到图像和图像编辑 | RunComfy

qwen/qwen-image-2.1/edit

Qwen Image 2.1 从文本中撰写静帧并编辑多达十条参考文献,具有本地透明度,1K 或 2K 输出,以及种子锁定。

Image 1
一到十张参考图片。顺序与提示匹配(第一张图片,第二张图片)。JPEG、PNG或WebP;每个文件最大30MB和25MP。在需要保持身份清晰时,保持四张或更少。
用简单的语言描述更改:添加、删除、重新设计或替换的内容。引用任何文本以逐字呈现。对于遮罩,描述白色区域中应出现的内容。
可选的黑白本地编辑蒙版。白色标记要更改的区域;黑色保持不变。需要恰好一张参考图像,不能与透明背景配合使用,并且忽略纵横比和提示重写。
输出宽高比。自动使用第一个参考。在蒙版模式下忽略。
输出细节级别。1K 更快;2K 的像素大约是前者的四倍,成本更高。
对于普通照片是不透明的。透明会写入真实的 alpha 通道——只描述主体,不要使用 JPEG。不能与蒙版结合使用。
PNG 和 WebP 可以携带 alpha 通道。JPEG 不能,因此它不能与透明背景结合使用。
在编辑前,将简短的指令改写成更完整的情景。当指令已足够准确时,请关闭。在遮罩模式下忽略。
用于可重复性的随机种子。每次运行使用 -1 可生成随机种子。
Idle
The rate is $0.029 per 1K output image and $0.119 per 2K output image.

Qwen Image 2.1 入门

Qwen 的 Qwen Image 2.1 可以根据文本提示创建新的静态图像,并修改你上传的照片,同时在 1K 或 2K 下原生支持透明度。
它用一个紧凑的模型取代了单独的生成器和抠图工具,帮助设计师、营销人员和产品团队一起发布封面、目录框架和编辑内容。
对于开发者来说,RunComfy 上的 Qwen Image 2.1 可以在浏览器中使用,也可以通过 HTTP API 使用,因此你无需自行托管或扩展模型。
适用场景:文本生成图像海报 | 参考图像编辑 | 透明抠图

Qwen / Qwen Image 2.1#


这款紧凑型的稳定模型既可以根据文本生成新的图片,也可以修改已有的照片。一套 Qwen Image 2.1 权重涵盖从文本到图像和从图像到图像的功能,在 1K 或 2K,并可选择原生透明度。


仅提示生成无需上传。编辑则需要添加一到十张参考图片以及一条指令。本页面运行 Qwen Image 2.1 参考工作流程;一个兄弟页面运行仅提示生成。


亮点#


  • 文字生成图片:Qwen Image 2.1 将书面说明转化为完整的静态图像——海报、产品照片、人物肖像以及带可读文字的布局。
  • 图片生成图片:同一权重可以根据简单语言的指令重新布置照片:更换背景、重新设计产品或结合多个参考图片。
  • 原生透明:Qwen Image 2.1 可以返回 RGBA 贴纸、图标或产品剪影,或将主体从普通 RGB 照片中提取到透明图层。
  • 最多十个参考:将肖像合并成群体,给模特穿上服装照片中的服装,或用产品静物图片布置房间。
  • 局部区域控制:Qwen Image 2.1 可以遵循圆形、手绘标记或黑白蒙版。蒙版模式需要正好一个参考图片,并且不能与透明背景同时使用。
  • 人、产品和类型: 面孔、包装和标题更贴近简报,这有助于目录框架和封面。

Wider 的工作还可以与 Qwen Image 2.1 一起使用:将自拍照扩展为全景,将产品照片转换为信息图,或从三视图角色表创建故事板。


参数#


在此页面,Qwen Image 2.1 运行图像到图像。文本到图像使用相同的分辨率、比例、背景、格式、提示重写和种子选择,不使用参考图像或遮罩。


参数必填类型默认值范围 / 选项描述
image_urls*是 (*)数组示例图片1–10 张图片按提示顺序参考的图片。JPEG、PNG 或 WebP;每个文件最大 30MB 和 25MP。身份必须保持清晰时,请保持在四张或以下。
prompt*是 (*)字符串示例指令最多 5,000 个字符描述新的静态图像或编辑内容。引用任何图片上的文字。带蒙版时,描述白色区域应显示的内容。
mask_url否字符串(图片)—可选黑白本地编辑蒙版。白色表示修改,黑色表示保持。仅可使用一个参考图像。忽略纵横比和提示重写。不能与透明背景同时使用。
aspect_ratio否字符串autoauto, 1:1, 4:3, 3:4, 3:2, 2:3, 16:9, 9:16, 21:9, 9:21auto 会自动对齐到第一个参考。蒙版模式下忽略。文本生成图像默认 1:1。
resolution否字符串1K1K, 2K1K 更快;2K 像素大约是四倍,处理时间更长,尤其是有参考时。
background否字符串opaqueopaque, transparenttransparent 会为新的静态图片或剪辑生成真实的 alpha 通道。只描述主体。不能与 JPEG 配合使用。
output_format否字符串pngpng, webp, jpegPNG 和 WebP 可以包含 alpha。JPEG 不行。
enhance_prompt否布尔truetrue, false在生成或编辑前重写简短提示。当提示已经精确时关闭。在蒙版模式下忽略。
seed否整数-1-1 或 0–2147483647固定种子以重现结果;使用 -1 生成新的变化。

  • 必填字段。

定价#


在此图像到图像页面上,Qwen Image 2.1 是每张 1K 图像 $0.029,每张 2K 图像 $0.119。文本到图像在其单独页面上每张 1K 图像 $0.020,每张 2K 图像 $0.079。额外的参考资料不会增加标注的附加费。对于批量处理,将所选等级的费率乘以输出数量。


如何使用#


  1. 当你只有提示词时,使用 Qwen Image 2.1 进行文本生成图像;当你有照片需要修改时,则使用图像到图像功能。
  2. 对于新的静态图像,说明主体、场景、风格,以及用引号标注的任何确切措辞。
  3. 对于编辑,按提示顺序上传一到十个参考图像。
  4. 说明 Qwen Image 2.1 应该修改的内容以及应保留的内容。只有在需要移动某一区域时才添加遮罩,并在该模式下只使用单个参考图像。
  5. 选择 1K 可快速生成 Qwen Image 2.1 初稿,或选择 2K 获取交付细节。
  6. 选择纵横比,或者在编辑时保持自动模式,由第一张参考图像设定画面尺寸。
  7. 当需要抠图时,请要求 Qwen Image 2.1 输出透明背景。该输出需使用 PNG 或 WebP,而非 JPEG。
  8. 先生成,再逐条修改指令。若希望再次获得相同效果,请固定种子。

提示与参考技巧#


  • 对于新的静态图像,先描述主体,然后是照明、镜头,以及 Qwen Image 2.1 应该放置任何标题的位置。
  • 图片上的文字用引号标出,以便完全原样呈现。
  • 按顺序命名引用对象:“把第一张图片中的人放到第二张图片的房间里。”
  • 当身份或标志需要保持清晰时,将 Qwen Image 2.1 的引用次数控制在四次或以下。
  • 对于团体照或试穿照,使用风景比例(如 3:2 或 16:9)通常能容纳更多主体。
  • 对于透明剪影,仅描述主体。提到场景通常会让 Qwen Image 2.1 将背景重新填充。
  • 使用蒙版时,描述应出现在白色区域的内容。
  • 在固定种子上迭代:每次操作更改背景、服装或照明中的一项。

Qwen Image 2.1 接受中英文混合的提示词。简短、具体的名词比冗长的情绪板效果更好。


Qwen Image 2.1 与其他型号的比较#


  • 根据公开可得的信息,它在紧凑型开放式静态模型中尤为突出,因为生成、编辑和本地 RGBA 输出共享一组权重。
  • 与仅基于提示的生成器相比,它还可以接受多达十个参考,并可以用遮罩、圆形或涂画标记标记区域。
  • 专用抠图工具只会移除背景。Qwen Image 2.1 可以根据文本创建透明素材,或从照片中提取素材。
  • 对于单张没有类型和合成的真实感肖像,更大的封闭生成器在皮肤微细节上可能仍然占优势。

更多可尝试的模型#


如果Qwen Image 2.1不是正确的起点,请在RunComfy上比较这些模型:


  • Qwen Image 3.0 — 后期 Qwen 文本到图像静帧。
  • Qwen Image 3.0 Edit — 对 Qwen Image 3.0 权重的指令编辑。
  • Qwen Edit 2509 — 多图像编辑,带姿势和布局锁定。
  • Nano Banana Pro — 详细的文本到图像静帧。
  • Flux 2 Pro — 仅提示的工作室风格静帧。

官方资源#


  • Qwen: https://qwen.ai/
  • Qwen 博客 — Qwen Image 2.1: https://qwen.ai/blog?id=qwen-image-2.1
  • Hugging Face 权重: https://huggingface.co/Qwen/Qwen-Image-2.1
  • GitHub: https://github.com/QwenLM/Qwen-Image-2.1

相关模型

flux-2/flex/text-to-image

根据文字生成图片,并调整尺寸、提示词扩展、引导强度、步数、随机种子和格式。

seedream-4-0/edit-sequential

通过精准的风格与连贯控制,构建自然衔接的创意视觉序列。

longcat-image/text-to-image

根据文字生成图片,提供 6 个精确尺寸预设,并可设置推理步数、引导强度、随机种子以及 JPEG、PNG 或 WebP 输出。

qwen-image-3.0/text-to-image

Qwen Image 3.0:详细的文本到图像,排版清晰

grok-2/image

根据文字提示词生成图片,每次可输出 1–10 张。

ideogram-v2/generate

使用 6 种风格和 11 种宽高比,生成包含文字设计的视觉图片。

常见问题

在图像到图像的工作流程中,Qwen Image 2.1 用于什么?

Qwen Image 2.1 根据书面说明修改照片,同时保持身份、产品形状和布局。典型工作包括更换背景、虚拟试穿、群体拼接、本地图像修补以及透明产品裁剪。

Qwen Image 2.1 可以拍多少参考图像?

您可以上传一到十张参考图像。Qwen Image 2.1 会按数组顺序读取它们,因此提示中的“第一张图像”和“第二张图像”对应该列表。当需要保持面部或标志清晰时,请将数量保持在四张或以下。

Qwen Image 2.1 支持透明背景和主题剪切吗?

是的。将背景设置为透明,这样 Qwen Image 2.1 会写入真正的 alpha 通道,或者让它将一个普通 RGB 照片中的主体提取到一个透明图层上。使用 PNG 或 WebP;JPEG 无法携带 alpha,并且蒙版不能与透明背景结合。

在 Qwen Image 2.1 中,本地编辑和蒙版如何工作?

Qwen Image 2.1 可以跟随圆圈、绘制标记或单独的黑白蒙版(白色变化,黑色保持)。蒙版模式需要恰好一个参考图像,遵循该图像的比例,并忽略纵横比及提示重写。在白色区域描述应该出现的内容。

Qwen Image 2.1 支持哪些输出尺寸?

Qwen Image 2.1 提供 1K 或 2K 输出和包括自动、1:1、4:3、3:4、3:2、2:3、16:9、9:16、21:9 和 9:21 的纵横比。自动会对齐到第一个参考。请查看当前 RunComfy 参数面板以获取具体选项。

Qwen Image 2.1 能否根据文本生成图像并进行编辑?

是的。相同的 Qwen Image 2.1 权重处理文本到图像和图像到图像。此页面是编辑/参考工作流程;一个单独的文本到图像页面可以从提示生成,而无需上传照片。

开发者可以通过 RunComfy API 使用 Qwen Image 2.1 吗?

是的。在 RunComfy 模型界面中原型化一个编辑,然后通过 RunComfy HTTP API 调用相同的 Qwen Image 2.1 模型,使用相同的参数。您不需要自己托管或扩展模型。

Qwen Image 2.1 在 RunComfy 上多少钱?

代数会消耗美元或积分。Qwen Image 2.1 的费用是每 1K 输出图像 $0.029,每 2K 输出图像 $0.119。额外的参考资料不会在此页面增加列出的附加费;新用户通常会获得一笔免费试用额度进行测试。

关注我们
  • 领英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 电子邮件
  • 系统状态
  • 附属
视频模型
  • Runway Aleph 2
  • Wan 2.5
  • Wan 2.6 Flash
  • MiniMax H3 Max
  • Wan 3.0 Reference To Video
  • Seedance 2.5 Reference to Video 480p
  • 查看所有模型 →
图像模型
  • Wan 2.6 Image to Image
  • Seedream 5.0 Pro
  • Flux 2 Klein 9B
  • Nano Banana Pro
  • Nano Banana 2 Edit
  • Z Image Turbo LoRA
  • 查看所有模型 →
法律
  • 服务条款
  • 隐私政策
  • Cookie 政策
RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。

Qwen Image 2.1 的例子