logo
RunComfy
  • ComfyUI
  • 训练器新
  • 模型
  • API
  • 定价
discord logo
模型
探索
所有模型
资源库
生成记录
模型 API
API 文档
API 密钥
账户
使用情况

Qwen Image Edit 2511:保持结构与主体一致性的图像编辑 | RunComfy

qwen/qwen-image/qwen-image-edit-2511

Qwen Image Edit 2511 可快速完成保持结构和主体一致性的图像编辑,精准处理多语言文字,并通过 API 接入产品、肖像和营销视觉工作流。

Image 1
Image 2
执行推理的步数。
控制生成结果遵循提示词的强度。
生成图像的文件格式。
Idle
The rate is $0.03 per image.

Qwen Image Edit 2511 简介

Alibaba 推出的 Qwen Image Edit 2511 按每张图像 $0.03 计费,最多支持 3 张输入图像,并能在编辑时保持画面结构与主体身份一致。它以语义和外观编辑取代手动蒙版及跨应用反复操作,在维持几何关系和人物、商品一致性的同时,精准控制中英文图中文字。电商、设计和营销团队因此可以减少前期设置与反复修改。开发者既可在 RunComfy 浏览器界面中使用,也可通过 HTTP API 接入,无需自行部署或扩缩模型。

适合:高保真产品样机 | 保持人物一致性的团队肖像更新 | 精准修改图中文字

X 上的 Qwen Image Edit 2511:社区与动态

模型概览#


  • 提供方: Alibaba / Tongyi Qianwen Team
  • 任务: image-to-image
  • 最大分辨率/时长: 支持预设宽高比
  • 简介: Qwen Image Edit 2511 是一款快速、理解画面结构并能稳定保持主体一致性的图像编辑模型。它支持语义编辑与外观编辑、多图参考和内置社区 LoRA 风格,适合产品图、肖像和营销素材。反复修改时,模型可减少画面漂移,增强多人一致性并保持稳定的几何关系。

核心能力#


多人编辑时保持主体一致#

  • 编辑单人或多人画面时,尽量保持人物特征和跨图一致性。
  • 减少画面漂移并保留未指定修改的区域,让肖像和合影编辑更稳定。

精准替换图内中英文文字#

  • 编辑或替换中文、英文文字时,尽量保留原有字体、字号和样式。
  • 减少包装、横幅和 UI 样机中的文字伪影,保持排版完整性。

理解结构的语义与外观控制#

  • 在遵循场景结构和几何关系的前提下修改姿势、风格或局部外观。
  • 最多支持 3 张输入图像用于风格和构图参考,提升工业设计、产品设计中的空间一致性。

输入参数#


核心提示词#

参数类型默认值/范围说明
promptstring""用自然语言描述编辑目标,并明确说明需要修改和保留的内容。
negative_promptstring""指定输出中需要避免的元素,例如“不要模糊”“不要水印”。

图像输入#

参数类型默认值/范围说明
image_urlsarray (image URIs)[]最多输入 10 张图像。第一张是待编辑的基础图,其余图像用于引导风格或构图。

尺寸与生成设置#

参数类型默认值/范围说明
image_sizestringsquare; presets: square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3, landscape_16_9选择预设宽高比。
num_inference_stepsinteger28扩散步数。提高数值通常能增强细节保真度,降低数值则可加快生成。
guidance_scalefloat4.5控制结果遵循提示词的强度。数值越高,指令约束越强,但创作自由度可能降低。
output_formatstringpng; options: jpeg, png, webp输出图像格式,请根据后续工作流选择。

Qwen Image Edit 2511 与其他模型的对比#


  • 对比 Qwen Image Edit 2509: Qwen Image Edit 2511 可进一步减少主体漂移,增强多人一致性,并提供内置社区 LoRA 风格与更强的几何推理。需要在多轮修改中稳定保持人物和结构时,更适合选择 2511。
  • 对比 Nano Banana Pro: Qwen Image Edit 2511 更擅长中英文文字编辑、主体一致性和多图融合。若希望用更少尝试获得高度写实的光线和干净边缘,Nano Banana Pro 仍可能更有优势;若更看重文字控制与跨图一致性,则可选择 2511。
  • 对比 Seedream 4.5: Qwen Image Edit 2511 在文字保留和主体一致性方面更稳定。Seedream 更擅长高分辨率风格化;需要在保持排版和结构的同时精准编辑时,可选择 2511。
  • 对比 Flux 2: Qwen Image Edit 2511 在严格控制几何关系的精细编辑中更不易产生伪影。Flux 系列偏重表现力丰富的风格化;产品设计、姿势调整和局部外观修改更适合 2511。
  • 对比 Z-Image-Turbo: Qwen Image Edit 2511 计算开销更高,但对结构、主体一致性和文字保真度的控制更严格。优先考虑速度和效率时可选 Z-Image-Turbo,优先考虑一致性和编辑精度时可选 2511。

API 集成#


开发者可通过标准 HTTP 请求调用 RunComfy API 中的 Qwen Image Edit 2511。提交基础图像、prompt 和 negative_prompt,并调整 num_inference_steps、guidance_scale、seed、output_format,即可获得一致、精细的编辑结果。接口支持基于 REST 的自动化,便于接入生产工作流。


注意:Qwen Image Edit 2511 API 端点


官方资源与许可#


  • Hugging Face: https://huggingface.co/Qwen/Qwen-Image-Edit-2511
  • 许可: 请以 Hugging Face 模型卡中的最新许可条款为准。商业使用可能需要单独签署协议。

相关模型

wan-2.7/text-to-image

WAN 2.7 文生图:精准理解提示词,提供多种尺寸预设,每次最多生成 5 张图像

nano-banana-2/edit

使用 Nano Banana 2 Edit 进行提示词驱动的图像编辑,支持多图输入,并可控制宽高比、分辨率、安全容忍度和输出选项。

longcat-image/edit

根据文字提示词编辑 1 张源图片,并可设置推理步数、引导强度、随机种子以及 JPEG、PNG 或 WebP 输出。

flux-2/pro/edit

通过文字指令和最多 10 张源图进行图像编辑,并可选择七种尺寸以及 JPEG 或 PNG 输出。

nano-banana-2/text-to-image

使用 Nano Banana 2 进行快速、高质量的文生图,支持宽高比、安全容忍度和输出格式控制。

qwen-edit-2509/lora/inscene

根据提示词修改现有场景中的元素,并设置尺寸、步数、引导强度、生成数量、格式和随机种子。

常见问题

Qwen Image Edit 2511 是什么?相比此前版本有哪些提升?

Qwen Image Edit 2511 是一款拥有 200 亿参数的图像编辑模型,重点提升了一致性和几何精度。它能更稳定地保持单人或多人身份特征,提高文字编辑保真度,并将社区 LoRA 风格直接集成到基础模型中,因此相较 2509 等早期 Qwen 版本更适合连续、精细的编辑任务。

Qwen Image Edit 2511 有哪些技术限制?

单次编辑支持的最大输出分辨率约为 4096×4096 像素,最多可使用 3 张参考图像。提示词长度约限于 1,024 个 token;API 请求超过这些限制时,可能会被截断或自动缩放。

Qwen Image Edit 2511 支持多图参考吗?最多可以输入几张?

支持。单次图像编辑最多可使用 3 张源图,用于融合或转换不同人物、商品的特征。模型通过类似 ControlNet 的条件控制和并行适配器整合细节,提升各参考图之间的一致性。

如何从 RunComfy 模型页面 测试过渡到 API 生产集成?

先在 RunComfy 模型页面 网页界面中使用 Qwen Image Edit 2511 确定提示词和参数,再从账户控制台生成访问密钥,即可通过 API 自动执行相同的提示词与控制设置。生产环境的扩展方式可参阅 RunComfy 文档中的“API Integration”部分。

与 Seedream 4.5 或 Flux 2 相比,Qwen Image Edit 2511 的图像编辑质量有何优势?

Qwen Image Edit 2511 在工业设计、产品设计和大量文字编辑中更能保持结构稳定。Seedream 4.5 擅长艺术化放大和风格化,而 Qwen Image Edit 2511 在多轮编辑中对文字、几何关系和主体身份的保持更可靠。

Qwen Image Edit 2511 与 Nano Banana Pro 在写实度和稳定性方面有何区别?

在追求极致写实光照或通过简短提示词完成小幅修改时,Nano Banana Pro 可能略有优势。Qwen Image Edit 2511 则能减少画面漂移,并提高多人一致性,尤其适合结构调整和要求文字排版准确的编辑任务。

Qwen Image Edit 2511 可以商用吗?需要注意哪些许可问题?

使用时需遵守 RunComfy 的托管模型条款。将生成结果用于商业项目之前,开发者还应查看 Alibaba 或 Tongyi-Lab 的原始许可,重点确认署名和衍生作品方面的限制。

Qwen Image Edit 2511 对合成或产品样机制作有哪些帮助?

它能在保持场景几何关系的同时完成物体插入、背景替换和光线一致性优化,适合电商素材、产品设计迭代,以及需要在整套营销活动中保持内容一致的工作流。

Qwen Image Edit 2511 如何减少连续编辑中的“身份漂移”?

模型采用双编码管线,将语义嵌入与 VAE 的视觉特征直接对齐。这样可以减少多轮编辑中人脸或品牌特征不一致的问题,比此前的 Qwen 版本更稳定地保持主体特征。

Qwen Image Edit 2511 如何处理图像中的文字?

编辑或替换文字时,模型会尽量保留原有字体、字号和样式,从而实现较为精准的排版对齐。这项能力尤其适合 UI/UX 和平面设计团队。

关注我们
  • 领英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 电子邮件
  • 系统状态
  • 附属
视频模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
图像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服务条款
  • 隐私政策
  • Cookie 政策
RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。

Qwen Image Edit 2511 输出示例