WAN 2.7 文生图:精准理解提示词,提供多种尺寸预设,每次最多生成 5 张图像
| 参数 | 类型 | 默认值/范围 | 说明 |
|---|---|---|---|
| prompt | string | "" | 用自然语言描述编辑目标,并明确说明需要修改和保留的内容。 |
| negative_prompt | string | "" | 指定输出中需要避免的元素,例如“不要模糊”“不要水印”。 |
| 参数 | 类型 | 默认值/范围 | 说明 |
|---|---|---|---|
| image_urls | array (image URIs) | [] | 最多输入 10 张图像。第一张是待编辑的基础图,其余图像用于引导风格或构图。 |
| 参数 | 类型 | 默认值/范围 | 说明 |
|---|---|---|---|
| image_size | string | square; presets: square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3, landscape_16_9 | 选择预设宽高比。 |
| num_inference_steps | integer | 28 | 扩散步数。提高数值通常能增强细节保真度,降低数值则可加快生成。 |
| guidance_scale | float | 4.5 | 控制结果遵循提示词的强度。数值越高,指令约束越强,但创作自由度可能降低。 |
| output_format | string | png; options: jpeg, png, webp | 输出图像格式,请根据后续工作流选择。 |
开发者可通过标准 HTTP 请求调用 RunComfy API 中的 Qwen Image Edit 2511。提交基础图像、prompt 和 negative_prompt,并调整 num_inference_steps、guidance_scale、seed、output_format,即可获得一致、精细的编辑结果。接口支持基于 REST 的自动化,便于接入生产工作流。
注意:Qwen Image Edit 2511 API 端点
WAN 2.7 文生图:精准理解提示词,提供多种尺寸预设,每次最多生成 5 张图像
使用 Nano Banana 2 Edit 进行提示词驱动的图像编辑,支持多图输入,并可控制宽高比、分辨率、安全容忍度和输出选项。
根据文字提示词编辑 1 张源图片,并可设置推理步数、引导强度、随机种子以及 JPEG、PNG 或 WebP 输出。
通过文字指令和最多 10 张源图进行图像编辑,并可选择七种尺寸以及 JPEG 或 PNG 输出。
使用 Nano Banana 2 进行快速、高质量的文生图,支持宽高比、安全容忍度和输出格式控制。
根据提示词修改现有场景中的元素,并设置尺寸、步数、引导强度、生成数量、格式和随机种子。
Qwen Image Edit 2511 是一款拥有 200 亿参数的图像编辑模型,重点提升了一致性和几何精度。它能更稳定地保持单人或多人身份特征,提高文字编辑保真度,并将社区 LoRA 风格直接集成到基础模型中,因此相较 2509 等早期 Qwen 版本更适合连续、精细的编辑任务。
单次编辑支持的最大输出分辨率约为 4096×4096 像素,最多可使用 3 张参考图像。提示词长度约限于 1,024 个 token;API 请求超过这些限制时,可能会被截断或自动缩放。
支持。单次图像编辑最多可使用 3 张源图,用于融合或转换不同人物、商品的特征。模型通过类似 ControlNet 的条件控制和并行适配器整合细节,提升各参考图之间的一致性。
先在 RunComfy 模型页面 网页界面中使用 Qwen Image Edit 2511 确定提示词和参数,再从账户控制台生成访问密钥,即可通过 API 自动执行相同的提示词与控制设置。生产环境的扩展方式可参阅 RunComfy 文档中的“API Integration”部分。
Qwen Image Edit 2511 在工业设计、产品设计和大量文字编辑中更能保持结构稳定。Seedream 4.5 擅长艺术化放大和风格化,而 Qwen Image Edit 2511 在多轮编辑中对文字、几何关系和主体身份的保持更可靠。
在追求极致写实光照或通过简短提示词完成小幅修改时,Nano Banana Pro 可能略有优势。Qwen Image Edit 2511 则能减少画面漂移,并提高多人一致性,尤其适合结构调整和要求文字排版准确的编辑任务。
使用时需遵守 RunComfy 的托管模型条款。将生成结果用于商业项目之前,开发者还应查看 Alibaba 或 Tongyi-Lab 的原始许可,重点确认署名和衍生作品方面的限制。
它能在保持场景几何关系的同时完成物体插入、背景替换和光线一致性优化,适合电商素材、产品设计迭代,以及需要在整套营销活动中保持内容一致的工作流。
模型采用双编码管线,将语义嵌入与 VAE 的视觉特征直接对齐。这样可以减少多轮编辑中人脸或品牌特征不一致的问题,比此前的 Qwen 版本更稳定地保持主体特征。
编辑或替换文字时,模型会尽量保留原有字体、字号和样式,从而实现较为精准的排版对齐。这项能力尤其适合 UI/UX 和平面设计团队。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。






