根据必填提示词为一张源图重新布光或进行编辑,并可设置六种输出尺寸、推理步数、引导强度、1–4 张结果图、随机种子以及 JPEG/PNG 输出。
| Parameter | Type | Default/Range | 说明 |
|---|---|---|---|
| image_url | string | Required | 输入图片的 URL。 |
| prompt | string | Optional | 对图层结构和图像内容的引导。 |
| negative_prompt | string | Optional | 需要排除的元素。 |
| num_layers | integer | Default: 4; Range: 1-10 | 需要生成的 RGBA 图层数量。 |
| num_inference_steps | integer | Default: 28; Range: 1-50 | 推理步数。 |
| guidance_scale | float | Default: 5; Range: 1-20 | 结果遵循 prompt 的程度。 |
| seed | integer | Default: 0 | 用于复现结果的固定随机种子。 |
| output_format | string | Options: png, webp; Default: png | 输出图像格式;需要保留透明度时建议使用 png。 |
RunComfy API 与浏览器界面使用相同字段。image_url 为必填项,prompt 和 negative_prompt 为可选控制项。响应会返回生成的图层素材,可用于编辑器或自动化流程。
如需编辑平面图像中的局部区域,可使用 Qwen-Image-Edit-2509。
根据必填提示词为一张源图重新布光或进行编辑,并可设置六种输出尺寸、推理步数、引导强度、1–4 张结果图、随机种子以及 JPEG/PNG 输出。
精准中文渲染与多语种图像编辑,助力创意设计
4 步亚秒级文本到图像,具有即时准确的视觉效果
根据提示词编辑或转换最多 20 张参考图片,并设置生成数量、格式、宽高比和分辨率。
基于 LoRA 的图像编辑模型,可在保持结构和主体一致性的同时精准修改创意素材。
Seedream 5.0 Lite 将参考图像转化为布局精准、风格一致的设计,助力创意工作流。
它会把一张输入图像分解为多个语义独立的 RGBA 图层。每个图层都保留透明度,可分别移动、改色、编辑或合成。
该模型采用 Apache-2.0 许可证,可按许可证条款商用。你仍需拥有输入图片的合法使用权,并遵守内容中涉及的第三方知识产权。
num_layers 范围为 1-10,num_inference_steps 为 1-50,guidance_scale 为 1-20。接口没有开放分辨率设置或提示词 token 上限。
当前 schema 没有这些输入项。接口必须提供一个 image_url,并可选用 prompt 和 negative_prompt 引导图层分解。
先在 RunComfy 浏览器界面中测试参数,再通过该模型的 RunComfy API 接口使用相同字段。image_url 为必填,其他已公开控制项可按需添加。
已发布的模型说明采用带有 Layer3D RoPE 位置嵌入的 VLD-MMDiT 主干,用于在图层间共享上下文,同时保持语义元素分离。
它的 RGBA-VAE 在共享潜在空间中表示 RGB 与 RGBA 数据,有助于为各语义组件生成一致的 Alpha 信息,便于后续编辑与合成。
它可以把包含文字的区域分到可编辑图层,但文字准确度仍会随输入与设置而变化。重要排版在投入生产前应仔细检查。
常见用途包括对象隔离、品牌素材调整、UI 组件提取、背景替换、布局原型、动画准备和 VFX 合成。
Qwen Image Edit 修改平面图像中的选定区域;Qwen Image Layered 则把图像分解为多个 RGBA 图层,更适合反复进行图层级编辑与合成。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。





