快速、低成本的提示词图像编辑模型,以固定 1K 分辨率输出。
prompt 和 image_urls 为必填项。image_urls 可填写 1–10 个图片 URL。image_size 提供 auto、square_hd、square、portrait_4_3、portrait_16_9、landscape_4_3 和 landscape_16_9,默认为 auto。enable_prompt_expansion 默认为 true。seed 是整数,默认值为 0。output_format 支持 jpeg 和 png,默认为 jpeg。guidance_scale 范围为 1.5–10,默认值为 3.5。num_inference_steps 范围为 2–50,默认值为 28。提供服务可访问的图片 URL,并明确说明要修改什么、希望保留什么。选择 auto 时由模型决定尺寸,也可以从 6 个固定值中选择。如果提示词扩展加入了不需要的细节,可比较开启和关闭后的结果。使用同一种子测试引导强度或步数,并检查每张输出是否出现意外变化。
如需在没有原始图片的情况下生成,请使用 Flux 2 Flex Text-to-Image。
快速、低成本的提示词图像编辑模型,以固定 1K 分辨率输出。
Qwen Image 2.1:统一的生成、编辑与透明性
用简短文字指定目标,对图片中的相应区域进行分割。
高精度文本到图像,提供精美的生产级视觉效果。
将图像分解为可编辑的 RGBA 图层,实现精准对象隔离和灵活设计控制。
根据文本生成精致图像,通过精准细节与灵活风格控制服务设计工作流。
它根据文字提示词编辑一张或多张原始图片。
prompt 和 image_urls 都是必填项。
image_urls 至少要有 1 个 URL,最多可有 10 个。
可选 auto、square_hd、square、portrait_4_3、portrait_16_9、landscape_4_3 和 landscape_16_9,默认为 auto。
设为 enable_prompt_expansion: true 时,模型会扩展提示词。默认值为 true。
支持 jpeg 和 png,默认为 jpeg。
guidance_scale 范围为 1.5–10,num_inference_steps 范围为 2–50,默认值分别为 3.5 和 28。
seed 是整数,默认值为 0。
写清需要修改的对象、目标变化和希望保留的部分,并在生成后检查结果。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。