Qwen Image 3.0 Edit:基于指令的AI图像编辑,最高可达2K
Qwen Image 2512 是 RunComfy 提供的文生图模型,可根据 prompt 和可选的 negative_prompt 生成一张高质量静态图像。它适合创意设计、营销素材、含文字海报和写实场景。
输出格式: square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3, landscape_16_9
| Parameter | 必填 | Type | Default | Range / Options | 说明 |
|---|---|---|---|---|---|
| prompt* | 是 (*) | string | — | — | 用于生成图像的提示词。 |
| negative_prompt | 否 | string | "" | — | 可选内容,用于弱化或避免图像中的指定元素。 |
| image_size | 否 | ImageSize | Enum or object | landscape_4_3 | Enum: square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3, landscape_16_9. |
| num_inference_steps | 否 | integer | 28 | — | 推理步数;提高数值可能增加细节,但也会降低速度。 |
| guidance_scale | 否 | float | 5 | — | 提示词引导强度;中等数值通常能平衡准确度与创作空间。 |
| seed | 否 | integer | — | — | 固定随机种子,可在相同设置下复现结果。 |
| output_format | 否 | OutputFormatEnum | "png" | jpeg, png, webp | 结果图像的文件格式。 |
Qwen Image 3.0 Edit:基于指令的AI图像编辑,最高可达2K
根据必填提示词编辑或融合 1–10 张必填 JPEG 或 PNG 图像。可选择 `1K`、`2K`、`4K` 或八种固定分辨率。
基于 LoRA 的图像编辑模型,可在保持结构和主体一致性的同时精准修改创意素材。
根据文本提示词生成图片,并设置宽高比和随机种子。
根据文本生成精致图像,通过精准细节与灵活风格控制服务设计工作流。
通过丰富的风格、尺寸与配色设置,生成位图、数字插画或矢量风格图片。
在 RunComfy 模型页面 完成测试后,开发者可沿用相同的模型配置接入 RunComfy API。创建 API 密钥后,即可通过代码设置生成参数并管理用量与成本;生产部署时还应确认 Qwen Image 2512 的 Apache 2.0 许可要求。
模型能够较准确地呈现中文和英文文字,支持多行段落以及中英文混排的海报设计。它具备版式理解能力,即使面对复杂设计,也能更好地保持文字对齐并减少变形。
它能细致表现不同肤色、头发纹理、人物姿态,同时保持图内文字清晰可读,因此适合同时追求写实人物与准确排版的杂志封面、广告和信息图。
部分模型更侧重写实风格或 4K 输出,而 Qwen Image 2512 强调准确文字、自然纹理与生成速度之间的平衡。相关基准结果显示,它在中英文内容的版式对齐方面优于同类开源方案。
它适合需要制作高质量多语言信息图、海报和广告素材的创意机构、教育团队与出版商。模型兼具专业级真实感和生成灵活性,可用于早期原型,也可用于规模化生产。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。





