依提示詞編輯圖像,可選使用遮罩,並設定長寬比。
Qwen Image 2512 是 RunComfy 提供的文生圖模型,可根據 prompt 和可選的 negative_prompt 生成一張高品質靜態圖片。它適合創意設計、行銷素材、含文字海報和寫實場景。
輸出格式: square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3, landscape_16_9
| Parameter | 必填 | Type | Default | Range / Options | 說明 |
|---|---|---|---|---|---|
| prompt* | 是 (*) | string | — | — | 用於生成圖片的提示詞。 |
| negative_prompt | 否 | string | "" | — | 可選內容,用於減少或避免圖片中的指定元素。 |
| image_size | 否 | ImageSize | Enum or object | landscape_4_3 | Enum: square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3, landscape_16_9. |
| num_inference_steps | 否 | integer | 28 | — | 推論步數;提高數值可能增加細節,但也會降低速度。 |
| guidance_scale | 否 | float | 5 | — | 提示詞引導強度;中等數值通常能平衡準確度與創作空間。 |
| seed | 否 | integer | — | — | 固定隨機種子,可在相同設定下重現結果。 |
| output_format | 否 | OutputFormatEnum | "png" | jpeg, png, webp | 結果圖片的檔案格式。 |
依提示詞編輯圖像,可選使用遮罩,並設定長寬比。
根據一張控制圖片產生新圖,支援最多 3 個 LoRA、4 種預處理模式、分階段 ControlNet 控制及 1–8 個推理步。
透過精細的提示詞控制,生成寫實且文字呈現準確的圖片。
基於 LoRA 的圖片編輯模型,可在維持結構和主體一致性的同時精準修改創意素材。
Flux 2 Flash Edit 可依照明確的文字指令編輯最多 4 張參考圖,並精確控制尺寸和輸出格式。
根據必填提示詞產生 1–4 張圖片,並可選擇 10 種長寬比、1K/2K/4K 解析度、三種檔案格式和同步傳回模式。
在 RunComfy 模型頁面 完成測試後,開發者可沿用相同的模型設定串接 RunComfy API。建立 API 金鑰後,即可透過程式設定生成參數並管理用量與成本;正式部署時還應確認 Qwen Image 2512 的 Apache 2.0 授權要求。
模型能夠較準確地呈現中文和英文文字,支援多行段落和中英文混排海報。它具備版面理解能力,即使面對複雜設計,也能更好地維持文字對齊並減少變形。
它能細緻呈現不同膚色、頭髮紋理、人物姿勢,同時維持圖片內文字清晰可讀,因此適合同時追求寫實人物與準確排版的雜誌封面、廣告和資訊圖表。
部分模型更著重寫實風格或 4K 輸出,而 Qwen Image 2512 強調準確文字、自然紋理與生成速度之間的平衡。相關基準結果顯示,它在中英文內容的版面對齊方面優於同類開源方案。
它適合需要製作高品質多語言資訊圖表、海報和廣告素材的創意機構、教育團隊與出版商。模型兼具專業級真實感和生成彈性,可用於早期原型,也可用於規模化製作。
RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。





