根據 2000 字元以內的必填提示詞生成圖片。可填寫選填負面提示詞,並從 13 種輸出尺寸中選擇。
| 參數 | 類型 | 預設值/範圍 | 說明 |
|---|---|---|---|
| prompt | string | "" | 用自然語言描述編輯目標,並明確說明需要修改和保留的內容。 |
| negative_prompt | string | "" | 指定輸出中需要避免的元素,例如「不要模糊」「不要浮水印」。 |
| 參數 | 類型 | 預設值/範圍 | 說明 |
|---|---|---|---|
| image_urls | array (image URIs) | [] | 最多輸入 10 張圖片。第一張是待編輯的基礎圖,其餘圖片用於引導風格或構圖。 |
| 參數 | 類型 | 預設值/範圍 | 說明 |
|---|---|---|---|
| image_size | string | square; presets: square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3, landscape_16_9 | 選擇預設長寬比。 |
| num_inference_steps | integer | 28 | 擴散步數。提高數值通常能增強細節保真度,降低數值則可加快生成。 |
| guidance_scale | float | 4.5 | 控制結果遵循提示詞的強度。數值越高,指令約束越強,但創作自由度可能降低。 |
| output_format | string | png; options: jpeg, png, webp | 輸出圖片格式,請依照後續工作流程選擇。 |
開發者可透過標準 HTTP 請求呼叫 RunComfy API 中的 Qwen Image Edit 2511。提交基礎圖片、prompt 和 negative_prompt,並調整 num_inference_steps、guidance_scale、seed、output_format,即可獲得一致、精細的編輯結果。介面支援以 REST 為基礎的自動化,方便串接正式工作流程。
注意:Qwen Image Edit 2511 API 端點
根據 2000 字元以內的必填提示詞生成圖片。可填寫選填負面提示詞,並從 13 種輸出尺寸中選擇。
根據文字生成圖片,提供 6 個精確尺寸預設,並可設定推理步數、引導強度、隨機種子以及 JPEG、PNG 或 WebP 輸出。
根據必填提示詞編輯 1–10 張來源圖片,並可視需要套用最多三個 LoRA 項目。可選擇六種輸出尺寸,並可設定推理步數、引導強度、1–4 張結果、隨機種子以及 Default、JPEG 或 PNG 輸出。
根據文字指令編輯 1–10 張參考圖片,並選擇固定尺寸預設、隨機種子以及 JPEG 或 PNG 輸出。
支援中文的 AI 文字轉圖工具,精準生成高質感影像
依提示詞編輯或轉換最多 20 張參考圖片,並設定生成數量、格式、寬高比與解析度。
Qwen Image Edit 2511 是一款擁有 200 億參數的圖片編輯模型,重點提升了一致性和幾何精度。它能更穩定地維持單人或多人的身分特徵、提高文字編輯保真度,並將社群 LoRA 風格直接整合至基礎模型,因此比 2509 等早期 Qwen 版本更適合連續、精細的編輯工作。
單次編輯支援的最大輸出解析度約為 4096×4096 像素,最多可使用 3 張參考圖片。提示詞長度約限於 1,024 個 token;API 請求超過這些限制時,可能會被截斷或自動縮放。
支援。單次圖片編輯最多可使用 3 張來源圖片,用於融合或轉換不同人物、商品的特徵。模型透過類似 ControlNet 的條件控制和並行適配器整合細節,提升各參考圖片之間的一致性。
先在 RunComfy 模型頁面 網頁介面中使用 Qwen Image Edit 2511 確定提示詞和參數,再從帳戶控制台產生存取金鑰,即可透過 API 自動執行相同的提示詞與控制設定。正式環境的擴充方式可參閱 RunComfy 文件中的「API Integration」部分。
Qwen Image Edit 2511 在工業設計、產品設計和大量文字編輯中更能維持結構穩定。Seedream 4.5 擅長藝術化放大和風格化,而 Qwen Image Edit 2511 在多輪編輯中對文字、幾何關係和主體身分的維持更可靠。
在追求極致寫實光線或透過簡短提示詞完成小幅修改時,Nano Banana Pro 可能略有優勢。Qwen Image Edit 2511 則能減少畫面漂移並提高多人一致性,尤其適合結構調整和要求文字排版準確的編輯工作。
使用時需遵守 RunComfy 的託管模型條款。將生成結果用於商業專案之前,開發者還應查看 Alibaba 或 Tongyi-Lab 的原始授權,重點確認署名和衍生作品方面的限制。
它能在維持場景幾何關係的同時完成物件插入、背景替換和光線一致性最佳化,適合電商素材、產品設計迭代,以及需要在整套行銷活動中維持內容一致的工作流程。
模型採用雙編碼管線,將語意嵌入與 VAE 的視覺特徵直接對齊。這樣可以減少多輪編輯中人臉或品牌特徵不一致的問題,比先前的 Qwen 版本更穩定地維持主體特徵。
編輯或替換文字時,模型會盡量保留原有字型、字級和樣式,進而實現較精準的排版對齊。這項能力尤其適合 UI/UX 和平面設計團隊。
RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。






