根據文字提示建立新圖片,可選擇 6 個固定尺寸預設、隨機種子以及 JPEG 或 PNG 輸出。
| 參數 | 類型 | 預設值/範圍 | 說明 |
|---|---|---|---|
| prompt | string | "" | 用自然語言描述編輯目標,並明確說明需要修改和保留的內容。 |
| negative_prompt | string | "" | 指定輸出中需要避免的元素,例如「不要模糊」「不要浮水印」。 |
| 參數 | 類型 | 預設值/範圍 | 說明 |
|---|---|---|---|
| image_urls | array (image URIs) | [] | 最多輸入 10 張圖片。第一張是待編輯的基礎圖,其餘圖片用於引導風格或構圖。 |
| 參數 | 類型 | 預設值/範圍 | 說明 |
|---|---|---|---|
| image_size | string | square; presets: square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3, landscape_16_9 | 選擇預設長寬比。 |
| num_inference_steps | integer | 28 | 擴散步數。提高數值通常能增強細節保真度,降低數值則可加快生成。 |
| guidance_scale | float | 4.5 | 控制結果遵循提示詞的強度。數值越高,指令約束越強,但創作自由度可能降低。 |
| output_format | string | png; options: jpeg, png, webp | 輸出圖片格式,請依照後續工作流程選擇。 |
開發者可透過標準 HTTP 請求呼叫 RunComfy API 中的 Qwen Image Edit 2511。提交基礎圖片、prompt 和 negative_prompt,並調整 num_inference_steps、guidance_scale、seed、output_format,即可獲得一致、精細的編輯結果。介面支援以 REST 為基礎的自動化,方便串接正式工作流程。
注意:Qwen Image Edit 2511 API 端點
根據文字提示建立新圖片,可選擇 6 個固定尺寸預設、隨機種子以及 JPEG 或 PNG 輸出。
以 Dreamina 4.0 輕鬆完成高精度圖像轉圖像創作,呈現細膩且具風格的 4K 視覺效果,專為設計師而生。
使用 FLUX Kontext Max 依提示詞編輯圖像,並設定隨機種子與 9 種長寬比之一。
由參考圖片引導的圖片編輯,支援版面控制、圖層分離和多語言文字
使用 Imagen 4 Fast 依提示詞生成圖像,並設定負面提示詞、長寬比與隨機種子。
使用Nano Banana Pro將草圖轉化為精確的2K-4K視覺效果,智慧校正與無縫創意控制。
Qwen Image Edit 2511 是一款擁有 200 億參數的圖片編輯模型,重點提升了一致性和幾何精度。它能更穩定地維持單人或多人的身分特徵、提高文字編輯保真度,並將社群 LoRA 風格直接整合至基礎模型,因此比 2509 等早期 Qwen 版本更適合連續、精細的編輯工作。
單次編輯支援的最大輸出解析度約為 4096×4096 像素,最多可使用 3 張參考圖片。提示詞長度約限於 1,024 個 token;API 請求超過這些限制時,可能會被截斷或自動縮放。
支援。單次圖片編輯最多可使用 3 張來源圖片,用於融合或轉換不同人物、商品的特徵。模型透過類似 ControlNet 的條件控制和並行適配器整合細節,提升各參考圖片之間的一致性。
先在 RunComfy 模型頁面 網頁介面中使用 Qwen Image Edit 2511 確定提示詞和參數,再從帳戶控制台產生存取金鑰,即可透過 API 自動執行相同的提示詞與控制設定。正式環境的擴充方式可參閱 RunComfy 文件中的「API Integration」部分。
Qwen Image Edit 2511 在工業設計、產品設計和大量文字編輯中更能維持結構穩定。Seedream 4.5 擅長藝術化放大和風格化,而 Qwen Image Edit 2511 在多輪編輯中對文字、幾何關係和主體身分的維持更可靠。
在追求極致寫實光線或透過簡短提示詞完成小幅修改時,Nano Banana Pro 可能略有優勢。Qwen Image Edit 2511 則能減少畫面漂移並提高多人一致性,尤其適合結構調整和要求文字排版準確的編輯工作。
使用時需遵守 RunComfy 的託管模型條款。將生成結果用於商業專案之前,開發者還應查看 Alibaba 或 Tongyi-Lab 的原始授權,重點確認署名和衍生作品方面的限制。
它能在維持場景幾何關係的同時完成物件插入、背景替換和光線一致性最佳化,適合電商素材、產品設計迭代,以及需要在整套行銷活動中維持內容一致的工作流程。
模型採用雙編碼管線,將語意嵌入與 VAE 的視覺特徵直接對齊。這樣可以減少多輪編輯中人臉或品牌特徵不一致的問題,比先前的 Qwen 版本更穩定地維持主體特徵。
編輯或替換文字時,模型會盡量保留原有字型、字級和樣式,進而實現較精準的排版對齊。這項能力尤其適合 UI/UX 和平面設計團隊。
RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。






