logo
RunComfy
  • ComfyUI
  • 訓練器新
  • 模型
  • API
  • 定價
discord logo
模型
探索
所有模型
資源庫
生成記錄
模型 API
API 文檔
API 金鑰
帳戶
使用情況

Qwen Image Edit 2511:維持結構與主體一致性的圖片編輯 | RunComfy

qwen/qwen-image/qwen-image-edit-2511

Qwen Image Edit 2511 可快速完成維持結構和主體一致性的圖片編輯,精準處理多語言文字,並透過 API 串接產品、肖像和行銷視覺工作流程。

Image 1
Image 2
執行推理的步數。
控制生成結果遵循提示詞的強度。
生成圖片的檔案格式。
Idle
The rate is $0.03 per image.

Qwen Image Edit 2511 簡介

Alibaba 推出的 Qwen Image Edit 2511 按每張圖片 $0.03 計費,最多支援 3 張輸入圖片,並能在編輯時維持畫面結構與主體身分一致。它以語意和外觀編輯取代手動遮罩及跨應用程式反覆操作,在維持幾何關係和人物、商品一致性的同時,精準控制中英文圖片文字。電商、設計和行銷團隊因此可以減少前期設定與反覆修改。開發者既可在 RunComfy 瀏覽器介面中使用,也可透過 HTTP API 串接,無需自行部署或擴縮模型。

適合:高擬真產品模型 | 維持人物一致性的團隊肖像更新 | 精準修改圖片文字

X 上的 Qwen Image Edit 2511:社群與動態

模型概覽#


  • 提供方: Alibaba / Tongyi Qianwen Team
  • 任務: image-to-image
  • 最大解析度/時長: 支援預設長寬比
  • 簡介: Qwen Image Edit 2511 是一款速度快、能理解畫面結構並穩定維持主體一致性的圖片編輯模型。它支援語意編輯與外觀編輯、多圖參考和內建社群 LoRA 風格,適合產品圖、肖像和行銷素材。反覆修改時,模型可減少畫面漂移、增強多人一致性並維持穩定的幾何關係。

核心能力#


多人編輯時維持主體一致#

  • 編輯單人或多人畫面時,盡量維持人物特徵和跨圖一致性。
  • 減少畫面漂移並保留未指定修改的區域,讓肖像和團體照編輯更穩定。

精準替換圖片內的中英文文字#

  • 編輯或替換中文、英文文字時,盡量保留原有字型、字級和樣式。
  • 減少包裝、橫幅和 UI 模型中的文字瑕疵,維持排版完整性。

理解結構的語意與外觀控制#

  • 在遵循場景結構和幾何關係的前提下修改姿勢、風格或局部外觀。
  • 最多支援 3 張輸入圖片用於風格和構圖參考,提升工業設計、產品設計中的空間一致性。

輸入參數#


核心提示詞#

參數類型預設值/範圍說明
promptstring""用自然語言描述編輯目標,並明確說明需要修改和保留的內容。
negative_promptstring""指定輸出中需要避免的元素,例如「不要模糊」「不要浮水印」。

圖片輸入#

參數類型預設值/範圍說明
image_urlsarray (image URIs)[]最多輸入 10 張圖片。第一張是待編輯的基礎圖,其餘圖片用於引導風格或構圖。

尺寸與生成設定#

參數類型預設值/範圍說明
image_sizestringsquare; presets: square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3, landscape_16_9選擇預設長寬比。
num_inference_stepsinteger28擴散步數。提高數值通常能增強細節保真度,降低數值則可加快生成。
guidance_scalefloat4.5控制結果遵循提示詞的強度。數值越高,指令約束越強,但創作自由度可能降低。
output_formatstringpng; options: jpeg, png, webp輸出圖片格式,請依照後續工作流程選擇。

Qwen Image Edit 2511 與其他模型的比較#


  • 對比 Qwen Image Edit 2509: Qwen Image Edit 2511 可進一步減少主體漂移、增強多人一致性,並提供內建社群 LoRA 風格與更強的幾何推理。需要在多輪修改中穩定維持人物和結構時,更適合選擇 2511。
  • 對比 Nano Banana Pro: Qwen Image Edit 2511 更擅長中英文文字編輯、主體一致性和多圖融合。若希望用更少嘗試獲得高度寫實的光線和乾淨邊緣,Nano Banana Pro 仍可能更有優勢;若更重視文字控制與跨圖一致性,則可選擇 2511。
  • 對比 Seedream 4.5: Qwen Image Edit 2511 在文字保留和主體一致性方面更穩定。Seedream 更擅長高解析度風格化;需要在維持排版和結構的同時精準編輯時,可選擇 2511。
  • 對比 Flux 2: Qwen Image Edit 2511 在嚴格控制幾何關係的精細編輯中較不易產生瑕疵。Flux 系列偏重表現力豐富的風格化;產品設計、姿勢調整和局部外觀修改更適合 2511。
  • 對比 Z-Image-Turbo: Qwen Image Edit 2511 運算成本較高,但對結構、主體一致性和文字保真度的控制更嚴格。優先考量速度和效率時可選 Z-Image-Turbo,優先考量一致性和編輯精度時可選 2511。

API 整合#


開發者可透過標準 HTTP 請求呼叫 RunComfy API 中的 Qwen Image Edit 2511。提交基礎圖片、prompt 和 negative_prompt,並調整 num_inference_steps、guidance_scale、seed、output_format,即可獲得一致、精細的編輯結果。介面支援以 REST 為基礎的自動化,方便串接正式工作流程。


注意:Qwen Image Edit 2511 API 端點


官方資源與授權#


  • Hugging Face: https://huggingface.co/Qwen/Qwen-Image-Edit-2511
  • 授權: 請以 Hugging Face 模型卡中的最新授權條款為準。商業使用可能需要另行簽署協議。

相關模型

flux-2/max/text-to-image

根據文字提示建立新圖片,可選擇 6 個固定尺寸預設、隨機種子以及 JPEG 或 PNG 輸出。

dreamina-4-0/edit

以 Dreamina 4.0 輕鬆完成高精度圖像轉圖像創作,呈現細膩且具風格的 4K 視覺效果,專為設計師而生。

flux-1-kontext/max/edit

使用 FLUX Kontext Max 依提示詞編輯圖像,並設定隨機種子與 9 種長寬比之一。

seedream-5.0-pro/image-to-image

由參考圖片引導的圖片編輯,支援版面控制、圖層分離和多語言文字

imagen-4/fast/text-to-image

使用 Imagen 4 Fast 依提示詞生成圖像,並設定負面提示詞、長寬比與隨機種子。

nano-banana/pro/edit

使用Nano Banana Pro將草圖轉化為精確的2K-4K視覺效果,智慧校正與無縫創意控制。

常見問題

Qwen Image Edit 2511 是什麼?相較先前版本有哪些提升?

Qwen Image Edit 2511 是一款擁有 200 億參數的圖片編輯模型,重點提升了一致性和幾何精度。它能更穩定地維持單人或多人的身分特徵、提高文字編輯保真度,並將社群 LoRA 風格直接整合至基礎模型,因此比 2509 等早期 Qwen 版本更適合連續、精細的編輯工作。

Qwen Image Edit 2511 有哪些技術限制?

單次編輯支援的最大輸出解析度約為 4096×4096 像素,最多可使用 3 張參考圖片。提示詞長度約限於 1,024 個 token;API 請求超過這些限制時,可能會被截斷或自動縮放。

Qwen Image Edit 2511 支援多圖參考嗎?最多可以輸入幾張?

支援。單次圖片編輯最多可使用 3 張來源圖片,用於融合或轉換不同人物、商品的特徵。模型透過類似 ControlNet 的條件控制和並行適配器整合細節,提升各參考圖片之間的一致性。

如何從 RunComfy 模型頁面 測試過渡到 API 正式整合?

先在 RunComfy 模型頁面 網頁介面中使用 Qwen Image Edit 2511 確定提示詞和參數,再從帳戶控制台產生存取金鑰,即可透過 API 自動執行相同的提示詞與控制設定。正式環境的擴充方式可參閱 RunComfy 文件中的「API Integration」部分。

與 Seedream 4.5 或 Flux 2 相比,Qwen Image Edit 2511 的圖片編輯品質有何優勢?

Qwen Image Edit 2511 在工業設計、產品設計和大量文字編輯中更能維持結構穩定。Seedream 4.5 擅長藝術化放大和風格化,而 Qwen Image Edit 2511 在多輪編輯中對文字、幾何關係和主體身分的維持更可靠。

Qwen Image Edit 2511 與 Nano Banana Pro 在寫實度和穩定性方面有何差異?

在追求極致寫實光線或透過簡短提示詞完成小幅修改時,Nano Banana Pro 可能略有優勢。Qwen Image Edit 2511 則能減少畫面漂移並提高多人一致性,尤其適合結構調整和要求文字排版準確的編輯工作。

Qwen Image Edit 2511 可以商用嗎?需要注意哪些授權問題?

使用時需遵守 RunComfy 的託管模型條款。將生成結果用於商業專案之前,開發者還應查看 Alibaba 或 Tongyi-Lab 的原始授權,重點確認署名和衍生作品方面的限制。

Qwen Image Edit 2511 對合成或產品模型製作有哪些幫助?

它能在維持場景幾何關係的同時完成物件插入、背景替換和光線一致性最佳化,適合電商素材、產品設計迭代,以及需要在整套行銷活動中維持內容一致的工作流程。

Qwen Image Edit 2511 如何減少連續編輯中的「身分漂移」?

模型採用雙編碼管線,將語意嵌入與 VAE 的視覺特徵直接對齊。這樣可以減少多輪編輯中人臉或品牌特徵不一致的問題,比先前的 Qwen 版本更穩定地維持主體特徵。

Qwen Image Edit 2511 如何處理圖片中的文字?

編輯或替換文字時,模型會盡量保留原有字型、字級和樣式,進而實現較精準的排版對齊。這項能力尤其適合 UI/UX 和平面設計團隊。

關注我們
  • 領英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 電子郵件
  • 系統狀態
  • 附屬
視頻模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
影像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服務條款
  • 隱私政策
  • Cookie 政策
RunComfy
版權 2026 RunComfy. 保留所有權利。

RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。

Qwen Image Edit 2511 輸出範例