logo
RunComfy
  • ComfyUI
  • 訓練器新
  • 模型
  • API
  • 定價
discord logo
模型
探索
所有模型
資源庫
生成記錄
模型 API
API 文檔
API 金鑰
帳戶
使用情況

Qwen Image 2.1:在 Models and API 上的文字轉圖像與圖像編輯 | RunComfy

qwen/qwen-image-2.1/edit

Qwen Image 2.1 從文本中創作靜態圖像並編輯最多十個參考資料,具有本地透明度,1K 或 2K 輸出,以及種子鎖定。

Image 1
一到十張參考圖片。順序與提示相符(第一張圖片、第二張圖片)。JPEG、PNG 或 WebP;每個檔案最大 30MB 和 25MP。當需要保持身份清晰時,請保持四張或更少。
用簡單的語言描述變化:應添加、刪除、重新設計或更換什麼。引用任何文字以逐字呈現。使用遮罩時,描述白色區域應該出現的內容。
可選的黑白本地編輯遮罩。白色標記要更改的區域;黑色保持不變。需要恰好一張參考圖像,不能與透明背景搭配,並且會忽略長寬比和提示重寫。
輸出長寬比。自動使用第一個參考。在遮罩模式下忽略。
輸出細節層級。1K 較快;2K 的像素大約是四倍,但成本更高。
對於普通照片是不透明的。透明會寫入真正的 alpha 通道——僅描述主體,且不要使用 JPEG。不能與遮罩結合使用。
PNG 和 WebP 可以帶有 alpha 通道。JPEG 不可以,所以不能與透明背景結合。
在編輯之前,將簡短的指令改寫成更完整的情景。當指令已經非常準確時,關閉此功能。在遮罩模式下將被忽略。
用於可重現性的隨機種子。每次運行使用 -1 將產生隨機種子。
Idle
The rate is $0.029 per 1K output image and $0.119 per 2K output image.

Qwen Image 2.1 介紹

Qwen 的 Qwen Image 2.1 可以從文字提示創建新的靜態圖像,並修改你上傳的照片,在 1K 或 2K 擁有原生透明度。
它用一個緊湊的模型取代了獨立的生成器和剪裁工具,幫助設計師、市場營銷人員和產品團隊一起完成封面、目錄框架及編輯工作。
對開發者而言,RunComfy 上的 Qwen Image 2.1 可以在瀏覽器中使用,也可通過 HTTP API 使用,因此你不需要自行託管或擴展模型。
適用於:文字生成圖片的海報 | 參考圖像編輯 | 透明剪裁

Qwen / Qwen Image 2.1#


這款緊湊型的蒸餾模型既可以從文字生成新的圖像,也可以修改你已有的照片。一組 Qwen Image 2.1 權重涵蓋文字到圖像和圖像到圖像,版本為 1K 或 2K,可選擇本地透明度。


僅提示生成不需要上傳。編輯則需添加一到十張參考圖片以及一個指令。此頁面運行 Qwen Image 2.1 參考工作流程;一個兄弟頁面運行僅提示生成。


重點#


  • 文字生成圖片: Qwen Image 2.1 將書面簡要轉換為完成的靜態圖像——海報、產品照片、肖像以及可閱讀文字的版面設計。
  • 圖片生成圖片: 使用相同的模型權重,根據簡單語言的指示重新呈現照片:更換背景、重新設計產品或結合多個參考圖像。
  • 原生透明度: Qwen Image 2.1 可以輸出 RGBA 貼紙、圖示或產品切圖,或將主體從普通 RGB 照片中提取到透明圖層。
  • 最多十個參考: 將肖像合併為群體,根據服裝照片為模特換裝,或根據產品靜物照片布置房間。
  • 區域控制: Qwen Image 2.1 可以遵循圓形、手繪標記或黑白蒙版。蒙版模式僅能使用且需要恰好一個參考,且不能與透明背景配合使用。
  • 人物、產品與類型: 臉孔、包裝和標題更貼近簡報,這有助於目錄框架和封面的呈現。

Wider 工作還可以與 Qwen Image 2.1 一起使用:將自拍照擴展成全景圖,將產品照片轉換為資訊圖表,或從三視角角色表建立故事板。


參數#


在此頁面上,Qwen Image 2.1 運行圖像到圖像。文字到圖像使用相同的解析度、比例、背景、格式、提示重寫和種子選擇,無需參考圖像或遮罩。


參數必填類型預設值範圍 / 選項說明
image_urls*是 (*)陣列範例圖片1–10 張圖片按提示順序的參考圖片。JPEG、PNG 或 WebP;每個檔案最多 30MB 和 25MP。當需要保持身分清晰時,建議不要超過四張。
prompt*是 (*)字串範例指令最多 5,000 個字元描述新的靜態圖像或編輯內容。引用任何圖上文字。使用遮罩時,描述應出現在白色區域的內容。
mask_url否字串(圖像)—選填黑白本地編輯遮罩。白色區域會被修改,黑色保持不變。要求正好一張參考圖。忽略長寬比和提示重寫。不可與透明背景搭配。
aspect_ratio否字串autoauto,1:1,4:3,3:4,3:2,2:3,16:9,9:16,21:9,9:21auto 將捕捉至第一個參考點。在遮罩模式下會被忽略。文字生成圖片預設為 1:1。
resolution否字串1K1K,2K1K 速度較快;2K 像素大約多四倍,耗時較長,尤其是在有參考時。
background否字串opaqueopaque,transparenttransparent 會為新的靜態圖像或裁切圖寫入真實的 alpha 通道。只描述主題。不能與 JPEG 配對使用。
output_format否字串pngpng,webp,jpegPNG 和 WebP 可攜帶 alpha。JPEG 不行。
enhance_prompt否布林值truetrue,false在生成或編輯前重寫簡短提示。當提示已精確時請關閉。在遮罩模式下會被忽略。
seed否整數-1-1 或 0–2147483647固定種子以重現結果;使用 -1 以生成新的變化。

  • 必填欄位。

定價#


在這個圖像生成頁面上,Qwen Image 2.1 是 每張 1K 圖像 $0.029,以及 每張 2K 圖像 $0.119。文字生成圖像在其專屬頁面上是 每張 1K 圖像 $0.020,以及 每張 2K 圖像 $0.079。額外參考不會增加列出的附加費。若為批量操作,請將所選等級的費率乘以輸出數量。


如何使用#


  1. 當你只有提示詞時,使用 Qwen Image 2.1 做文字生成圖片;當你有照片需要修改時,使用圖片生成圖片。
  2. 若要創建新的靜態圖像,請命名主題、場景、風格,以及任何引用中的精確詞語。
  3. 若要編輯,按提示中提到的順序上傳一到十個參考圖。
  4. 說明 Qwen Image 2.1 應該改變什麼以及保留什麼。只有在需要移動單一區域時才添加遮罩,並在該模式下使用單一參考圖。
  5. 選擇 1K 做更快速的 Qwen Image 2.1 草稿,或選擇 2K 以獲得交付細節。
  6. 選擇長寬比,或在編輯時保持自動,這樣第一個參考圖就會設定畫框。
  7. 當需要裁切時,要求 Qwen Image 2.1 生成透明背景。該輸出需要 PNG 或 WebP,而不是 JPEG。
  8. 先生成結果,然後每次更改一條指令。若希望再次獲得相同的外觀,請固定種子。

提示與參考技巧#


  • 對於新的靜態圖像,先描述主體,然後是燈光、鏡頭,以及 Qwen Image 2.1 應放置任何標題的位置。
  • 圖像上的文字用引號標示,以便精確呈現。
  • 按順序命名參考:"將第一張圖像中的人物放入第二張圖像的房間中。"
  • 當身份或商標需保持清晰時,將 Qwen Image 2.1 的參考次數保持在四次或以下。
  • 對於群體照或試穿,使用 3:2 或 16:9 的橫向比例通常能容納更多主體。
  • 對於透明剪影,只描述主體。提及場景通常會讓 Qwen Image 2.1 將背景填充回去。
  • 使用遮罩時,描述白色區域中應顯示的內容。
  • 在固定種子上迭代:每次只改變背景、服裝或燈光中的一項。

Qwen Image 2.1 接受中英文混合的提示。簡短、具體的名詞比冗長的情緒板更好。


Qwen Image 2.1 與其他模型的比較#


  • 根據公開可得的資訊,它在緊湊型開放式靜態模型中脫穎而出,因為生成、編輯和原生 RGBA 輸出共用一組權重。
  • 與僅提示生成器相比,它還可以接受最多十個參考,並且可以使用遮罩、圓形或塗畫標記來針對區域。
  • 專用的剪裁工具僅能移除背景。Qwen Image 2.1 可以從文字創建透明資產,或從照片中提取資產。
  • 對於單張無類型且未合成的寫實人像,大型封閉生成器在皮膚微細節上仍可能佔優。

更多可嘗試的模型#


如果 Qwen Image 2.1 不是正確的起點,請比較這些模型在 RunComfy 的表現:


  • Qwen Image 3.0 — 後期 Qwen 文字轉圖片靜態影像。
  • Qwen Image 3.0 Edit — 對 Qwen Image 3.0 權重的指令編輯。
  • Qwen Edit 2509 — 多圖像編輯,帶姿勢與佈局鎖定。
  • Nano Banana Pro — 詳細文字轉圖片靜態影像。
  • Flux 2 Pro — 工作室風格僅提示靜態影像。

官方資源#


  • Qwen: https://qwen.ai/
  • Qwen 部落格 — Qwen Image 2.1: https://qwen.ai/blog?id=qwen-image-2.1
  • Hugging Face 權重: https://huggingface.co/Qwen/Qwen-Image-2.1
  • GitHub: https://github.com/QwenLM/Qwen-Image-2.1

相關模型

gpt-image-2.5/sunburst/edit

針對活動藝術作品和精美產品視覺效果進行精確的參考影像編輯。

seedream-4-0/edit

根據必填提示詞編輯或融合 1–10 張必填 JPEG 或 PNG 圖片。可選擇 `1K`、`2K`、`4K` 或八種固定解析度。

q2/text-to-image

根據文字產生圖片,可選擇 16:9、9:16 或 1:1 長寬比、1080p/2k/4k 輸出和隨機種子。

gpt-image-2.5/flare/edit

針對創作者內容、社交貼文和產品變體進行基於參考的快速圖像編輯。

dreamina-4-0/edit

以 Dreamina 4.0 輕鬆完成高精度圖像轉圖像創作,呈現細膩且具風格的 4K 視覺效果,專為設計師而生。

qwen-image-3.0/edit

Qwen Image 3.0 Edit:基於指令的AI影像編輯,最高可達2K

常見問題

Qwen Image 2.1 在圖像到圖像工作流程中有什麼用途?

Qwen Image 2.1 根據書面指示修改照片,同時保留身份、產品形狀和佈局。典型的工作包括背景替換、虛擬試穿、群體合成、局部修補以及透明產品剪裁。

Qwen Image 2.1 可以拍攝多少張參考圖片?

你可以上傳一到十張參考圖片。Qwen Image 2.1 會按陣列順序讀取它們,因此提示中的「第一張圖片」和「第二張圖片」會對應到該列表。在臉部或標誌需要保持清晰時,請將數量保持在四張或以下。

Qwen Image 2.1 是否支持透明背景和主體剪裁?

是的。將背景設置為透明,這樣 Qwen Image 2.1 才會寫入真正的 alpha 通道,或者要求它將主體從普通的 RGB 照片提取到透明圖層。使用 PNG 或 WebP;JPEG 無法攜帶 alpha,並且遮罩無法與透明背景合併。

Qwen Image 2.1 中的本地編輯和遮罩是如何運作的?

Qwen Image 2.1 可以跟隨圓圈、已繪製的標記或單獨的黑白遮罩(白色會改變,黑色保持不變)。遮罩模式需要正好一個參考圖像,遵循該圖像的比例,並忽略長寬比和提示改寫。請描述白色區域中應出現的內容。

Qwen Image 2.1 支援哪些輸出尺寸?

Qwen Image 2.1 提供 1K 或 2K 輸出以及包括自動、1:1、4:3、3:4、3:2、2:3、16:9、9:16、21:9 和 9:21 的長寬比。自動會自動對齊到第一個參考。請檢查當前的 RunComfy 參數面板以獲取精確選項。

_Qwen Image 2.1_ 能否像從文字生成圖像一樣編輯圖像?

是的。相同的 Qwen Image 2.1 權重可處理文字轉圖像和圖像轉圖像。此頁面是編輯/參考工作流程;另一個文字轉圖像頁面可從提示生成,而無需上傳照片。

開發人員可以透過 RunComfy API 使用 Qwen Image 2.1 嗎?

是的。在 RunComfy 模型界面中原型化編輯,然後通過 RunComfy HTTP API 調用相同的 Qwen Image 2.1 模型,使用相同的參數。您不需要自己托管或擴展模型。

Qwen Image 2.1 在 RunComfy 的價格是多少?

世代消耗美元或點數。Qwen Image 2.1的費用為每張1K輸出圖像$0.029,每張2K輸出圖像$0.119。額外的參考資料在此頁面上不會增加列出的附加費;新用戶通常會獲得免費試用額度以進行測試。

關注我們
  • 領英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 電子郵件
  • 系統狀態
  • 附屬
視頻模型
  • Runway Aleph 2
  • Wan 2.5
  • Wan 2.6 Flash
  • MiniMax H3 Max
  • Wan 3.0 Reference To Video
  • Seedance 2.5 Reference to Video 480p
  • 查看所有模型 →
影像模型
  • Wan 2.6 Image to Image
  • Seedream 5.0 Pro
  • Flux 2 Klein 9B
  • Nano Banana Pro
  • Nano Banana 2 Edit
  • Z Image Turbo LoRA
  • 查看所有模型 →
法律
  • 服務條款
  • 隱私政策
  • Cookie 政策
RunComfy
版權 2026 RunComfy. 保留所有權利。

RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。

Qwen Image 2.1 的例子