Qwen Image 2.1 編輯 ComfyUI 工作流程:從文本進行精確、參考引導的圖像編輯#
這個 Qwen Image 2.1 編輯 ComfyUI 工作流程將簡單語言指令和一個或多個視覺參考轉換為忠實的圖像編輯。它設計用於產品放置、光線和天氣變更、風格轉換、圖像內文本替換和角色故事板。工作流程在應用請求的更改時保持原始場景構圖,因此您的框架、透視和背景保持不變。
基於統一的 Qwen-Image-2.1 模型構建,該管道接受基礎圖像作為畫布,外加可選的參考圖像,您可以在提示中調用。典型示例包括向房間添加產品、將陽光照片轉換為雨天、新文本替換標籤或在面板間一致地展示角色。結果以準備分享的圖像形式輸出。
Comfyui Qwen Image 2.1 編輯 ComfyUI 工作流程中的關鍵模型#
- Qwen-Image-2.1 擴散模型(UNet)。核心圖像編輯器,根據您的指令和參考合成一致的更改。此工作流程使用為 ComfyUI 打包的 UNet 權重,可在官方權重庫 Comfy-Org/Qwen-Image-2.1 中獲得。
- Qwen3-VL 8B 文本-圖像編碼器。將指令提示和鏈接的參考圖像編碼為驅動編輯的條件信號。編碼器權重與同一庫一起發送,位於 Comfy-Org/Qwen-Image-2.1 的 text_encoders 下。
- Qwen-Image-2.1 VAE。壓縮和解碼圖像至和從擴散模型使用的潛在空間,確保高保真重建和穩定編輯。VAE 權重包含在 Comfy-Org/Qwen-Image-2.1 中。
如何使用 Comfyui Qwen Image 2.1 編輯 ComfyUI 工作流程#
整體邏輯很簡單:加載模型、設置畫布尺寸、編碼您的文本和參考、采樣編輯並保存結果。下述組織反映圖形組織,展示各部分如何組合在一起。
模型組#
此組加載 UNet、多模態編碼器和 VAE,為 Qwen Image 2.1 編輯 ComfyUI 工作流程提供動力。UNet 提供編輯能力,編碼器將您的提示和參考圖像轉換為指導,而 VAE 在像素和潛在變量之間移動。這些加載器預填充為推薦的 Qwen-Image-2.1 權重,因此您可以開箱即用。高級用戶可以交換同一系列的權重以提高速度或精度。應用緩存以避免重複運行相同模型時的重新加載開銷。
圖像尺寸組#
此組決定編輯將針對的潛在畫布。默認情況下,畫布遵循基礎圖像的長寬比,以幫助保持構圖和攝影機幾何。如果啟用自定義畫布,工作流程將切換到用戶指定的寬度和高度,適用於方形縮略圖或垂直故事板等任務。為了最忠實的編輯,設置接近模型使用的基礎圖像調整大小的自定義尺寸。大的偏差可能會使編輯偏離原始框架。
條件組#
在此,工作流程將文本指令與視覺背景融合。將您的基礎場景連接到 image_1,並將任何參考連接到額外的圖像插槽,然後在您的提示中使用類似 <image1>、<image2> 等標記引用它們。編碼器建立正面和負面條件,外加基於基礎圖像的初始潛在變量,將編輯錨定在您的構圖中。清晰、具體的提示效果最佳:描述要更改的內容、要保留的內容以及如何匹配透視、光線或材料。您可以包括 "no extra objects" 或 "no text" 之類的約束以抑制不需要的工件。
采樣組#
此組從條件中生成實際編輯。采樣器解釋步驟、指導強度和采樣器或調度器選擇,以平衡忠實度和創造力。低指導值傾向於保持輸入,而較高的值推動更大的更改;中等步數通常足以獲得乾淨的結果。采樣後,VAE 將潛在變量解碼為圖像並保存輸出。如果需要嚴格的可重現性,保持固定種子;如果想要多樣性,則隨機化它。
Comfyui Qwen Image 2.1 編輯 ComfyUI 工作流程中的關鍵節點#
Image Edit (Qwen Image 2.1) (#459) 這是將工作流程綁定在一起的前面板。它公開了指令字段、采樣器控制、自定義尺寸切換和基礎場景及參考的圖像輸入。使用 <image1>、<image2> 等在提示中明確地將指令綁定到連接的圖像。保持負面提示專注於您不想要的東西(例如,“標誌、水印、額外對象”)。結構反映了 Qwen-Image-2.1 的官方編輯模板,因此大多數任務無需圖形更改即可正常工作 reference。
TextEncodeQwenImage21 (#474) 使用 Qwen3-VL 8B 編碼器對文本和圖像進行編碼,並準備由基礎圖像引導的條件和初始潛在變量。這是工作流程學習哪些元素要保留和哪些要修改的地方。保持參考在透視、材料和光線方面與目標結果視覺上接近。提供多個參考時,在提示中指出它們的角色以避免歧義。該節點使用 Comfy-Org/Qwen-Image-2.1 中捆綁的官方 Qwen-Image-2.1 編碼器。
ResolutionSelector (#13) 提供便捷的預設以及自定義畫布的手動寬度和高度。當項目需要特定的長寬比或像素尺寸時使用,例如市場方形或高故事板框架。為了最大限度地忠實於基礎圖像,保持自定義尺寸接近模型對基礎圖像的內部調整大小。Qwen-Image-2.1 還支持直接 2K 輸出;當您需要更高細節而不進行後期放大時,請使用此功能,如 Comfy-Org 權重頁面所述 reference。
ComfySwitchNode (#468) 控制采樣器接收由基礎圖像或由選擇器調整大小的空畫布派生的潛在變量。開啟它以獲得嚴格的自定義尺寸,或關閉它以自動遵循基礎圖像幾何。如果選擇自定義畫布,請避免與基礎圖像調整大小的尺寸極端偏離,否則編輯可能會漂移。這個簡單的開關是移動在保持構圖的編輯和故意重新構圖之間的關鍵。
KSampler (#458) 運行產生編輯的擴散過程。調整 steps 以獲得細節和穩定性,調整 cfg 以控制提示對結果的影響;較低的指導通常更好地保留輸入,而較高的指導強制進行更大的更改。sampler_name 和 scheduler 影響紋理和收斂;提供的組合是 Qwen-Image-2.1 的實用默認值。固定 seed 以重現結果或隨機化以獲得新變化。當一個更改幾乎正確但不完美時,先嘗試小步或指導微調再重寫提示。
SaveImageAdvanced (#461) 處理文件名前綴、格式和色彩空間,使輸出組織井然有序,準備好分享。每個任務或場景使用清晰、語義的前綴,以保持多次運行實驗的整潔。在迭代時,考慮在前綴中嵌入關鍵運行信息,如場景或主題,以便後續快速過濾。PNG 是安全的歸檔選擇;僅在文件大小至關重要時切換到 JPEG。
可選附加項#
- 產品放置的提示模式:“使用 <image1> 作為基礎場景。將 <image2> 中的 [object] 放置在 [surface] 上。匹配 [lighting] 和 [perspective]。添加柔和的接觸陰影。沒有額外的對象,沒有文本。”
- 對於光線或天氣變更,說明要保留的內容:“保持 <image1> 的構圖和攝影機框架。轉換為金色時間的陽光 / 小雨 / 陰天,同時匹配現有陰影。”
- 對於風格轉換,要求材料或渲染更改,同時保持結構:“保持 <image1> 的佈局。轉換為水彩插圖 / 電影級別 / 霓虹賽博朋克色彩調色板。”
- 對於圖像內文本替換,明確說明:“將 <image1> 上的標籤替換為 ‘NEW TEXT’,相同字體粗細和顏色,保持邊緣和反射。”
- 對於角色故事板,提供多個面部或服裝參考,跨 <image2>..<imageN>,並要求面板間的身份一致性。
這個 Qwen Image 2.1 編輯 ComfyUI 工作流程為您提供一個高效、構圖感知的編輯器,能夠響應精確的語言和具體的視覺線索。從清晰的提示、良好的參考和尊重基礎圖像的尺寸選擇開始,然後通過小的采樣器調整進行迭代,以獲得製作就緒的結果。
致謝#
此工作流程實現並建立在以下作品和資源之上。我們感謝 Comfy-Org 提供的 ComfyUI 工作流程源和官方圖像編輯模板,Qwen 提供的 Qwen-Image-2.1 模型和公告,以及 Comfy-Org 主辦的 ComfyUI 模型權重,感謝他們的貢獻和維護。欲了解權威細節,請參考下文鏈接的原始文檔和存儲庫。
資源#
- Comfy-Org/Workflow source
- 文檔 / 發布說明: Workflow source
- Qwen/Qwen Image 2.1 announcement
- 文檔 / 發布說明: Qwen Image 2.1 announcement
- Comfy-Org/ComfyUI model weights
- Hugging Face: Comfy-Org/Qwen-Image-2.1
- Comfy-Org/Official image editing template
- GitHub: Comfy-Org/workflow_templates
注意:使用所引用的模型、數據集和代碼須遵循其作者和維護者提供的各自許可和條款。








