Qwen Image 2.1 用於 ComfyUI 中的參考指導合成的多圖像編輯#
此工作流程將多個參考圖像組裝成一個連貫的場景,使用英語編輯指令。它在保留可識別的設計特徵、材料和照明的同時,融合主題、物件和環境。參考感知提示增強階段在生成之前擴展您的方向,因此 Qwen Image 2.1 可以準確地放置每個元素並保持身份的完整性。
Qwen Image 2.1 多圖像編輯非常適合於室內造型、協調服裝可視化以及從獨立照片創建的群體肖像。您描述每個參考應該如何出現和交互,工作流程將您的指令重寫成明確的編輯提示,模型產生一個單一的寫實或風格化圖像,感覺自然組合。
Comfyui Qwen Image 2.1 多圖像編輯工作流程中的關鍵模型#
- Qwen-Image-2.1。用於生成的核心文本和圖像條件擴散模型。它啟用參考感知編輯和多個視覺輸入的穩健放置。查看模型卡和項目概述以了解功能和變體:Hugging Face, GitHub。
- Qwen-Image-2.1-PE-I2I。一個指令調整的組件,用於參考感知提示增強。它將您的英語指令重寫為簡潔、可生成的編輯提示,基於提供的圖像:Hugging Face。
- Qwen-Image-2.1 VAE。變分自編碼器將潛在變量解碼回 RGB,同時保持色彩忠實性和細節:隨 Qwen-Image-2.1 發佈包裝在 Hugging Face。
如何使用 Comfyui Qwen Image 2.1 多圖像編輯工作流程#
工作流程分三個階段運行:您提供參考資料和一個簡單的英語指令,提示重寫帶有圖像基礎,生成器從增強的提示和您的參考資料組合最終圖像。
用戶輸入#
使用四個 LoadImage 節點作為您的基本場景和參考元素:Image 1 - Reading Room (#470), Image 2 - Sage Armchair (#510), Image 3 - Side Table and Tea (#503), 和 Image 4 - Cosmos Flowers (#511)。如果需要更多來源,還有標記為“未使用參考”的額外 LoadImage 節點;當您希望參考資料影響結果時,將它們連接起來。在 Edit Instructions - English (#516) 中撰寫您的指令,明確說明每個圖像的角色、要保留的特徵、物件的位置以及要避免的事項。設定 ResolutionSelector (#13) 中的輸出寬高比和大小,然後工作流程將在該分辨率下創建一個 EmptyLatentImage (#480) 用於生成,除非您選擇下面描述的替代路徑。
提示重寫#
所有選擇的圖像由 ZNGB_ImageBatchMulti (#531) 彙總並通過 TextGenerateLTX2Prompt (#502) 傳遞給 English Prompt Enhancement。在 English Output Instruction (#517) 中添加一行簡短的輔助行以僅返回最終提示。增強步驟使用 Qwen Image 2.1 PE 模型將角色、位置、照明和一致性規則擴展為單一的明確編輯指令。您可以在 Enhanced Prompt Preview (#501) 中預覽這個精煉文本,然後生成自動進行。
模型#
Models 組加載生成組件:UNETLoader (#477) 用於 Qwen-Image-2.1,CLIPLoader (#533) 用於其文本視覺編碼器,VAELoader (#479) 用於解碼。TextEncodeQwenImage21 (#519) 然後將增強的提示、您的可選負面提示和最多十個參考圖像合併為適合多圖像編輯的條件。當需要時,它還會生成一個可選的參考潛在變量以更緊密地指導結構。
取樣和輸出#
QwenImage21Cache (#484) 與 KSampler (#482) 共享模型以進行高效的迭代取樣。默認情況下,ComfySwitchNode (#483) 從 EmptyLatentImage (#480) 路由一個空白潛在變量以進行自由組合;當您希望更強的參考幾何或佈局遵循時,將其切換為使用 TextEncodeQwenImage21 潛在變量。調整 KSampler 以平衡提示遵循和變化,然後 VAEDecode (#481) 和 SaveImage (#534) 生成您選擇的文件名前綴的最終圖像。
Comfyui Qwen Image 2.1 多圖像編輯工作流程中的關鍵節點#
TextGenerateLTX2Prompt (#502)#
此節點使用 Qwen Image 2.1 PE 模型執行參考感知提示增強。提供您的指令和組裝的圖像批次以獲得一個單一的、明確的編輯提示,基於參考資料。當您需要保留許多物件屬性時,增加允許長度,並調整取樣選項以偏好創意轉述或嚴格的字面重寫。預覽節點顯示生成器將遵循的內容。
TextEncodeQwenImage21 (#519)#
將增強的提示和最多十個參考圖像編碼為 Qwen-Image-2.1 的條件。使用 negative_prompt 禁止不需要的重複、拼貼效果或額外人物。resolution 輸入設定特徵提取的工作比例;匹配您的輸出以穩定地保持細節。當通過開關選擇時,該節點還可以發出一個初始潛在變量,以更緊密地鎖定組成。
ComfySwitchNode (#483)#
切換 KSampler 的啟動策略。保持默認的空白潛在變量以進行更自由的組合,仍然通過條件尊重參考身份。當您希望更強的結構指導時,切換到來自 TextEncodeQwenImage21 的參考潛在變量;將這與較低的去噪結合以強調參考資料。
KSampler (#482)#
驅動 Qwen-Image-2.1 的去噪過程。使用 seed 來重現特定排列或探索變化。調整 cfg 以決定模型如何嚴格遵循增強的提示,以及 steps 以進行質量速度權衡。sampler_name 和 scheduler 的選擇可以微妙地改變紋理和銳度;當迭代一種外觀時,選擇一致的組合。
ResolutionSelector (#13)#
快速控制輸出寬度和高度。選擇一個舒適框住所有參考元素的寬高比。較大的分辨率顯示更多來自參考的紋理,但需要更多計算,因此在您的組成穩定後逐漸增加。
可選附加功能#
- 在撰寫指令時,列舉每個圖像的角色和要保留的精確特徵:材料、顏色、圖案、輪廓和比例。
- 保持相機角度、時間和光照方向在參考資料中一致,以獲得更自然的合成。
- 對於室內裝飾,選擇一個基礎房間作為環境,將家具或裝飾視為要放置的物件;對於服裝,使用一個模特或模型作為基礎,提供服裝作為物件參考。
- 如果看到重複或拼貼工藝品,強化
negative_prompt使用如“無重複,無拼貼”之類的術語,並明確物件數量。 - 使用潛在開關進行兩種模式:空白潛在變量進行探索性佈局,參考潛在變量進行精確放置。
- 使用固定的
seed鎖定一個有前途的外觀,然後只通過更改指令或一次交換一個參考來創建變化。 - 使用
SaveImage文件名前綴按場景組織結果,以便輕鬆比較迭代。
有關此 Qwen Image 2.1 多圖像編輯工作流程中使用的模型系列和權重的背景,請參見官方資源:Qwen-Image-2.1 on Hugging Face, Qwen-Image-2.1-PE-I2I, 以及項目庫在 GitHub。
致謝#
此工作流程實施並基於以下工作和資源構建。我們感謝 RunningHub 提供工作流程來源,QwenLM (Qwen) 提供 Qwen-Image-2.1,以及 Qwen 提供 Qwen-Image-2.1-PE-I2I 參考感知提示增強,感謝他們的貢獻和維護。欲了解權威細節,請參考以下鏈接的原始文檔和庫。
資源#
- RunningHub/Workflow source
- 文檔 / 發佈說明: Workflow source
- Qwen/Qwen-Image-2.1
- Hugging Face: Qwen/Qwen-Image-2.1
- GitHub: QwenLM/Qwen-Image-2.1
- QwenLM/Qwen-Image-2.1
- GitHub: QwenLM/Qwen-Image-2.1
- Hugging Face: Qwen/Qwen-Image-2.1
- Qwen/Qwen-Image-2.1-PE-I2I
- Hugging Face: Qwen/Qwen-Image-2.1-PE-I2I
注意:使用所參考的模型、數據集和代碼受制於其作者和維護者提供的相應許可和條款。




