Qwen Image 2.1 臉部交換 ComfyUI 工作流程:通過提示引導的身份轉移進行自然頭部替換#
此 Qwen Image 2.1 臉部交換 ComfyUI 工作流程使用單獨的身份參考替換現有場景中的主體頭部和面部。由 Qwen-Image-2.1 圖像編輯和輕量級提示生成階段驅動,它在保留原場景的姿勢、服裝和背景的同時,轉移面部特徵、髮型和面部毛髮。
專為角色重鑄、編輯肖像和創意頭部交換場景而設計,該工作流程操作簡單:提供您的原始場景,添加身份肖像,運行提示生成,並採樣最終合成。清晰、光線充足的參考肖像有助於 Qwen Image 2.1 臉部交換 ComfyUI 工作流程產生無縫、逼真的混合效果。
Comfyui Qwen Image 2.1 臉部交換 ComfyUI 工作流程中的關鍵模型#
- Qwen-Image-2.1。執行頭部替換的核心圖像編輯擴散模型,同時尊重文本和視覺條件。請參閱 Hugging Face 上的官方模型卡:Qwen/Qwen-Image-2.1。
- Qwen-Image-2.1 VAE。用於將最終潛在解碼為 RGB 並保留顏色保真度的變分自動編碼器。打包的權重可在 Comfy-Org 發行版中獲得:Comfy-Org/Qwen-Image-2.1 • vae。
- Qwen-Image-2.1 文本編碼器(Qwen-VL 系列,8B)。將生成的指令和參考圖像轉換為擴散過程條件的跨模態編碼器。請參閱 Comfy-Org 存儲庫中的文本編碼器資產:Comfy-Org/Qwen-Image-2.1 • text_encoders。
如何使用 Comfyui Qwen Image 2.1 臉部交換 ComfyUI 工作流程#
該圖由標題為“Qwen Image 2.1 Face Swap”的單一組織成,協調輸入、提示生成、多模態條件、採樣和保存。在高層級上,您加載兩張圖像,讓提示塊編寫簡潔的編輯指令,將所有內容編碼為 Qwen-Image-2.1,選擇是從空白畫布還是從圖像引導的潛在開始,然後進行採樣和解碼。
輸入:原始場景和身份肖像#
- 將您的場景或目標角色加載到
Original character(#470)中。此圖像提供應在面部交換後保留的身體、姿勢、服裝和環境。 - 將要轉移的面部加載到
new face(#510)中。使用銳利的正面或四分之三肖像,光線一致;如果您希望髮型也能轉移,請包括髮際線。 - 該工作流程還批量處理這兩個輸入,以便提示生成器可以“看到”這兩張圖像,以便更好地編寫指令。
提示生成:將您的意圖轉化為精確的編輯提示#
- 通過
aijuxi文本節點JjkText(#516)提供簡短指令,並與批量圖像結合在TextGenerateLTX2Prompt(#502)中。 - 生成器生成一個緊湊的、以編輯為重點的指令(例如,“將圖像 1 中的人的頭替換為圖像 2 中的人,保持姿勢、服裝和背景”)。
- 這個自動生成的指令減少了提示工程的負擔,並有助於 Qwen Image 2.1 Face Swap ComfyUI 工作流程在多次運行中保持一致。
條件:Qwen-Image-2.1 的多模態指導#
TextEncodeQwenImage21(#485)攝取指令以及這兩張圖像,以產生描述要替換的內容和要保留的內容的正面和負面條件。- 編碼器還準備了一個受您參考影響的潛在藍圖。此設置使模型能夠在保持原場景完整的同時轉移身份特徵。
分辨率和潛在路由:選擇構圖和控制強度#
- 在
ResolutionSelector(#13)中設置您想要的寬高比和像素預算。分辨率會提供一個EmptyLatentImage,該圖像定義了合成的畫布大小。 ComfySwitchNode(#483)選擇起始潛在:- 開:從空的潛在開始,最大化創意自由並加強身份轉移。
- 關:從編碼器的潛在開始,進行更接近原始構圖的圖像引導交換。
- 此開關允許您在不改變其他設置的情況下調整交換的“強度”。
採樣、解碼和保存#
- UNet 權重加載一次並緩存(
UNETLoader到QwenImage21Cache),然後KSampler(#482)使用您的條件和選擇的潛在來源運行擴散過程。 VAEDecode將採樣的潛在轉換為 RGB 圖像,並且SaveImage(#518)使用帶有時間戳的文件名寫入結果。- Qwen Image 2.1 Face Swap ComfyUI 工作流程是每個種子的確定性,因此您可以通過保持相同的種子和配置來重現最喜歡的外觀。
Comfyui Qwen Image 2.1 臉部交換 ComfyUI 工作流程中的關鍵節點#
TextEncodeQwenImage21(#485)#
這是交換的核心:它將生成的指令與兩張圖像融合在一起,以生成 Qwen-Image-2.1 遵循的指導。為了更緊密地保留場景,請將您的指令集中在僅替換頭部,同時保留姿勢、服裝和背景。如果您需要更溫和的編輯,請使用圖像引導模式(請參見下面的開關),並保持負面語言簡潔,以免過度限制模型。
TextGenerateLTX2Prompt(#502)#
此節點將您的意圖和兩張圖像提煉為簡潔的編輯指令。當您希望一致的措辭和更少的手動提示時,請使用它。如果您更喜歡自己的措辭,可以通過提供自定義指令並保持簡短、具體和場景保留來繞過生成器。
ComfySwitchNode(#483)#
此開關路由起始潛在。使用空潛在路徑以獲得更強的身份轉移和風格化,或者當您希望構圖和光線緊貼原始場景時使用編碼器潛在路徑。當您看到漂移過多(轉為圖像引導)或身份轉移不足(轉為空潛在)時,請切換此開關。
KSampler(#482)#
控制採樣策略和編輯強度。在圖像引導模式下,降低去噪因子將保留更多的原始頭部結構;更高的值將推動更強的替換。選擇您信任的肖像採樣器和調度程式,並在比較變體時固定種子。
ResolutionSelector(#13)#
設定生成的寬高比和像素預算。匹配原始場景的框架以減少變形,或者如果您計劃裁剪,請嘗試稍大一些的畫布。更高的分辨率更好地捕捉髮絲細節,但會增加運行時間。
可選附加功能#
- 使用乾淨、無遮擋的身份肖像;如果您希望眼睛和眉毛忠實轉移,請避免使用太陽鏡和重度遮擋。
- 匹配頭部比例:如果原始主體靠近攝像機,請裁剪身份參考以獲得相似的頭部大小。
- 保持圖像之間的光線一致,以獲得更自然的混合效果;如果光線不同,請選擇圖像引導的潛在,以更好地遵循場景。
- 對於批量探索,鎖定種子並僅更改身份肖像;這樣可以隔離新面孔的效果。
- 如果結果看起來“過度編輯”,請使用圖像引導的潛在並降低整體編輯強度;如果身份無法保持,請從空的潛在開始並加強提示指令。
- 此工作流程使用的模型資產可從 Hugging Face 獲得:Qwen/Qwen-Image-2.1 和 Comfy-Org/Qwen-Image-2.1。
致謝#
此工作流程實施並基於以下作品和資源構建。我們感謝 aijuxi 的 Original workflow、Qwen 的 Qwen-Image-2.1 (official model) 和 Qwen 的 Qwen-Image-2.1 official announcement 的貢獻和維護。欲了解權威詳情,請參閱下列鏈接的原始文檔和存儲庫。
資源#
- aijuxi/Original workflow
- 文檔 / 發布說明:Original workflow by aijuxi
- Qwen/Qwen-Image-2.1
- Hugging Face: Qwen/Qwen-Image-2.1
- Qwen/Qwen-Image-2.1 official announcement
- 文檔 / 發布說明:Qwen-Image-2.1 official announcement
注意:引用的模型、數據集和代碼的使用受其作者和維護者提供的各自許可和條款約束。






