Qwen Image 2.1 Troca de Rosto ComfyUI Workflow: substituição natural de cabeça com transferência de identidade guiada por prompt#
Este Workflow de Troca de Rosto Qwen Image 2.1 ComfyUI substitui a cabeça e o rosto de um sujeito em uma cena existente usando uma referência de identidade separada. Alimentado por edição de imagem Qwen‑Image‑2.1 e uma etapa leve de geração de prompt, transfere características faciais, estilo de cabelo e barba enquanto preserva a pose, roupas e cenário originais da cena.
Projetado para recast de personagens, retratos editoriais e cenas criativas de troca de cabeça, o workflow é simples de dirigir: forneça sua cena original, adicione um retrato de identidade, execute a geração de prompt e amostre o composto final. Retratos de referência claros e bem iluminados ajudam o Workflow de Troca de Rosto Qwen Image 2.1 ComfyUI a produzir misturas contínuas e fotorrealistas.
Modelos principais no Comfyui Qwen Image 2.1 Troca de Rosto ComfyUI Workflow#
- Qwen‑Image‑2.1. O modelo de difusão de edição de imagem central que realiza a substituição de cabeça enquanto respeita a condicionamento de texto e visual. Veja o cartão do modelo oficial no Hugging Face: Qwen/Qwen-Image-2.1.
- Qwen‑Image‑2.1 VAE. O codificador automático variacional usado para decodificar o latente final para RGB e preservar a fidelidade de cor. Os pesos empacotados estão disponíveis na distribuição Comfy‑Org: Comfy‑Org/Qwen‑Image‑2.1 • vae.
- Qwen‑Image‑2.1 codificador de texto (família Qwen‑VL, 8B). O codificador cross‑modal que transforma a instrução gerada e as imagens de referência em condicionamento para o processo de difusão. Veja os ativos do codificador de texto no repositório Comfy‑Org: Comfy‑Org/Qwen‑Image‑2.1 • text_encoders.
Como usar o Comfyui Qwen Image 2.1 Troca de Rosto ComfyUI Workflow#
O gráfico é organizado como um único grupo intitulado "Qwen Image 2.1 Troca de Rosto" que orquestra entradas, geração de prompt, condicionamento multimodal, amostragem e salvamento. Em um nível alto, você carrega duas imagens, deixa o bloco de prompt criar uma instrução de edição concisa, codifica tudo para Qwen‑Image‑2.1, escolhe se começa de uma tela vazia ou de um latente guiado por imagem, depois amostra e decodifica.
Entradas: cena original e retrato de identidade#
- Carregue sua cena ou personagem alvo em
Original character(#470). Esta imagem fornece corpo, pose, roupas e ambiente que devem ser preservados após a troca de rosto. - Carregue o rosto para transferir em
new face(#510). Use um retrato nítido, frontal ou três-quartos com iluminação consistente; inclua a linha do cabelo se quiser que o estilo de cabelo seja transferido. - O workflow também agrupa essas duas entradas para que o gerador de prompt possa "ver" ambas as imagens juntas para uma melhor criação de instruções.
Geração de prompt: transforme sua intenção em uma dica de edição precisa#
- Uma diretiva curta é fornecida via
aijuxinó de textoJjkText(#516) e combinada com as imagens agrupadas emTextGenerateLTX2Prompt(#502). - O gerador produz uma instrução compacta e focada em edição (por exemplo, "Substitua a cabeça da pessoa na Imagem 1 pela pessoa da Imagem 2, mantenha pose, roupa e fundo").
- Esta instrução criada automaticamente reduz o esforço de engenharia de prompt e ajuda o Workflow de Troca de Rosto Qwen Image 2.1 ComfyUI a permanecer consistente entre execuções.
Condicionamento: orientação multimodal para Qwen‑Image‑2.1#
TextEncodeQwenImage21(#485) ingere a instrução junto com as duas imagens para produzir condicionamento positivo e negativo que descrevem o que substituir e o que preservar.- O codificador também prepara um plano latente influenciado por suas referências. Esta configuração é o que permite ao modelo transferir traços de identidade enquanto mantém a cena original intacta.
Resolução e roteamento latente: escolha composição e força de controle#
- Defina sua proporção de aspecto e orçamento de pixels desejados em
ResolutionSelector(#13). A resolução alimenta umEmptyLatentImageque define o tamanho da tela para síntese. ComfySwitchNode(#483) seleciona o latente inicial:- On: comece de um latente vazio para máxima liberdade criativa e transferência de identidade mais forte.
- Off: comece do latente do codificador para trocas guiadas por imagem que se ajustam mais fielmente à composição original.
- Este switch permite ajustar quão "forte" é a troca sem alterar outras configurações.
Amostragem, decodificação e salvamento#
- Os pesos UNet são carregados uma vez e armazenados em cache (
UNETLoaderparaQwenImage21Cache), entãoKSampler(#482) executa o processo de difusão usando seu condicionamento e fonte latente escolhida. VAEDecodeconverte o latente amostrado em uma imagem RGB, eSaveImage(#518) grava o resultado com um nome de arquivo com carimbo de data/hora.- O Workflow de Troca de Rosto Qwen Image 2.1 ComfyUI é determinístico por semente, então você pode reproduzir um visual favorito mantendo a mesma semente e configuração.
Nós-chave no Comfyui Qwen Image 2.1 Troca de Rosto ComfyUI Workflow#
TextEncodeQwenImage21 (#485)#
Este é o coração da troca: ele funde a instrução gerada com ambas as imagens para produzir a orientação que Qwen‑Image‑2.1 segue. Para preservação mais rigorosa da cena, mantenha sua instrução focada em substituir apenas a cabeça enquanto retém pose, roupa e fundo. Se precisar de edições mais suaves, use o modo guiado por imagem (veja o switch abaixo) e mantenha a linguagem negativa concisa para evitar sobreconstranger o modelo.
TextGenerateLTX2Prompt (#502)#
Este nó destila sua intenção e as duas imagens em uma instrução de edição concisa. Use-o quando quiser frases consistentes e menos prompts manuais. Se preferir sua própria redação, pode ignorar o gerador alimentando uma instrução personalizada e mantendo-a curta, específica e preservadora de cena.
ComfySwitchNode (#483)#
Este switch roteia o latente inicial. Use o caminho de latente vazio para transferência de identidade mais forte e estilização, ou o caminho de latente do codificador quando quiser que a composição e a iluminação se apeguem de perto à cena original. Inverta isso quando perceber muito desvio (vá guiado por imagem) ou pouca transferência de identidade (vá latente vazio).
KSampler (#482)#
Controla a estratégia de amostragem e a força da edição. Um fator de denoise mais baixo preservará mais da estrutura original da cabeça no modo guiado por imagem; um valor mais alto empurrará uma substituição mais forte. Escolha um sampler e scheduler em que confie para retratos e fixe a semente ao comparar variações.
ResolutionSelector (#13)#
Define a proporção de aspecto e orçamento de pixels para geração. Combine o enquadramento da cena original para reduzir distorções, ou tente uma tela ligeiramente maior se planeja cortar. Resoluções mais altas capturam melhor os detalhes do cabelo, mas aumentam o tempo de execução.
Extras opcionais#
- Use um retrato de identidade limpo e desobstruído; evite óculos de sol e grandes obstruções se quiser que olhos e sobrancelhas sejam transferidos fielmente.
- Combine a escala da cabeça: se o sujeito original estiver próximo à câmera, corte a referência de identidade para um tamanho de cabeça semelhante.
- Mantenha a iluminação consistente entre as imagens para misturas mais naturais; se a iluminação for diferente, prefira o latente guiado por imagem para melhor aderência à cena.
- Para exploração em lote, bloqueie a semente e mude apenas o retrato de identidade; isso isola o efeito do novo rosto.
- Se os resultados parecerem "supereditados", use o latente guiado por imagem e reduza a força geral da edição; se a identidade não aderir, comece de um latente vazio e fortaleça a instrução do prompt.
- Os ativos do modelo usados por este workflow estão disponíveis no Hugging Face: Qwen/Qwen‑Image‑2.1 e Comfy‑Org/Qwen‑Image‑2.1.
Agradecimentos#
Este workflow implementa e se baseia nos seguintes trabalhos e recursos. Agradecemos sinceramente a aijuxi por Workflow Original, Qwen por Qwen-Image-2.1 (modelo oficial), e Qwen por anúncio oficial Qwen-Image-2.1 por suas contribuições e manutenção. Para detalhes autoritativos, consulte a documentação original e repositórios vinculados abaixo.
Recursos#
- aijuxi/Workflow Original
- Docs / Notas de Lançamento: Original workflow by aijuxi
- Qwen/Qwen-Image-2.1
- Hugging Face: Qwen/Qwen-Image-2.1
- Qwen/Qwen-Image-2.1 anúncio oficial
- Docs / Notas de Lançamento: Qwen-Image-2.1 anúncio oficial
Nota: O uso dos modelos, conjuntos de dados e código referenciados está sujeito às respectivas licenças e termos fornecidos por seus autores e mantenedores.






