ComfyUI>Flujos de trabajo>Qwen Image 2.1 Edición de Imágenes Múltiples | Hasta 10 Imágenes de Entrada

Qwen Image 2.1 Edición de Imágenes Múltiples | Hasta 10 Imágenes de Entrada

Workflow Name: RunComfy/Qwen-2.1-Multi-image
Workflow ID: 0000...1523
Utiliza la edición de múltiples referencias para construir una escena pulida. Define el papel de cada imagen en inglés simple. La mejora de indicaciones retiene sujetos y configuraciones clave. Crea habitaciones estilizadas o atuendos coordinados. Construye retratos grupales naturales a partir de fotos separadas. Obtén resultados precisos con menos pasos.

ComfyUI Qwen Image 2.1 Multi-image Editing Workflow

Qwen Image 2.1 Multi-image Editing | English-Guided Fusion
Want to run this workflow?
  • Fully operational workflows
  • No missing nodes or models
  • No manual setups required
  • Features stunning visuals

ComfyUI Qwen Image 2.1 Multi-image Editing Examples

qwen-image-2-1-multi-image-editing-1523-example_01.webp
qwen-image-2-1-multi-image-editing-1523-example_02.webp
qwen-image-2-1-multi-image-editing-1523-example_03.webp

Qwen Image 2.1 Edición de Imágenes Múltiples para composición guiada por referencias en ComfyUI#

Este flujo de trabajo ensambla múltiples imágenes de referencia en una escena coherente usando instrucciones de edición en inglés. Combina sujetos, objetos y entornos mientras conserva características de diseño reconocibles, materiales e iluminación. Una etapa de mejora de indicaciones consciente de las referencias expande tus direcciones antes de la generación para que Qwen Image 2.1 pueda colocar cada elemento con precisión y mantener intactas las identidades.

Qwen Image 2.1 Edición de Imágenes Múltiples es ideal para estilización de interiores, visualización de atuendos coordinados y retratos grupales creados a partir de fotos separadas. Describe cómo debe aparecer e interactuar cada referencia, el flujo de trabajo reescribe tu instrucción en una indicación de edición explícita, y el modelo produce una imagen fotorealista o estilizada que se siente naturalmente compuesta.

Modelos clave en el flujo de trabajo de edición de imágenes múltiples de ComfyUI Qwen Image 2.1#

  • Qwen-Image-2.1. El modelo de difusión condicionado por texto e imagen utilizado para la generación. Permite la edición consciente de referencias y la colocación robusta de múltiples entradas visuales. Consulta la tarjeta del modelo y el resumen del proyecto para capacidades y variantes: Hugging Face, GitHub.
  • Qwen-Image-2.1-PE-I2I. Un componente ajustado por instrucciones utilizado aquí para la mejora de indicaciones consciente de referencias. Reescribe tus direcciones en inglés en una indicación de edición concisa y lista para generación basada en las imágenes proporcionadas: Hugging Face.
  • Qwen-Image-2.1 VAE. El codificador automático variacional que decodifica latentes de nuevo a RGB mientras mantiene la fidelidad del color y el detalle fino: empaquetado con el lanzamiento de Qwen-Image-2.1 en Hugging Face.

Cómo usar el flujo de trabajo de edición de imágenes múltiples de ComfyUI Qwen Image 2.1#

El flujo de trabajo se ejecuta en tres etapas: proporcionas referencias y una instrucción en inglés simple, la indicación se reescribe con base en las imágenes, y el generador compone una imagen final a partir de la indicación mejorada más tus referencias.

Entrada del usuario#

Usa los cuatro nodos LoadImage para tu escena base y elementos de referencia: Image 1 - Reading Room (#470), Image 2 - Sage Armchair (#510), Image 3 - Side Table and Tea (#503), y Image 4 - Cosmos Flowers (#511). Los nodos adicionales LoadImage etiquetados como “Unused Reference” están disponibles si necesitas más fuentes; conéctalos cuando quieras que las referencias influyan en el resultado. Escribe tu instrucción en Edit Instructions - English (#516), indicando claramente el papel de cada imagen, los rasgos a preservar, dónde colocar objetos y qué evitar. Configura tu aspecto y tamaño de salida en ResolutionSelector (#13), luego el flujo de trabajo creará una EmptyLatentImage (#480) en esa resolución para la generación a menos que elijas la ruta alternativa descrita a continuación.

Reescritura de indicaciones#

Todas las imágenes seleccionadas se agrupan por ZNGB_ImageBatchMulti (#531) y se pasan a English Prompt Enhancement a través de TextGenerateLTX2Prompt (#502). Se agrega una línea de ayuda corta en English Output Instruction (#517) para devolver solo la indicación final. El paso de mejora utiliza un modelo PE de Qwen Image 2.1 para expandir roles, colocación, iluminación y reglas de consistencia en una única instrucción de edición explícita. Puedes previsualizar este texto refinado en Enhanced Prompt Preview (#501) antes de que la generación proceda automáticamente.

Modelos#

El grupo Models carga los componentes de generación: UNETLoader (#477) para Qwen-Image-2.1, CLIPLoader (#533) para sus codificadores de texto-visión, y VAELoader (#479) para decodificación. TextEncodeQwenImage21 (#519) luego fusiona la indicación mejorada, tu indicación negativa opcional, y hasta diez imágenes de referencia en un condicionamiento adecuado para la edición de imágenes múltiples. También produce un latente de referencia opcional que puede guiar la estructura más estrechamente cuando se desee.

Muestreo y salida#

QwenImage21Cache (#484) comparte el modelo con KSampler (#482) para un muestreo iterativo eficiente. Por defecto, ComfySwitchNode (#483) dirige un latente en blanco desde EmptyLatentImage (#480) para una composición libre; cámbialo para usar el latente de TextEncodeQwenImage21 cuando desees una mayor adhesión a la geometría o disposición de las referencias. Ajusta KSampler para equilibrar la adhesión a las indicaciones y la variación, luego VAEDecode (#481) y SaveImage (#534) producen tu imagen final con el prefijo de nombre de archivo elegido.

Nodos clave en el flujo de trabajo de edición de imágenes múltiples de ComfyUI Qwen Image 2.1#

TextGenerateLTX2Prompt (#502)#

Este nodo realiza la mejora de indicaciones consciente de referencias utilizando un modelo PE de Qwen Image 2.1. Proporciona tu instrucción y el lote de imágenes ensamblado para obtener una única indicación de edición explícita basada en las referencias. Aumenta la longitud permitida cuando necesites preservar muchos atributos de objetos, y ajusta las opciones de muestreo para favorecer la paráfrasis creativa o reescrituras estrictamente literales. El nodo de vista previa muestra exactamente lo que seguirá el generador.

TextEncodeQwenImage21 (#519)#

Codifica la indicación mejorada y hasta diez imágenes de referencia en un condicionamiento para Qwen-Image-2.1. Utiliza el negative_prompt para prohibir duplicados no deseados, efectos de collage o personas adicionales. La entrada resolution establece la escala de trabajo para la extracción de características; ajústala a tu salida para mantener el detalle estable. Este nodo también puede emitir un latente inicial que bloquea la composición más estrechamente cuando se selecciona a través del interruptor.

ComfySwitchNode (#483)#

Alterna la estrategia de inicio para KSampler. Mantén el latente en blanco por defecto para una composición más libre que aún respeta la identidad de la referencia a través del condicionamiento. Cambia al latente de referencia de TextEncodeQwenImage21 cuando desees una guía estructural más fuerte; combina esto con un menor nivel de desruido para enfatizar las referencias.

KSampler (#482)#

Conduce el proceso de desruido de Qwen-Image-2.1. Usa seed para reproducir una disposición específica o explorar variaciones. Ajusta cfg para determinar cuán firmemente el modelo sigue la indicación mejorada y steps para el equilibrio entre calidad y velocidad. Las opciones sampler_name y scheduler pueden cambiar sutilmente la textura y la nitidez; elige un par consistente al iterar en un aspecto.

ResolutionSelector (#13)#

Ofrece un control rápido sobre el ancho y la altura de salida. Elige una relación de aspecto que enmarque cómodamente todos los elementos referenciados. Las resoluciones más grandes revelan más textura de las referencias pero requieren más recursos de cómputo, así que aumenta gradualmente a medida que tu composición se estabiliza.

Extras opcionales#

  • Al escribir instrucciones, enumera el papel de cada imagen y las características exactas a preservar: material, color, patrón, silueta y escala.
  • Mantén el ángulo de la cámara, la hora del día y la dirección de la iluminación consistentes en todas las referencias para composiciones más naturales.
  • Para interiores, elige una habitación base como el entorno y trata los muebles o decoraciones como objetos a colocar; para atuendos, usa un maniquí o modelo como base y proporciona prendas como referencias de objetos.
  • Si ves duplicados o artefactos de collage, fortalece el negative_prompt con términos como “sin duplicados, sin collage” y sé explícito sobre el número de objetos.
  • Usa el interruptor de latente para dos modos: latente en blanco para un diseño exploratorio, latente de referencia para una colocación precisa.
  • Bloquea un aspecto prometedor con una seed fija, luego crea variaciones cambiando solo la instrucción o intercambiando una referencia a la vez.
  • Organiza los resultados por escena usando el prefijo de nombre de archivo SaveImage para que las iteraciones sean fáciles de comparar.

Para antecedentes sobre la familia de modelos y los pesos utilizados en este flujo de trabajo de edición de imágenes múltiples de Qwen Image 2.1, consulta los recursos oficiales: Qwen-Image-2.1 en Hugging Face, Qwen-Image-2.1-PE-I2I, y el repositorio del proyecto en GitHub.

Agradecimientos#

Este flujo de trabajo implementa y se basa en los siguientes trabajos y recursos. Agradecemos a RunningHub por la fuente del flujo de trabajo, a QwenLM (Qwen) por Qwen-Image-2.1, y a Qwen por la mejora de indicaciones consciente de referencias Qwen-Image-2.1-PE-I2I por sus contribuciones y mantenimiento. Para detalles autorizados, consulta la documentación original y los repositorios enlazados a continuación.

Recursos#

Nota: El uso de los modelos, conjuntos de datos y código referenciados está sujeto a las respectivas licencias y términos proporcionados por sus autores y mantenedores.

RunComfy
Derechos de autor 2026 RunComfy. Todos los derechos reservados.

RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.