ComfyUI>Flujos de trabajo>Flujo de Trabajo de Qwen Image 2.1 ComfyUI: Texto a Imagen

Flujo de Trabajo de Qwen Image 2.1 ComfyUI: Texto a Imagen

Workflow Name: RunComfy/Qwen-Image-2.1-text-to-image
Workflow ID: 0000...1519
Convierte tus prompts en imágenes detalladas de 2048x2048 con Qwen Image 2.1. Puedes crear retratos de moda, escenas cinematográficas y conceptos de productos. Ajusta fácilmente los prompts y la resolución. Reutiliza semillas para resultados consistentes. Ejecuta INT8 para una generación eficiente. Exporta la obra terminada como archivos PNG RGBA.

Qwen Image 2.1 Text To Image ComfyUI Workflow Workflow

Qwen Image 2.1 in ComfyUI | 2K INT8 Text-to-Image
¿Quiere ejecutar este flujo de trabajo?
  • Flujos de trabajo completamente operativos
  • Sin nodos ni modelos faltantes
  • No se requiere configuración manual
  • Presenta visuales impresionantes

Qwen Image 2.1 Text To Image ComfyUI Workflow Examples

qwen-image-2-1-in-comfyui-2k-int8-text-to-image-1519-example_01.webp
qwen-image-2-1-in-comfyui-2k-int8-text-to-image-1519-example_02.webp
qwen-image-2-1-in-comfyui-2k-int8-text-to-image-1519-example_03.webp
qwen-image-2-1-in-comfyui-2k-int8-text-to-image-1519-example_04.webp
qwen-image-2-1-in-comfyui-2k-int8-text-to-image-1519-example_05.webp
qwen-image-2-1-in-comfyui-2k-int8-text-to-image-1519-example_06.webp

Flujo de Trabajo de Qwen Image 2.1 Texto a Imagen en ComfyUI#

Convierte los prompts de texto en imágenes detalladas y de alta resolución con los pesos abiertos oficiales de Qwen-Image-2.1 empaquetados para ComfyUI. Este flujo de trabajo de Qwen Image 2.1 Texto a Imagen en ComfyUI está diseñado para creadores que desean resultados reproducibles y salidas nítidas en 2048×2048 nativo. Soporta inferencia INT8 para un uso eficiente de VRAM y guarda PNGs RGBA limpios, lo que lo hace ideal para retratos de moda, imágenes cinematográficas y conceptos de productos pulidos.

Construido alrededor de un camino simple de generar-decodificar-guardar, el flujo de trabajo te da control directo sobre el texto del prompt, la semilla y la resolución. Mantén una semilla fija para iteraciones con versiones, cambia de estilo con frases de prompt y exporta activos con fondo transparente listos para las cadenas de diseño.

Modelos clave en el flujo de trabajo de Qwen Image 2.1 Texto a Imagen en ComfyUI#

  • Qwen-Image-2.1 (Comfy-Org): El modelo central de peso abierto de texto a imagen que interpreta tu prompt y sintetiza la imagen en el espacio latente. Utiliza un generador estilo MMDiT optimizado para detalle de alta fidelidad y composición consciente de la tipografía. Comfy-Org/Qwen-Image-2.1
  • Qwen-Image-2.1 VAE: El autoencoder que decodifica los latentes generados de nuevo a píxeles. Preserva el detalle fino y la consistencia tonal en altas resoluciones. Distribuido con el mismo paquete de modelo que el anterior.
  • Plantilla oficial (referencia): Un gráfico autoritativo de texto a imagen que puedes comparar o adaptar a tus necesidades. image_qwen_image_2_1_t2i.json

Cómo usar el flujo de trabajo de Qwen Image 2.1 Texto a Imagen en ComfyUI#

Flujo general: los prompts y una condición de semilla condicionan el modelo, un sampler produce la imagen en el espacio latente, el VAE decodifica a píxeles, y la salida se guarda como un PNG RGBA. Los grupos se ejecutan de izquierda a derecha para que puedas previsualizar e iterar rápidamente.

Prompt y estilo

  • Usa el prompt positivo para la intención y dirección artística y el prompt negativo para mantener fuera los artefactos. Para retratos de moda, referencia la iluminación, el ángulo de la cámara, la lente y los materiales; para marcos cinematográficos, guía el estado de ánimo y la gradación de color; para tomas de productos, especifica superficies, iluminación de estudio y reflejos. Mantén una semilla estable cuando desees una reproducibilidad estricta a través de ajustes de prompt.

Resolución y semilla

  • Establece tu tamaño objetivo en el nodo de resolución antes de muestrear. El flujo de trabajo está validado en 2048×2048 con pesos INT8 y tamaño de lote 1 para fiabilidad en GPUs modernas. Si necesitas previsualizaciones más rápidas, baja a 1024 o 1536 y luego regresa a 2048 para los renders finales. La semilla es expuesta al usuario para que puedas bloquear variaciones o explorar aleatoriamente.

Carga de modelos

  • El grupo de modelos carga los pesos INT8 de Qwen-Image-2.1 y el VAE compañero. No se requiere cableado manual más allá de seleccionar los checkpoints correctos. Los prompts se codifican y pasan al generador para que el sampler tenga tanto el condicionamiento de texto como el lienzo latente que necesita.

Muestreo

  • Una etapa KSampler maneja la trayectoria de difusión. Los pasos y CFG están expuestos para que puedas equilibrar la velocidad y la adherencia al prompt. Las elecciones de sampler y scheduler se incluyen para el control de estilo y estabilidad; comienza con los valores predeterminados, luego ajusta solo cuando necesites un aspecto diferente o un seguimiento más estricto del prompt.

Decodificar y guardar

  • El VAE decodifica el latente final en una imagen y el grupo de guardar escribe PNGs RGBA. Si tu composición asume transparencia (logotipos, superposiciones de UI, recortes de productos), el exportador preserva el canal alfa para que los activos caigan directamente en las herramientas de diseño sin enmascaramiento adicional.

Nodos clave en el flujo de trabajo de Qwen Image 2.1 Texto a Imagen en ComfyUI#

  • UNETLoader Carga la columna vertebral de difusión INT8 de Qwen-Image-2.1 que realmente realiza la generación. Mantén esto apuntado a los pesos 2.1 para consistencia a través de sesiones; cambia solo cuando estés evaluando variantes.
  • CLIPLoader o cargador de codificador de texto específico del modelo Inicializa el codificador de prompt para que tu texto se incruste correctamente para el generador. Si cambias codificadores, retoca ligeramente el CFG y revisa la fraseología del prompt para mantener la misma intención visual.
  • EmptySD3LatentImage Define el tamaño del lienzo latente y el lote. Establece el ancho y la altura aquí a 2048 × 2048 para finales, luego ajusta hacia abajo para borradores más rápidos. Mantén el tamaño del lote 1 en resolución nativa para evitar presión en VRAM.
  • KSampler Conduce el proceso de difusión. Usa pasos para intercambiar velocidad por detalle y ajusta cfg para apretar o relajar la adherencia al prompt. Si cambias samplers o schedulers, haz cambios pequeños e incrementales y compara resultados con una semilla fija.
  • SaveImage Exporta la imagen decodificada como un PNG RGBA con tu patrón de nombres elegido. Esto preserva la transparencia para la composición y asegura una reproducibilidad exacta cuando se combina con una semilla fija y un prompt.

Extras opcionales#

  • Patrones de prompt que funcionan: “retrato de moda de 35mm, luz de borde suave, estilo editorial, detalle de textura de tela, fondo neutro” o “toma amplia cinematográfica, luz volumétrica a través de persianas, gradación teal–orange, alto contraste” o “render de producto de estudio, taza de cerámica brillante, iluminación de tres puntos, sombra suave en papel continuo.”
  • Reproducibilidad: Registra el prompt, prompt negativo, semilla y resolución con cada exportación. Pequeñas ediciones contra una semilla fija son la forma más rápida de ajustar la apariencia sin perder la composición.
  • Rendimiento: Los pesos INT8 reducen el uso de VRAM y hacen práctico el 2048×2048. Para hardware de menor memoria, previsualiza a 1024 y luego escala o vuelve a renderizar a tamaño completo cuando estés satisfecho.
  • Construcción de referencia: Si deseas comparar la estructura del nodo o restaurar los valores predeterminados, comienza desde la plantilla oficial y migra tus nodos de prompt y guardar. image_qwen_image_2_1_t2i.json
  • Paquete de modelos: Usa la distribución mantenida de Comfy-Org para un comportamiento consistente a través de entornos. Comfy-Org/Qwen-Image-2.1

Agradecimientos#

Este flujo de trabajo implementa y se basa en los siguientes trabajos y recursos. Agradecemos a Comfy.org por el artículo de lanzamiento de ComfyUI, a Comfy-Org por los pesos abiertos de Qwen-Image-2.1, y a Comfy-Org por la plantilla oficial de flujo de trabajo de texto a imagen por sus contribuciones y mantenimiento. Para detalles autorizados, por favor consulta la documentación original y los repositorios enlazados a continuación.

Recursos#

Nota: El uso de los modelos, conjuntos de datos y código referenciados está sujeto a las respectivas licencias y términos proporcionados por sus autores y mantenedores.

RunComfy
Derechos de autor 2026 RunComfy. Todos los derechos reservados.

RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.