Generación y edición de imágenes con control de composición y capas
Qwen Image 2512 es un modelo de texto a imagen disponible en RunComfy que genera una única imagen fija de alta calidad a partir de un prompt y un negative_prompt opcional. Es adecuado para diseño creativo, piezas de marketing, carteles con texto integrado y escenas fotorrealistas.
Formatos de salida: square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3, landscape_16_9
| Parámetro | Obligatorio | Type | Default | Range / Options | Descripción |
|---|---|---|---|---|---|
| prompt* | Sí (*) | string | — | — | Prompt a partir del cual se genera la imagen. |
| negative_prompt | No | string | "" | — | Términos opcionales para reducir o evitar determinados elementos. |
| image_size | No | ImageSize | Enum or object | landscape_4_3 | Enum: square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3, landscape_16_9. |
| num_inference_steps | No | integer | 28 | — | Número de pasos de inferencia; un valor mayor puede aportar más detalle a costa de velocidad. |
| guidance_scale | No | float | 5 | — | Intensidad de seguimiento del prompt; los valores medios suelen equilibrar precisión y creatividad. |
| seed | No | integer | — | — | Semilla fija para reproducir resultados con la misma configuración. |
| output_format | No | OutputFormatEnum | "png" | jpeg, png, webp | Formato de archivo de la imagen resultante. |
Generación y edición de imágenes con control de composición y capas
Genera con FLUX1.1 Pro imágenes detalladas, de composición precisa y fieles al prompt.
Crea imágenes 4K precisas con herramientas flexibles de fusión y texto
Edite hasta tres imágenes con un máximo de tres LoRA y controles precisos de escala de guía, pasos de inferencia, tamaño, semilla y formato de salida.
Genera una imagen únicamente desde un prompt y elige entre 2K, 4K y nueve tamaños fijos.
Seedream 5.0 Lite Texto a Imagen: motor de prompts a visuales con control preciso de composición y tipografía
Después de las pruebas en la página del modelo de RunComfy, los desarrolladores pueden reutilizar la misma configuración mediante la API de RunComfy. Solo deben crear una clave API, definir los parámetros de generación en el código, controlar el uso y los costes y respetar las condiciones de Apache 2.0 al desplegar Qwen Image 2512 en producción.
Qwen Image 2512 maneja texto en chino e inglés con alta precisión y admite párrafos de varias líneas y carteles en varios idiomas. Su formación integra la comprensión del diseño, lo que permite a los desarrolladores y diseñadores mantener una alineación de fuentes clara y una distorsión mínima incluso en diseños complejos.
Qwen Image 2512 destaca en la representación de variaciones de tonos de piel, detalles del cabello y posturas corporales expresivas, manteniendo al mismo tiempo un texto incrustado limpio y legible. Estos puntos fuertes lo hacen ideal para portadas de revistas, anuncios e infografías que requieren tanto realismo como tipografía exacta.
A diferencia de algunos competidores que se centran principalmente en el estilo fotorrealista o la salida con resolución 4K, Qwen Image 2512 prioriza la reproducción fiel del texto y texturas naturales equilibradas. Además, tiene una velocidad de generación rápida. Los resultados de referencia indican que su alineación de diseño para contenido bilingüe supera las alternativas comparables de código abierto.
Qwen Image 2512 es óptimo para agencias, educadores y editores que buscan infografías, carteles y elementos visuales publicitarios multilingües de alta calidad. Ofrece una combinación de realismo de imagen de nivel profesional y flexibilidad generativa, lo que lo hace adecuado tanto para el diseño de prototipos como para la producción a escala.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.





