Segmenta un elemento de una imagen a partir de una breve descripción de texto.
| Parámetro | Tipo | Valor predeterminado/rango | Descripción |
|---|---|---|---|
| prompt | string | "" | Instrucción en lenguaje natural que describe la edición. Indica con claridad qué debe cambiar y qué debe conservarse. |
| negative_prompt | string | "" | Elementos que deben evitarse en el resultado, por ejemplo, «sin desenfoque» o «sin marca de agua». |
| Parámetro | Tipo | Valor predeterminado/rango | Descripción |
|---|---|---|---|
| image_urls | array (image URIs) | [] | Hasta 10 imágenes de entrada. La primera es la base que se editará; las demás sirven como referencia de estilo o composición. |
| Parámetro | Tipo | Valor predeterminado/rango | Descripción |
|---|---|---|---|
| image_size | string | square; presets: square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3, landscape_16_9 | Selecciona una de las relaciones de aspecto predefinidas. |
| num_inference_steps | integer | 28 | Número de pasos de difusión. Aumentarlo puede mejorar el detalle; reducirlo acelera la generación. |
| guidance_scale | float | 4.5 | Intensidad con la que el resultado sigue el prompt. Los valores altos obedecen la instrucción con mayor rigor, pero pueden reducir la libertad creativa. |
| output_format | string | png; options: jpeg, png, webp | Formato de la imagen de salida. Elígelo en función del flujo de trabajo posterior. |
Los desarrolladores pueden usar Qwen Image Edit 2511 en la API de RunComfy mediante solicitudes HTTP estándar. Envía las imágenes de base junto con prompt y negative_prompt y ajusta num_inference_steps, guidance_scale, seed y output_format para obtener ediciones coherentes y detalladas. La automatización basada en REST permite incorporarlo a procesos de producción.
Nota: endpoint de API de Qwen Image Edit 2511
Segmenta un elemento de una imagen a partir de una breve descripción de texto.
Genera de 1 a 4 imágenes a partir de un prompt obligatorio, con 10 relaciones de aspecto, resolución 1K, 2K o 4K, tres formatos de archivo y retorno síncrono opcional.
Imágenes detalladas y texto preciso para creadores visuales
WAN 2.7 Pro text-to-image genera imágenes fijas de alta fidelidad para impresión y gran formato. Conserva los mismos controles del modelo Standard, admite prompts bilingües y produce hasta cinco imágenes por ejecución.
Genere imágenes de diseño precisas con control refinado y detalles repetibles.
Flux 2 Turbo Text to Image genera imágenes detalladas a partir de texto con control de fidelidad al prompt, semillas reproducibles y formatos predefinidos.
Qwen Image Edit 2511 es un modelo de edición de imágenes con 20.000 millones de parámetros centrado en la coherencia y la precisión geométrica. Conserva mejor la identidad de una o varias personas, mejora la fidelidad al editar texto e integra estilos LoRA de la comunidad directamente en el modelo base. Estas mejoras lo diferencian de versiones anteriores de Qwen, como 2509.
La resolución de salida máxima admitida es de aproximadamente 4096×4096 píxeles por edición y se pueden usar hasta tres imágenes de referencia. El prompt está limitado a unos 1.024 tokens. Las solicitudes de API que superen estos límites pueden truncarse o ajustarse de escala.
Sí. Una tarea de edición puede usar hasta tres imágenes de origen para combinar o transformar sujetos y productos. El modelo fusiona los detalles mediante un condicionamiento similar a ControlNet y adaptadores paralelos, lo que mejora la coherencia entre todas las referencias.
Primero puedes crear un prototipo con Qwen Image Edit 2511 en la interfaz web de la página del modelo de RunComfy. Después, genera una clave de acceso desde el panel de tu cuenta y automatiza por API el mismo prompt y los mismos parámetros de control. La documentación de RunComfy explica el escalado para producción en la sección «Integración de API».
Qwen Image Edit 2511 mantiene una estructura más estable, sobre todo en diseño industrial, productos y ediciones con mucho texto. Seedream 4.5 destaca en ampliaciones artísticas y estilización; Qwen Image Edit 2511 conserva mejor el texto, la geometría y la identidad a lo largo de varias ediciones.
Nano Banana Pro puede aventajarlo ligeramente en iluminación extremadamente fotorrealista y cambios pequeños descritos con prompts breves. Qwen Image Edit 2511 reduce esa diferencia gracias a una menor deriva y una mejor coherencia entre varias personas. Destaca especialmente en manipulaciones estructurales y trabajos que exigen fidelidad tipográfica.
El acceso está sujeto a las condiciones de modelos alojados de RunComfy. Antes de usar comercialmente las imágenes generadas, los desarrolladores también deben comprobar la licencia original de Alibaba o Tongyi-Lab, en especial las condiciones de atribución y de obras derivadas.
El editor conserva la geometría de la escena y permite cambios como insertar objetos, sustituir fondos o mejorar la coherencia de la iluminación. Por ello resulta útil para comercio electrónico, iteraciones de diseño y campañas que necesitan mantener un estilo visual uniforme.
Su canal de codificación dual alinea directamente los embeddings semánticos con las características visuales del VAE. Así disminuyen las diferencias en rostros o rasgos de marca entre varias pasadas de edición y se conserva el sujeto mejor que en variantes anteriores de Qwen.
Al editar o sustituir texto, el modelo procura conservar la tipografía, el tamaño y el estilo originales. De este modo logra una alineación tipográfica muy precisa, especialmente útil para equipos de UI/UX y diseño gráfico.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.






