Genere una imagen a partir de texto con seis ajustes preestablecidos de tamaño exacto y controles para pasos de inferencia, orientación, semilla y salida JPEG, PNG o WebP.
Este modelo compacto de destiladores tanto escribe una nueva imagen a partir de texto como revisa fotos que ya tienes. Un conjunto de pesos Qwen Image 2.1 cubre texto a imagen e imagen a imagen, en 1K o 2K, con transparencia nativa opcional.
La generación solo con indicaciones no necesita carga. La edición añade de una a diez imágenes de referencia más una instrucción. Esta página ejecuta el flujo de trabajo de referencia Qwen Image 2.1; una página hermana ejecuta generación solo con indicaciones.
Los trabajos más amplios también funcionan con Qwen Image 2.1: expandir una selfie en un panorama, convertir una foto de producto en una infografía o crear un guion gráfico a partir de una hoja de personaje de tres vistas.
En esta página, Qwen Image 2.1 ejecuta imagen a imagen. Texto a imagen utiliza la misma resolución, proporción, fondo, formato, reescritura de la indicación y opciones de semilla, sin imágenes de referencia ni máscara.
| Parámetro | Requerido | Tipo | Predeterminado | Rango / Opciones | Descripción |
|---|---|---|---|---|---|
image_urls* | Sí (*) | Matriz | Imagen de ejemplo | 1–10 imágenes | Imágenes de referencia en el orden del prompt. JPEG, PNG o WebP; cada archivo hasta 30MB y 25MP. Mantenga cuatro o menos cuando la identidad deba permanecer nítida. |
prompt* | Sí (*) | Cadena | Instrucción de ejemplo | Hasta 5,000 caracteres | Describa la nueva imagen fija o la edición. Cite cualquier texto presente en la imagen. Con una máscara, describa lo que debería aparecer en el área blanca. |
mask_url | No | Cadena (imagen) | — | Opcional | Máscara de edición local en blanco y negro. Blanco para cambios, negro permanece. Requiere exactamente una referencia. La relación de aspecto y la reescritura del prompt se ignoran. No se puede combinar con un fondo transparente. |
aspect_ratio | No | Cadena | auto | auto, 1:1, 4:3, 3:4, 3:2, 2:3, 16:9, 9:16, 21:9, 9:21 | auto se ajusta a la primera referencia. Ignorado en modo máscara. El valor predeterminado de texto a imagen es 1:1. |
resolution | No | Cadena | 1K | 1K, 2K | 1K es más rápido; 2K tiene aproximadamente cuatro veces más píxeles y tarda más, especialmente con referencias. |
background | No | Cadena | opaquo | opaquo, transparente | transparente escribe un canal alfa real para nuevas imágenes fijas o recortes. Describe solo el sujeto. No se puede combinar con JPEG. |
output_format | No | Cadena | png | png, webp, jpeg | PNG y WebP pueden tener alfa. JPEG no puede. |
enhance_prompt | No | Booleano | true | true, false | Reescribe un breve prompt antes de generar o editar. Desactivar cuando ya es exacto. Ignorado en modo máscara. |
seed | No | Entero | -1 | -1 o 0–2147483647 | Fija una semilla para reproducir un resultado; usa -1 para una nueva variación. |
En esta página de imagen a imagen, Qwen Image 2.1 es $0.029 por imagen 1K y $0.119 por imagen 2K. Texto a imagen es $0.020 por imagen 1K y $0.079 por imagen 2K en su propia página. Las referencias adicionales no añaden un recargo listado. Para un lote, multiplica la tarifa del nivel seleccionado por el número de resultados.
Qwen Image 2.1 acepta preguntas mixtas de chino e inglés. Los sustantivos cortos y concretos superan a los mood boards largos.
Si Qwen Image 2.1 no es el punto de partida adecuado, compara estos modelos en RunComfy:
Genere una imagen a partir de texto con seis ajustes preestablecidos de tamaño exacto y controles para pasos de inferencia, orientación, semilla y salida JPEG, PNG o WebP.
Seedream 5.0 Lite transforma visuales de referencia en diseños con layout preciso y estilo consistente para flujos creativos.
Edita una imagen de origen mediante un prompt obligatorio, con máscara opcional, de 2 a 50 pasos de inferencia, resolución 480p o 720p, control de semilla y tres formatos de salida.
Cree una imagen a partir de un prompt y hasta siete imágenes de referencia, con relación de aspecto seleccionable, resolución 1080p–4K y control de semilla.
Edite de una a diez imágenes de referencia a partir de una instrucción de texto con ajustes preestablecidos de tamaño seleccionables, semillas y salida JPEG o PNG.
Modelo de edición con LoRA para transformar recursos visuales con precisión y conservar su estructura.
Qwen Image 2.1 revisa fotos a partir de una instrucción escrita mientras mantiene la identidad, la forma del producto y la disposición. Los trabajos típicos incluyen cambios de fondo, prueba virtual, composiciones grupales, repintado local y recortes transparentes de productos.
Puedes subir de una a diez imágenes de referencia. Qwen Image 2.1 las lee en orden de arreglo, por lo que "la primera imagen" y "la segunda imagen" en el aviso se corresponden con esa lista. Mantén el número en cuatro o menos cuando las caras o los logotipos deban mantenerse nítidos.
Sí. Configura el fondo como transparente para que Qwen Image 2.1 escriba un canal alfa real, o pídele que separe un sujeto de una foto RGB normal sobre una capa transparente. Usa PNG o WebP; JPEG no puede llevar alfa, y una máscara no se puede combinar con un fondo transparente.
Qwen Image 2.1 puede seguir círculos, marcas pintadas o una máscara en blanco y negro separada (el blanco cambia, el negro se mantiene). El modo máscara necesita exactamente una referencia, sigue la proporción de esa imagen y ignora la relación de aspecto y la reescritura del prompt. Describe lo que debería aparecer en el área blanca.
Qwen Image 2.1 ofrece salidas 1K o 2K y relaciones de aspecto que incluyen automático, 1:1, 4:3, 3:4, 3:2, 2:3, 16:9, 9:16, 21:9 y 9:21. Automático se ajusta a la primera referencia. Verifique el panel de parámetros actual de RunComfy para conocer las opciones exactas.
Sí. Los mismos pesos Qwen Image 2.1 manejan texto-a-imagen y imagen-a-imagen. Esta página es el flujo de trabajo de Editar/referencia; una página separada de texto-a-imagen genera a partir de un prompt sin subir fotos.
Sí. Prototipa una edición en la interfaz del modelo RunComfy, luego llama al mismo modelo Qwen Image 2.1 a través del RunComfy HTTP API con parámetros idénticos. No necesitas hospedar o escalar el modelo tú mismo.
Las generaciones consumen USD o créditos. Qwen Image 2.1 se factura a $0.029 por cada imagen de salida 1K y a $0.119 por cada imagen de salida 2K. Las referencias adicionales no agregan un recargo listado en esta página; los usuarios nuevos típicamente reciben una cantidad de prueba gratuita para probar.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.





