Conversión de texto a imagen en menos de un segundo en 4 pasos con imágenes precisas
| Parámetro | Tipo | Valor/límite | Descripción |
|---|---|---|---|
| prompt | string | Menos de 2000 caracteres | Descripción principal de la imagen. Conviene especificar sujeto, estilo, luz, ambiente y composición. |
| negative_prompt | string | Máx. 500 caracteres | Elementos o rasgos que deben evitarse. |
| Parámetro | Tipo | Valor/límite | Descripción |
|---|---|---|---|
| image_url | image_uri | Opcional; JPEG/JPG/PNG sin alfa/BMP/WEBP; 384–5000 px por lado; máx. 10 MB | Imagen de referencia para estilo, identidad o edición. |
| Parámetro | Tipo | Valor/límite | Descripción |
|---|---|---|---|
| image_size | string | Predeterminado: 1024*1024 (1:1); 8 tamaños fijos | Elige 10241024 (1:1), 8001200 (2:3), 1200800 (3:2), 9601280 (3:4), 1280960 (4:3), 7201280 (9:16), 1280720 (16:9) o 1344576 (21:9). |
| max_images | integer | Predeterminado: 1; rango: 1–5 | Define el máximo; el modelo puede devolver menos imágenes. |
| seed | integer | Predeterminado: 0; rango: 0–2147483647 | Un seed fijo ayuda a obtener resultados reproducibles. |
Wan 2.6 Text to Image se integra mediante la API de RunComfy con solicitudes HTTP estándar. Envía el prompt, una referencia opcional y el tamaño de salida para automatizar la generación en procesos creativos o de CI/CD.
Nota: endpoint de API de Wan 2.6 Text to Image
Para movimiento y narrativa, utiliza Wan 2.6 Text to Video: https://www.runcomfy.com/models/wan-ai/wan-2-6/text-to-video
Para animar una imagen existente, utiliza Wan 2.6 Image to Video: https://www.runcomfy.com/models/wan-ai/wan-2-6/image-to-video
Conversión de texto a imagen en menos de un segundo en 4 pasos con imágenes precisas
Genera imágenes fotorrealistas, con texto preciso y un control detallado del prompt.
Crea secuencias visuales coherentes con control preciso de estilo y continuidad.
Edite de una a diez imágenes de referencia a partir de una instrucción de texto con ajustes preestablecidos de tamaño seleccionables, semillas y salida JPEG o PNG.
Qwen Image 2.1 T2I: 1K/2K alambiques aún con transparencia nativa
Edite una imagen de origen con un prompt de texto y controles para los pasos de inferencia, la fuerza para seguir las instrucciones del texto, la semilla y la salida JPEG, PNG o WebP.
Wan 2.6 Text to Image crea imágenes estáticas de alta calidad a partir de prompts. También admite una imagen de referencia opcional para controlar mejor el estilo, la identidad del sujeto o una edición concreta. Se centra en seguir el prompt, representar texturas realistas y mantener una composición estable.
Wan 2.6 Text to Image reúne la generación de texto a imagen y el control opcional mediante referencias en un mismo flujo. Resulta especialmente útil cuando la identidad visual, los elementos de marca y las revisiones dirigidas son más importantes que una generación aislada sin referencia.
Puedes elegir 1024×1024 (1:1), 800×1200 (2:3), 1200×800 (3:2), 960×1280 (3:4), 1280×960 (4:3), 720×1280 (9:16), 1280×720 (16:9) o 1344×576 (21:9). Esta interfaz no ofrece otros tamaños ni dimensiones personalizadas.
El prompt debe tener menos de 2000 caracteres y el prompt negativo admite un máximo de 500. La referencia opcional debe ser JPEG, JPG, PNG sin canal alfa, BMP o WEBP, medir entre 384 y 5000 píxeles por lado y ocupar como máximo 10 MB.
Después de probar el modelo en la interfaz de RunComfy, puedes llamar al mismo flujo mediante el endpoint de API de Wan 2.6 Text to Image y tu clave de API. Envía por HTTP el prompt, la referencia opcional y el tamaño. La página indica un precio de $0.015 por imagen; comprueba que tu cuenta tenga créditos antes de llamar a la API.
La imagen de referencia opcional aporta los rasgos del sujeto y el estilo, mientras el prompt describe la escena deseada. Mantener la misma referencia y usar instrucciones claras mejora la coherencia, aunque no garantiza resultados idénticos en cada generación.
No. Este modelo solo genera imágenes estáticas. Para vídeo, utiliza Wan 2.6 Text to Video o Wan 2.6 Image to Video; la sincronización de audio o de labios no forma parte de este endpoint de texto a imagen.
El modelo se ofrece bajo las condiciones de Alibaba Cloud Model Studio. El uso comercial depende de esas condiciones, de tu región y de tu contrato; según la página del modelo, los usuarios gratuitos no disponen de licencia comercial. Revisa siempre las condiciones vigentes antes de publicar.
max_images permite fijar un máximo de 1 a 5 imágenes, aunque el modelo puede devolver menos. Un seed fijo entre 0 y 2147483647 facilita la reproducción, pero no garantiza una serie idéntica píxel por píxel.
Sí. Para contenido vertical ofrece 720×1280 (9:16), 800×1200 (2:3) y 960×1280 (3:4). Para piezas cuadradas o panorámicas puedes elegir 1:1, 4:3, 3:2, 16:9 o 21:9.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.





