Cree imágenes detalladas a partir de indicaciones escritas con controles de tamaño, fondo, calidad y formato de salida.
| Parámetro | Tipo | Valor/límite | Descripción |
|---|---|---|---|
| prompt | string | Menos de 2000 caracteres | Descripción principal de la imagen. Conviene especificar sujeto, estilo, luz, ambiente y composición. |
| negative_prompt | string | Máx. 500 caracteres | Elementos o rasgos que deben evitarse. |
| Parámetro | Tipo | Valor/límite | Descripción |
|---|---|---|---|
| image_url | image_uri | Opcional; JPEG/JPG/PNG sin alfa/BMP/WEBP; 384–5000 px por lado; máx. 10 MB | Imagen de referencia para estilo, identidad o edición. |
| Parámetro | Tipo | Valor/límite | Descripción |
|---|---|---|---|
| image_size | string | Predeterminado: 1024*1024 (1:1); 8 tamaños fijos | Elige 10241024 (1:1), 8001200 (2:3), 1200800 (3:2), 9601280 (3:4), 1280960 (4:3), 7201280 (9:16), 1280720 (16:9) o 1344576 (21:9). |
| max_images | integer | Predeterminado: 1; rango: 1–5 | Define el máximo; el modelo puede devolver menos imágenes. |
| seed | integer | Predeterminado: 0; rango: 0–2147483647 | Un seed fijo ayuda a obtener resultados reproducibles. |
Wan 2.6 Text to Image se integra mediante la API de RunComfy con solicitudes HTTP estándar. Envía el prompt, una referencia opcional y el tamaño de salida para automatizar la generación en procesos creativos o de CI/CD.
Nota: endpoint de API de Wan 2.6 Text to Image
Para movimiento y narrativa, utiliza Wan 2.6 Text to Video: https://www.runcomfy.com/models/wan-ai/wan-2-6/text-to-video
Para animar una imagen existente, utiliza Wan 2.6 Image to Video: https://www.runcomfy.com/models/wan-ai/wan-2-6/image-to-video
Cree imágenes detalladas a partir de indicaciones escritas con controles de tamaño, fondo, calidad y formato de salida.
Edición de imágenes rápida, económica y guiada por prompts con resolución fija de 1K.
Edita o combina entre 1 y 10 imágenes con un prompt y elige relación de aspecto, formato y número de resultados.
Crea imágenes realistas a partir de prompts, con tipografía precisa en chino e inglés y composiciones equilibradas.
Crea imágenes asombrosas desde texto con IA avanzada y edición precisa.
Crea y edita imágenes desde texto con control preciso y resultados coherentes.
Wan 2.6 Text to Image crea imágenes estáticas de alta calidad a partir de prompts. También admite una imagen de referencia opcional para controlar mejor el estilo, la identidad del sujeto o una edición concreta. Se centra en seguir el prompt, representar texturas realistas y mantener una composición estable.
Wan 2.6 Text to Image reúne la generación de texto a imagen y el control opcional mediante referencias en un mismo flujo. Resulta especialmente útil cuando la identidad visual, los elementos de marca y las revisiones dirigidas son más importantes que una generación aislada sin referencia.
Puedes elegir 1024×1024 (1:1), 800×1200 (2:3), 1200×800 (3:2), 960×1280 (3:4), 1280×960 (4:3), 720×1280 (9:16), 1280×720 (16:9) o 1344×576 (21:9). Esta interfaz no ofrece otros tamaños ni dimensiones personalizadas.
El prompt debe tener menos de 2000 caracteres y el prompt negativo admite un máximo de 500. La referencia opcional debe ser JPEG, JPG, PNG sin canal alfa, BMP o WEBP, medir entre 384 y 5000 píxeles por lado y ocupar como máximo 10 MB.
Después de probar el modelo en la interfaz de RunComfy, puedes llamar al mismo flujo mediante el endpoint de API de Wan 2.6 Text to Image y tu clave de API. Envía por HTTP el prompt, la referencia opcional y el tamaño. La página indica un precio de $0.015 por imagen; comprueba que tu cuenta tenga créditos antes de llamar a la API.
La imagen de referencia opcional aporta los rasgos del sujeto y el estilo, mientras el prompt describe la escena deseada. Mantener la misma referencia y usar instrucciones claras mejora la coherencia, aunque no garantiza resultados idénticos en cada generación.
No. Este modelo solo genera imágenes estáticas. Para vídeo, utiliza Wan 2.6 Text to Video o Wan 2.6 Image to Video; la sincronización de audio o de labios no forma parte de este endpoint de texto a imagen.
El modelo se ofrece bajo las condiciones de Alibaba Cloud Model Studio. El uso comercial depende de esas condiciones, de tu región y de tu contrato; según la página del modelo, los usuarios gratuitos no disponen de licencia comercial. Revisa siempre las condiciones vigentes antes de publicar.
max_images permite fijar un máximo de 1 a 5 imágenes, aunque el modelo puede devolver menos. Un seed fijo entre 0 y 2147483647 facilita la reproducción, pero no garantiza una serie idéntica píxel por píxel.
Sí. Para contenido vertical ofrece 720×1280 (9:16), 800×1200 (2:3) y 960×1280 (3:4). Para piezas cuadradas o panorámicas puedes elegir 1:1, 4:3, 3:2, 16:9 o 21:9.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.





