Genera canciones con voces de hasta 4 minutos a partir de etiquetas de estilo y letras.
Wan 3.0 Text To Video lee una descripción en lenguaje sencillo y devuelve un breve clip cinematográfico. Describes el tema, la acción, la cámara y la luz; el modelo compone la toma, impulsa el movimiento y puede agregar audio coincidente en una sola pasada.
Esta página cubre el punto final de solo texto de la familia Wan 3.0. No hay ninguna imagen para cargar, por lo que es una manera rápida de explorar una idea, bloquear una escena o producir una toma corta terminada solo con palabras.
| Parámetro | Requerido | Tipo | Predeterminado | Gama / Opciones | Descripción |
|---|---|---|---|---|---|
| mensaje* | Sí (*) | cadena | - | - | Escena, sujeto, acción, cámara, iluminación y movimiento. |
| resolución | No | cadena | 720p | 480p, 720p, 1080p | Nivel de resolución de salida. |
| aspect_ratio | No | cadena | 16:9 | 16:9, 9:16, 1:1, 4:3, 3:4, adaptive | Relación de aspecto de salida. |
| duración | No | entero | 5 | 2-30 | Duración de la salida en segundos. |
| enable_audio | No | booleano | verdadero | verdadero/falso | Incluye una pista de audio sincronizada. |
| semilla | No | entero | aleatorio | 0-2147483647 | Semilla para resultados reproducibles. |
El precio depende de la resolución elegida: $0,06 por segundo en 480p, $0,12 por segundo en 720p y $0,25 por segundo en 1080p. Habilitar o deshabilitar el audio no cambia la tarifa.
Genera canciones con voces de hasta 4 minutos a partir de etiquetas de estilo y letras.
Anima una imagen de referencia mediante el movimiento de un vídeo guía.
Anima la imagen de un personaje de referencia con el movimiento de un video de conducción mientras mantienes al personaje reconocible.
Procesa un vídeo existente con una pista de audio y añade, si lo necesitas, prompt y semilla.
Anima una imagen inicial mediante un prompt y controla LoRA, fotogramas, FPS, resolución, relación de aspecto, pasos y seed.
Convierte imágenes de referencia en un video fluido en 720P o 1080P con un solo prompt.
Wan 3.0 Text To Video genera un clip cinematográfico corto directamente a partir de un mensaje escrito, sin necesidad de imagen de referencia. Es útil para la previsualización de conceptos, tomas publicitarias y promocionales, y videos sociales, permitiéndole visualizar una idea en minutos solo con palabras.
El punto final de texto a video comienza solo a partir de un mensaje, por lo que el modelo compone toda la escena, mientras que el punto final de imagen a video anima un primer fotograma específico que usted proporciona. Elige Wan 3.0 Text To Video cuando quieras que el modelo invente el encuadre, e imagen a vídeo cuando ya tengas la toma inicial.
Wan 3.0 Text To Video sigue indicaciones estructuradas que nombran el sujeto, la acción, el movimiento de la cámara y la iluminación, y produce un movimiento coherente similar al de una película. Las indicaciones claras y concretas con una única dirección de cámara por toma generalmente dan los resultados más predecibles.
Admite salida 480p, 720p y 1080p, una duración de 2 a 30 segundos y relaciones de aspecto que incluyen 16:9, 9:16, 1:1, 4:3 y 3:4. Utilice 480p para borradores rápidos y 1080p para entrega; verifique el panel RunComfy para conocer los límites de corriente exactos.
Sí. Wan 3.0 Text To Video puede generar una pista de audio sincronizada con el video y puede desactivar el audio para una exportación silenciosa. Habilitar o deshabilitar el audio no afecta el precio.
El modo de pensamiento permite una interpretación más deliberada del mensaje, lo que puede ayudar cuando una escena combina varias acciones, temas o reglas de composición. Es opcional y está desactivado de forma predeterminada, por lo que puede habilitarlo para mensajes complejos y dejarlo desactivado para mensajes simples.
Sí. Puede crear un prototipo de Wan 3.0 Text To Video en la interfaz de usuario del modelo RunComfy y luego llamar al mismo modelo a través de RunComfy HTTP API con los mismos parámetros. Esto hace que sea sencillo pasar de las pruebas del navegador a un flujo de trabajo de producción automatizado.
Las generaciones consumen dólares o créditos según la resolución y la duración: $0,06 por segundo a 480p, $0,12 por segundo a 720p y $0,25 por segundo a 1080p. Los nuevos usuarios generalmente reciben una cantidad de prueba gratuita para probar Wan 3.0 Text To Video primero.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.





