Convierte imágenes y textos en videos HD con movimiento realista.
Wan 3.0 Text To Video lee una descripción en lenguaje sencillo y devuelve un breve clip cinematográfico. Describes el tema, la acción, la cámara y la luz; el modelo compone la toma, impulsa el movimiento y puede agregar audio coincidente en una sola pasada.
Esta página cubre el punto final de solo texto de la familia Wan 3.0. No hay ninguna imagen para cargar, por lo que es una manera rápida de explorar una idea, bloquear una escena o producir una toma corta terminada solo con palabras.
| Parámetro | Requerido | Tipo | Predeterminado | Gama / Opciones | Descripción |
|---|---|---|---|---|---|
| mensaje* | Sí (*) | cadena | - | - | Escena, sujeto, acción, cámara, iluminación y movimiento. |
| resolución | No | cadena | 720p | 480p, 720p, 1080p | Nivel de resolución de salida. |
| aspect_ratio | No | cadena | 16:9 | 16:9, 9:16, 1:1, 4:3, 3:4, adaptive | Relación de aspecto de salida. |
| duración | No | entero | 5 | 2-30 | Duración de la salida en segundos. |
| thinking_mode | No | booleano | falso | verdadero/falso | Interpretación más profunda para indicaciones complejas. |
| enable_audio | No | booleano | verdadero | verdadero/falso | Incluye una pista de audio sincronizada. |
| semilla | No | entero | aleatorio | 0-2147483647 | Semilla para resultados reproducibles. |
El precio depende de la resolución elegida: $0,06 por segundo en 480p, $0,12 por segundo en 720p y $0,25 por segundo en 1080p. Habilitar o deshabilitar el audio no cambia la tarifa.
Convierte imágenes y textos en videos HD con movimiento realista.
Transforma imágenes en videos cinematográficos al instante con la potencia creativa de Veo 3.1 Fast.
Convierte imágenes en videos fluidos y cinematográficos con IA
Convierta una imagen de referencia en un vídeo de 5 o 10 segundos, con un prompt negativo opcional y generación de audio nativo.
Genere video entre los fotogramas inicial y final con audio opcional
Modifique un fragmento concreto de un vídeo mediante un prompt y sustituya el audio, la imagen o ambos.
Wan 3.0 Text To Video genera un clip cinematográfico corto directamente a partir de un mensaje escrito, sin necesidad de imagen de referencia. Es útil para la previsualización de conceptos, tomas publicitarias y promocionales, y videos sociales, permitiéndole visualizar una idea en minutos solo con palabras.
El punto final de texto a video comienza solo a partir de un mensaje, por lo que el modelo compone toda la escena, mientras que el punto final de imagen a video anima un primer fotograma específico que usted proporciona. Elige Wan 3.0 Text To Video cuando quieras que el modelo invente el encuadre, e imagen a vídeo cuando ya tengas la toma inicial.
Wan 3.0 Text To Video sigue indicaciones estructuradas que nombran el sujeto, la acción, el movimiento de la cámara y la iluminación, y produce un movimiento coherente similar al de una película. Las indicaciones claras y concretas con una única dirección de cámara por toma generalmente dan los resultados más predecibles.
Admite salida 480p, 720p y 1080p, una duración de 2 a 30 segundos y relaciones de aspecto que incluyen 16:9, 9:16, 1:1, 4:3 y 3:4. Utilice 480p para borradores rápidos y 1080p para entrega; verifique el panel RunComfy para conocer los límites de corriente exactos.
Sí. Wan 3.0 Text To Video puede generar una pista de audio sincronizada con el video y puede desactivar el audio para una exportación silenciosa. Habilitar o deshabilitar el audio no afecta el precio.
El modo de pensamiento permite una interpretación más deliberada del mensaje, lo que puede ayudar cuando una escena combina varias acciones, temas o reglas de composición. Es opcional y está desactivado de forma predeterminada, por lo que puede habilitarlo para mensajes complejos y dejarlo desactivado para mensajes simples.
Sí. Puede crear un prototipo de Wan 3.0 Text To Video en la interfaz de usuario del modelo RunComfy y luego llamar al mismo modelo a través de RunComfy HTTP API con los mismos parámetros. Esto hace que sea sencillo pasar de las pruebas del navegador a un flujo de trabajo de producción automatizado.
Las generaciones consumen dólares o créditos según la resolución y la duración: $0,06 por segundo a 480p, $0,12 por segundo a 720p y $0,25 por segundo a 1080p. Los nuevos usuarios generalmente reciben una cantidad de prueba gratuita para probar Wan 3.0 Text To Video primero.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.





