Convierte texto en videos creativos en segundos con IA avanzada.
Happy Horse 1.1 es el modelo de video multimodal nativo de Alibaba. La familia completa reúne cuatro funciones —text-to-video, image-to-video, reference-to-video y edición de video— sobre una misma arquitectura que genera imagen y sonido a la vez. El diálogo, el sonido ambiente y los efectos Foley quedan sincronizados con la acción desde el primer render, en lugar de añadirse después.
El modelo está optimizado para lograr resultados de calidad cinematográfica: movimientos creíbles y físicamente coherentes, luces y sombras con matices y recursos de cámara como acercamientos, alejamientos y cambios de foco selectivo. También conserva la identidad de los personajes y la continuidad de la escena en secuencias de varias tomas, y admite estilos que van del video realista a la pintura con tinta, las figuras de papel o el stop motion con plastilina.
Esta versión mejora la generación 1.0. Las acciones que antes podían sentirse lentas ahora tienen más ritmo y peso, y el modelo mantiene mejor el parecido en una gama más amplia de sujetos, incluidos los rostros asiáticos.
En esta página de RunComfy, Happy Horse 1.1 funciona en modo text-to-video: escribe un prompt y obtendrás un clip corto con sonido integrado. Los modos image-to-video, reference-to-video y edición forman parte de la misma familia.
Formato de salida: resolución 720P o 1080P / fps 24 / duración 3-15 s / relación de aspecto 16:9, 9:16 o 1:1 / audio incluido
| Parámetro | Obligatorio | Tipo | Predeterminado | Rango / opciones | Descripción |
|---|---|---|---|---|---|
| prompt* | Sí (*) | string | — | — | Descripción de la escena, la acción y el movimiento de cámara. |
| resolution | No | string | 1080P | 720P, 1080P | Nivel de resolución de salida. |
| ratio | No | string | 16:9 | 16:9, 9:16, 1:1 | Relación de aspecto del video. |
| duration | No | integer | 5 | 3-15 | Duración del clip, en segundos. |
El precio se calcula según la duración y la resolución:
| Resolución | Tarifa |
|---|---|
| 720P | $0.13 por segundo |
| 1080P | $0.16 por segundo |
Ejemplos de coste estimado
| Duración | 720P | 1080P |
|---|---|---|
| 5 s (predeterminado) | ~$0.65 | ~$0.80 |
| 10 s | ~$1.30 | ~$1.60 |
| 15 s | ~$1.95 | ~$2.40 |
Convierte texto en videos creativos en segundos con IA avanzada.
Transforma un clip de origen mediante un prompt de texto y audio nativo.
Genere un vídeo 16:9 a partir de un prompt de texto, con duración, resolución, frecuencia de fotogramas y audio opcional.
Convierte texto o imágenes en videos cinematográficos precisos
Crea un vídeo con Google Veo 3 a partir de un prompt de texto y elige si quieres generar audio.
Convierta retratos fijos en vídeos expresivos y realistas con control y precisión.
Happy Horse 1.1 es un modelo text-to-video que convierte un prompt escrito en un clip corto, con movimientos naturales y físicamente coherentes y audio integrado. Resulta útil para piezas breves en redes sociales, prototipos de escenas y animaciones de producto o publicidad cuando quieres obtener imagen y sonido a partir de una sola descripción.
Happy Horse 1.1 corrige varios puntos débiles conocidos de la generación 1.0: las acciones tienen un ritmo más dinámico y el parecido se mantiene mejor en sujetos diversos, incluidos los rostros asiáticos. Según la información pública disponible, estas mejoras lo convierten en una opción más fiable para clips centrados en personajes.
Sí. Happy Horse 1.1 crea audio sincronizado al mismo tiempo que el video, por lo que el clip se entrega con sonido y no como un borrador silencioso. Puedes incluir en el prompt los sonidos que quieras para orientar el ambiente y los efectos.
Happy Horse 1.1 genera video en 720P o 1080P a 24 fps, con una duración de 3 a 15 segundos. También puedes elegir una relación de aspecto 16:9, 9:16 o 1:1 para formatos horizontales, verticales o cuadrados.
Empieza por el sujeto principal y una acción clara; añade después el entorno, la iluminación y el movimiento de cámara. Como Happy Horse 1.1 genera movimiento y sonido a la vez, describir ambos de forma concreta suele dar resultados más previsibles.
El modelo recibe un prompt de texto y controles de resolución, relación de aspecto y duración. Los clips deben durar entre 3 y 15 segundos. Consulta el panel de parámetros de RunComfy para confirmar los límites actuales, ya que algunas opciones pueden variar según la configuración del proveedor.
Sí. Puedes probar Happy Horse 1.1 en la interfaz de RunComfy y, después, llamar al mismo modelo mediante la API con idénticos parámetros para automatizar el proceso. No necesitas alojar ni escalar el modelo por tu cuenta.
Happy Horse 1.1 se factura por segundo de video y el importe se descuenta de tu saldo en usd o credits: $0.13 por segundo en 720P y $0.16 por segundo en 1080P. Por ejemplo, un clip de 5 segundos en 1080P cuesta unos $0.80. Consulta la sección Generation de la página para ver la información vigente.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.





