logo
RunComfy
  • ComfyUI
  • EntrenadorNuevo
  • Modelos
  • API
  • Precios
discord logo
MODELOS
Explorar
Todos los modelos
BIBLIOTECA
Generaciones
APIS DE MODELOS
Documentación de la API
Claves API
CUENTA
Uso

Happy Horse 1.1: generación de video con IA y audio nativo en RunComfy Models y mediante la API | RunComfy

alibaba/happyhorse-1.1/text-to-video

Happy Horse 1.1 es el modelo de video multimodal de Alibaba para generar desde texto, imágenes o referencias y editar video con audio nativo. Esta página ofrece el modo text-to-video en 720P o 1080P y con una duración de 3 a 15 segundos.

Describe la escena, la acción y el movimiento de cámara que quieres ver en el video.
Nivel de resolución del video generado.
Relación de aspecto del video generado.
Duración del video generado, en segundos.
Idle
The rate is $0.13 per second for 720P, and $0.16 per second for 1080P.

Introducción a Happy Horse 1.1

Happy Horse 1.1 de Alibaba es un modelo de video multimodal nativo que reúne text-to-video, image-to-video, reference-to-video y edición de video. En una sola pasada crea clips con movimientos fluidos y físicamente creíbles y genera audio sincronizado. Este flujo basado en prompts reemplaza la planificación manual de planos, la creación de sonido por separado y los procesos de render lentos, al tiempo que corrige varios puntos débiles de la generación 1.0. En esta página de RunComfy, Happy Horse 1.1 funciona en modo text-to-video, con una tarifa de $0.13 por segundo en 720P o $0.16 por segundo en 1080P y una duración de 3 a 15 segundos. Puedes usarlo en el navegador o mediante una API HTTP, sin alojar ni escalar el modelo.
Ideal para: videos cortos para redes sociales | prototipos de escenas narrativas | clips animados de productos y anuncios

Alibaba / Happy Horse 1.1#


Happy Horse 1.1 es el modelo de video multimodal nativo de Alibaba. La familia completa reúne cuatro funciones —text-to-video, image-to-video, reference-to-video y edición de video— sobre una misma arquitectura que genera imagen y sonido a la vez. El diálogo, el sonido ambiente y los efectos Foley quedan sincronizados con la acción desde el primer render, en lugar de añadirse después.


El modelo está optimizado para lograr resultados de calidad cinematográfica: movimientos creíbles y físicamente coherentes, luces y sombras con matices y recursos de cámara como acercamientos, alejamientos y cambios de foco selectivo. También conserva la identidad de los personajes y la continuidad de la escena en secuencias de varias tomas, y admite estilos que van del video realista a la pintura con tinta, las figuras de papel o el stop motion con plastilina.


Esta versión mejora la generación 1.0. Las acciones que antes podían sentirse lentas ahora tienen más ritmo y peso, y el modelo mantiene mejor el parecido en una gama más amplia de sujetos, incluidos los rostros asiáticos.


En esta página de RunComfy, Happy Horse 1.1 funciona en modo text-to-video: escribe un prompt y obtendrás un clip corto con sonido integrado. Los modos image-to-video, reference-to-video y edición forman parte de la misma familia.


Formato de salida: resolución 720P o 1080P / fps 24 / duración 3-15 s / relación de aspecto 16:9, 9:16 o 1:1 / audio incluido


Aspectos destacados#


  • Un modelo, cuatro modos: Happy Horse 1.1 abarca text-to-video, image-to-video, reference-to-video y edición de video; esta página ofrece el modo text-to-video.
  • Sincronización audiovisual nativa: el diálogo, el sonido ambiente y los efectos Foley se generan junto con el video en una sola pasada.
  • Acabado cinematográfico: el control de la profundidad de campo, la atmósfera y la iluminación da a los planos medios y cortos un aspecto de película.
  • Cámara expresiva: admite acercamientos, alejamientos y transiciones de profundidad de campo para crear planos dinámicos.
  • Narrativa de varias tomas: mantiene la identidad de los personajes y la continuidad entre cortes en clips de hasta 15 segundos.
  • Movimiento más fluido y dinámico: mejora el ritmo y la sensación de impulso respecto a la generación 1.0, con menos artefactos de deformación.
  • Amplia variedad de estilos: genera tanto video realista como estilos de pintura con tinta, figuras de papel o stop motion con plastilina.
  • Control de resolución y encuadre: elige 720P o 1080P, una relación 16:9, 9:16 o 1:1 y cualquier duración entre 3 y 15 segundos.

Parámetros#


ParámetroObligatorioTipoPredeterminadoRango / opcionesDescripción
prompt*Sí (*)string——Descripción de la escena, la acción y el movimiento de cámara.
resolutionNostring1080P720P, 1080PNivel de resolución de salida.
ratioNostring16:916:9, 9:16, 1:1Relación de aspecto del video.
durationNointeger53-15Duración del clip, en segundos.

Precios#


El precio se calcula según la duración y la resolución:


ResoluciónTarifa
720P$0.13 por segundo
1080P$0.16 por segundo

Ejemplos de coste estimado


Duración720P1080P
5 s (predeterminado)~$0.65~$0.80
10 s~$1.30~$1.60
15 s~$1.95~$2.40

Cómo usarlo#


  1. Abre la página del modelo en RunComfy y selecciona Happy Horse 1.1 en el catálogo de modelos.
  2. Escribe un prompt que indique el sujeto, la acción, el entorno, el movimiento de cámara y el ambiente.
  3. Elige la resolución: 720P para hacer pruebas a menor coste o 1080P para el resultado final.
  4. Ajusta la relación de aspecto al destino del clip: 16:9 para horizontal, 9:16 para vertical o 1:1 para cuadrado.
  5. Define una duración de 3 a 15 segundos; empieza con un clip corto mientras afinas el estilo.
  6. Genera el video y revisa tanto el movimiento como el audio en la vista previa.
  7. Retoca unas pocas palabras cada vez y vuelve a generar. Después, descarga el resultado o usa los mismos parámetros mediante la interfaz o la API de RunComfy.

Consejos para prompts y referencias#


  • Empieza por el sujeto principal y una acción clara; añade después el entorno y la iluminación.
  • Describe de forma explícita qué debe moverse y cómo, por ejemplo, caminar, desplazarse o girar la cámara.
  • Incluye las pistas sonoras que quieras oír, ya que Happy Horse 1.1 genera el audio junto con el video.
  • Mantén un ambiente dominante por clip y evita mezclar indicaciones de tono contradictorias.
  • Prueba primero con una duración corta antes de invertir en un render de 15 segundos.

Comparación de Happy Horse 1.1 con otros modelos#


  • Frente a Happy Horse 1.0, ofrece movimientos más dinámicos, menos deformaciones y un tratamiento más estable de rostros diversos, según la información pública disponible.
  • Frente a los modelos de video sin sonido, integra diálogo, ambiente y efectos Foley sincronizados, por lo que no necesitas una fase de audio aparte.
  • La familia Happy Horse llamó la atención al encabezar la clasificación de pruebas a ciegas de Artificial Analysis Video Arena para text-to-video e image-to-video, gracias a la fluidez del movimiento, el color natural y la sincronización de audio.
  • Caso de uso ideal: elígelo cuando necesites convertir rápidamente una idea escrita en un clip cinematográfico con audio, no en un borrador silencioso.

Otros modelos que puedes probar#


  • Kling Video — Movimiento cinematográfico para tomas narrativas más largas.
  • Pika 2.2 — Iteración rápida para clips pensados para redes sociales.
  • Wan 2.7 — Text-to-video compatible con archivos de audio personalizados.
  • Seedance — Generación de escenas estilizadas y centradas en la atmósfera.

Modelos relacionados

seedance-1-0/pro/fast/text-to-video

Convierte texto en videos creativos en segundos con IA avanzada.

seedance-2.0-mini/video-to-video

Transforma un clip de origen mediante un prompt de texto y audio nativo.

ltx-2/fast/text-to-video

Genere un vídeo 16:9 a partir de un prompt de texto, con duración, resolución, frecuencia de fotogramas y audio opcional.

Kling 1.5 Pro

Convierte texto o imágenes en videos cinematográficos precisos

veo-3/text-to-video

Crea un vídeo con Google Veo 3 a partir de un prompt de texto y elige si quieres generar audio.

live-avatar

Convierta retratos fijos en vídeos expresivos y realistas con control y precisión.

Preguntas Frecuentes

¿Para qué sirve Happy Horse 1.1?

Happy Horse 1.1 es un modelo text-to-video que convierte un prompt escrito en un clip corto, con movimientos naturales y físicamente coherentes y audio integrado. Resulta útil para piezas breves en redes sociales, prototipos de escenas y animaciones de producto o publicidad cuando quieres obtener imagen y sonido a partir de una sola descripción.

¿Qué diferencias hay entre Happy Horse 1.1 y Happy Horse 1.0?

Happy Horse 1.1 corrige varios puntos débiles conocidos de la generación 1.0: las acciones tienen un ritmo más dinámico y el parecido se mantiene mejor en sujetos diversos, incluidos los rostros asiáticos. Según la información pública disponible, estas mejoras lo convierten en una opción más fiable para clips centrados en personajes.

¿Happy Horse 1.1 genera audio junto con el video?

Sí. Happy Horse 1.1 crea audio sincronizado al mismo tiempo que el video, por lo que el clip se entrega con sonido y no como un borrador silencioso. Puedes incluir en el prompt los sonidos que quieras para orientar el ambiente y los efectos.

¿Qué resoluciones y duraciones admite Happy Horse 1.1?

Happy Horse 1.1 genera video en 720P o 1080P a 24 fps, con una duración de 3 a 15 segundos. También puedes elegir una relación de aspecto 16:9, 9:16 o 1:1 para formatos horizontales, verticales o cuadrados.

¿Cómo se escribe un buen prompt para Happy Horse 1.1?

Empieza por el sujeto principal y una acción clara; añade después el entorno, la iluminación y el movimiento de cámara. Como Happy Horse 1.1 genera movimiento y sonido a la vez, describir ambos de forma concreta suele dar resultados más previsibles.

¿Qué límites de entrada debo tener en cuenta al usar Happy Horse 1.1?

El modelo recibe un prompt de texto y controles de resolución, relación de aspecto y duración. Los clips deben durar entre 3 y 15 segundos. Consulta el panel de parámetros de RunComfy para confirmar los límites actuales, ya que algunas opciones pueden variar según la configuración del proveedor.

¿Se puede usar Happy Horse 1.1 mediante la API de RunComfy?

Sí. Puedes probar Happy Horse 1.1 en la interfaz de RunComfy y, después, llamar al mismo modelo mediante la API con idénticos parámetros para automatizar el proceso. No necesitas alojar ni escalar el modelo por tu cuenta.

¿Cuánto cuesta generar con Happy Horse 1.1 en RunComfy?

Happy Horse 1.1 se factura por segundo de video y el importe se descuenta de tu saldo en usd o credits: $0.13 por segundo en 720P y $0.16 por segundo en 1080P. Por ejemplo, un clip de 5 segundos en 1080P cuesta unos $0.80. Consulta la sección Generation de la página para ver la información vigente.

Síguenos
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Soporte
  • Discord
  • Correo electrónico
  • Estado del sistema
  • afiliado
Modelos de Video
  • MiniMax H3
  • Minimax H3 Image to Video
  • FLUX 3 Video
  • Happy Horse 1.1 reference to video
  • Wan 2.6 Flash
  • Hailuo 2.3 Fast Standard
  • Ver todos los modelos →
Modelos de Imagen
  • FLUX 3 Image
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • seedream 4.0
  • GPT Image 2 Image Edit
  • Nano Banana Pro
  • Ver todos los modelos →
Legal
  • Términos de servicio
  • Política de privacidad
  • Política de cookies
RunComfy
Derechos de autor 2026 RunComfy. Todos los derechos reservados.

RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.

Ejemplos de Happy Horse 1.1

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...