HappyHorse 1.0 I2V en Alibaba anima una imagen fija en video nativo de 1080p con movimiento con precisión física y sujetos con identidad estable.
Seedance 2.0 Fast es un modelo text-to-video multimodal optimizado para la velocidad de ByteDance Seed que convierte descripciones de escenas y referencias opcionales en clips cinematográficos cortos. En RunComfy, la generación se controla con un prompt y imágenes opcionales (hasta 9), videos (hasta 3) y audio (hasta 3) para el modo de referencia multimodal, y puede configurar relación de aspecto, duración, resolution, generar audio, seed y herramientas opcionales (p. ej. [{ "type": "web_search" }] para permitir la búsqueda en línea cuando el modelo lo elija).
type: web_search para que el modelo pueda buscar en la web cuando sea necesario; marque usage.tool_usage.web_search en la respuesta de la consulta de tarea para saber cuántas búsquedas se ejecutaron.HappyHorse 1.0 I2V en Alibaba anima una imagen fija en video nativo de 1080p con movimiento con precisión física y sujetos con identidad estable.
Crea con Wan 2.2 Plus un vídeo de cinco segundos desde un prompt y elige tamaño, seed y ampliación del prompt.
Modifique un fragmento concreto de un vídeo mediante un prompt y sustituya el audio, la imagen o ambos.
Modelo de video con IA rápido y económico para crear clips de varias tomas con audio nativo y referencias.
Clips Image-to-Video de 3 a 15 segundos por $0.083 por segundo.
Genere un vídeo a partir de un prompt obligatorio con 6, 8 o 10 segundos, de 1080p a 2160p, 25 o 50 FPS, formato 16:9 fijo y audio generado opcional.
Seedance 2.0 Fast es el modelo de video multimodal orientado a la velocidad de ByteDance Seed: usted describe la escena en texto y puede agregar imágenes, video de referencia y audio de referencia para que el modelo alinee el movimiento, la apariencia y el sonido. En RunComfy, está optimizado para resultados más rápidos y al mismo tiempo admite clips cortos cinematográficos, audio nativo opcional, resultados con sincronización labial precisa y control de cámara cuando dirige la toma en su prompt.
La resolución es 480p o 720p (predeterminada). Relación de aspecto tiene como valor predeterminado adaptativo (el modelo elige la coincidencia más cercana; el resultado de la tarea muestra la relación de salida real). También puede fijarla en 16:9, 9:16, 4:3, 3:4, 1:1 o 21:9.
Solo se requiere prompt; las referencias son opcionales pero definen modo de referencia multimodal cuando las agrega. Prompt: se recomiendan aproximadamente ≤500 caracteres chinos o ≤1000 palabras en inglés. Imágenes: hasta 9 (jpeg, png, webp, bmp, tiff, gif). Videos de referencia: hasta 3 (mp4, mov), cada 2–15 segundos. Audio de referencia: hasta 3 (wav, mp3), cada 2–15 segundos y menos de 15 MB. Los prompts claros más las referencias alineadas generalmente brindan la identidad, el estilo y la sincronización más estables.
Duración es un número entero 4–15 segundos (predeterminado 5). Elija cualquier valor de segundo completo en ese rango por trabajo.
Con Generar audio (generate_audio) configurado en true (el valor predeterminado), el modelo puede generar video con audio sincronizado (diálogo, SFX o música). Configúrelo en false para video silencioso. La calidad de la sincronización labial depende de la precisión con la que describa el habla, el encuadre y el ritmo en el prompt; el audio de referencia también puede guiar el ritmo o el tono cuando utiliza referencias multimodales.
Elija Fast cuando más le interesen tiempos de espera más cortos e iteración rápida: los mismos campos del Playground (prompt, image_url, video_url, audio_url, aspect_ratio, duration, resolution, generate_audio, seed), con salida 480p/720p aquí y todos los límites de referencia multimodal. Elija Pro cuando desee la fidelidad cinematográfica más alta que ofrece el proveedor para una toma. Realice pruebas A/B con el mismo prompt y las mismas referencias para juzgar la calidad frente a la velocidad de su canalización.
Seedance 2.0 Fast se centra en clips cinematográficos cortos con referencias multimodales enriquecidas (muchas imágenes más video y audio opcionales), 4–15 s duración, relaciones de aspecto fijas o adaptativas y audio integrado cuando generate_audio está activado. Las mejoras dependen del caso de uso; compare usted mismo prompts, personajes y paquetes de referencia en lugar de depender de un único benchmark.
Depende del presupuesto, la latencia y el tipo de movimiento que necesite. En RunComfy, Seedance 2.0 Fast prioriza un text-to-video multimodal rápido con hasta nueve imágenes, tres videos de referencia, tres referencias de audio, ajustes predefinidos de 480p/720p y una opción para generar audio. Wan 2.5 y Kling 2.6 difieren en precios, límites y fortalezas: ejecute pruebas paralelas con sus briefs y conjuntos de referencia típicos.
Reproduzca el esquema de entrada del Playground: prompt, image_url, video_url, audio_url, aspect_ratio, duration, resolution, generate_audio y seed. Aplique los mismos límites de prompts y medios en su aplicación, luego autentíquese con su clave API y créditos para trabajos por lotes o automatizados.
El uso comercial depende de la licencia de ByteDance para el modelo y de los términos de servicio de RunComfy. Lea la licencia oficial del modelo y los documentos RunComfy, o envíe un correo electrónico a hi@runcomfy.com antes de utilizar el material generado en campañas pagas, trabajos para clientes o distribución amplia.
Creadores y equipos que necesitan generación rápida de videos multimodales: conceptos sociales y publicitarios, storyboards y previsualizaciones, cortos de marca y flujos de trabajo con muchas iteraciones donde la velocidad importa tanto como un solo fotograma principal. Combine texto con referencias cuando necesite apariencia, personaje o movimiento guiado por audio reproducible; luego pase a Pro para un pulido final cuando la toma lo amerite.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.





