Convierte imágenes en videos con realismo y control artístico para diseñadores.
Seedance 2.0 Fast es un modelo text-to-video multimodal optimizado para la velocidad de ByteDance Seed que convierte descripciones de escenas y referencias opcionales en clips cinematográficos cortos. En RunComfy, la generación se controla con un prompt y imágenes opcionales (hasta 9), videos (hasta 3) y audio (hasta 3) para el modo de referencia multimodal, y puede configurar relación de aspecto, duración, resolution, generar audio, seed y herramientas opcionales (p. ej. [{ "type": "web_search" }] para permitir la búsqueda en línea cuando el modelo lo elija).
type: web_search para que el modelo pueda buscar en la web cuando sea necesario; marque usage.tool_usage.web_search en la respuesta de la consulta de tarea para saber cuántas búsquedas se ejecutaron.Convierte imágenes en videos con realismo y control artístico para diseñadores.
Anime la imagen de un personaje de referencia con movimiento de un video de conducción usando controles de indicación, resolución, inferencia, guía de imagen y guía de pose.
HappyHorse 1.0 Video Edit en Alibaba edita un video de entrada con instrucciones de texto e imágenes de referencia para transferencia de estilo, reemplazo local e intercambios de vestimenta.
Cree un vídeo a partir de un mensaje de texto y de uno a tres clips de referencia, con controles de duración, tamaño de salida, estructura de la toma, semilla, mensaje negativo y generación de audio.
Convierte imágenes en videos realistas con audio y movimiento fluido
Redefine el estilo cuadro a cuadro y mantiene coherencia visual en tus videos.
Seedance 2.0 Fast es el modelo de video multimodal orientado a la velocidad de ByteDance Seed: usted describe la escena en texto y puede agregar imágenes, video de referencia y audio de referencia para que el modelo alinee el movimiento, la apariencia y el sonido. En RunComfy, está optimizado para resultados más rápidos y al mismo tiempo admite clips cortos cinematográficos, audio nativo opcional, resultados con sincronización labial precisa y control de cámara cuando dirige la toma en su prompt.
La resolución es 480p o 720p (predeterminada). Relación de aspecto tiene como valor predeterminado adaptativo (el modelo elige la coincidencia más cercana; el resultado de la tarea muestra la relación de salida real). También puede fijarla en 16:9, 9:16, 4:3, 3:4, 1:1 o 21:9.
Solo se requiere prompt; las referencias son opcionales pero definen modo de referencia multimodal cuando las agrega. Prompt: se recomiendan aproximadamente ≤500 caracteres chinos o ≤1000 palabras en inglés. Imágenes: hasta 9 (jpeg, png, webp, bmp, tiff, gif). Videos de referencia: hasta 3 (mp4, mov), cada 2–15 segundos. Audio de referencia: hasta 3 (wav, mp3), cada 2–15 segundos y menos de 15 MB. Los prompts claros más las referencias alineadas generalmente brindan la identidad, el estilo y la sincronización más estables.
Duración es un número entero 4–15 segundos (predeterminado 5). Elija cualquier valor de segundo completo en ese rango por trabajo.
Con Generar audio (generate_audio) configurado en true (el valor predeterminado), el modelo puede generar video con audio sincronizado (diálogo, SFX o música). Configúrelo en false para video silencioso. La calidad de la sincronización labial depende de la precisión con la que describa el habla, el encuadre y el ritmo en el prompt; el audio de referencia también puede guiar el ritmo o el tono cuando utiliza referencias multimodales.
Elija Fast cuando más le interesen tiempos de espera más cortos e iteración rápida: los mismos campos del Playground (prompt, image_url, video_url, audio_url, aspect_ratio, duration, resolution, generate_audio, seed), con salida 480p/720p aquí y todos los límites de referencia multimodal. Elija Pro cuando desee la fidelidad cinematográfica más alta que ofrece el proveedor para una toma. Realice pruebas A/B con el mismo prompt y las mismas referencias para juzgar la calidad frente a la velocidad de su canalización.
Seedance 2.0 Fast se centra en clips cinematográficos cortos con referencias multimodales enriquecidas (muchas imágenes más video y audio opcionales), 4–15 s duración, relaciones de aspecto fijas o adaptativas y audio integrado cuando generate_audio está activado. Las mejoras dependen del caso de uso; compare usted mismo prompts, personajes y paquetes de referencia en lugar de depender de un único benchmark.
Depende del presupuesto, la latencia y el tipo de movimiento que necesite. En RunComfy, Seedance 2.0 Fast prioriza un text-to-video multimodal rápido con hasta nueve imágenes, tres videos de referencia, tres referencias de audio, ajustes predefinidos de 480p/720p y una opción para generar audio. Wan 2.5 y Kling 2.6 difieren en precios, límites y fortalezas: ejecute pruebas paralelas con sus briefs y conjuntos de referencia típicos.
Reproduzca el esquema de entrada del Playground: prompt, image_url, video_url, audio_url, aspect_ratio, duration, resolution, generate_audio y seed. Aplique los mismos límites de prompts y medios en su aplicación, luego autentíquese con su clave API y créditos para trabajos por lotes o automatizados.
El uso comercial depende de la licencia de ByteDance para el modelo y de los términos de servicio de RunComfy. Lea la licencia oficial del modelo y los documentos RunComfy, o envíe un correo electrónico a hi@runcomfy.com antes de utilizar el material generado en campañas pagas, trabajos para clientes o distribución amplia.
Creadores y equipos que necesitan generación rápida de videos multimodales: conceptos sociales y publicitarios, storyboards y previsualizaciones, cortos de marca y flujos de trabajo con muchas iteraciones donde la velocidad importa tanto como un solo fotograma principal. Combine texto con referencias cuando necesite apariencia, personaje o movimiento guiado por audio reproducible; luego pase a Pro para un pulido final cuando la toma lo amerite.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.





