Genera canciones de hasta 4 minutos con voces y letras a partir de etiquetas de estilo.
Cargue una imagen inicial y una imagen final, agregue un resumen escrito de lo que sucede en el medio y obtenga un clip corto con audio nativo sincronizado opcional. En RunComfy, puede fijar ambos fotogramas clave en la interfaz de usuario del modelo y luego reutilizar la misma entrada en HTTP API.
Formato de salida: Vídeo / imágenes de inicio + fin / 5 a 20 segundos / 720p o 1080p / audio nativo opcional
| Parámetro | Requerido | Tipo | Predeterminado | Gama / Opciones | Descripción |
|---|---|---|---|---|---|
| start_image_url* | Sí (*) | cadena | — | PNG, JPEG, WebP URL | Imagen utilizada como primer fotograma del vídeo. |
| end_image_url* | Sí (*) | cadena | — | PNG, JPEG, WebP URL | Imagen utilizada como último fotograma del vídeo. |
| mensaje* | Sí (*) | cadena | — | — | Texto que describe la transición y el movimiento entre los dos fotogramas. |
| aspect_ratio | No | cadena | automático | automático, 21:9, 2:1, 16:9, 4:3, 1:1, 3:4, 9:16 | Forma del marco de salida; auto deja elegir el modelo. |
| resolución | No | cadena | 720p | 720p, 1080p | Resolución de salida. |
| duración | No | entero | 5 | 5–20 | Duración del clip en segundos; necesario en la práctica para poder colocar el marco final. |
| generate_audio | No | booleano | verdadero | verdadero, falso | Ya sea para generar audio sincronizado. |
| safety_tolerance | No | entero | 2 | 0–4 | 0 es el más estricto; 4 es el más permisivo. |
La facturación de FLUX 3 First Last Frame to Video se basa en la duración del clip generado y la resolución seleccionada.
| Resolución | Tarifa |
|---|---|
| 720p | 0,19 dólares por segundo |
| 1080p | 0,32 dólares por segundo |
Ejemplos de costos estimados (720p)
| Duración | Aprox. costo |
|---|---|
| 5 segundos | ~$0,85 |
| 10 segundos | ~$1,70 |
| 20 segundos | ~$3.40 |
Ejemplos de costos estimados (1080p)
| Duración | Aprox. costo |
|---|---|
| 5 segundos | ~$1.45 |
| 10 segundos | ~$2.90 |
| 20 segundos | ~$5.80 |
Genera canciones de hasta 4 minutos con voces y letras a partir de etiquetas de estilo.
Seedance 2.5 Reference to Video 4K: clips multireferencia 4K
Anime una imagen requerida con un prompt obligatorio usando Kling 2.1 Standard, con controles de duración, relación de aspecto, prompt negativo y intensidad del prompt.
Convierta un retrato y una pista de audio en un vídeo de avatar parlante, con un prompt opcional de movimiento o forma de hablar.
MiniMax H3: texto a vídeo 768p/2K con audio estéreo nativo
Edita un vídeo existente mediante una instrucción de texto y la URL del vídeo.
FLUX 3 First Last Frame to Video toma una imagen inicial, una imagen final y un mensaje de texto, luego genera el movimiento entre esos dos fotogramas clave con audio nativo sincronizado opcional. Se adapta a transiciones de pose a pose, arcos de revelación de productos y puentes de escena cuando ambos marcos de sujetalibros ya están bloqueados.
FLUX 3 First Last Frame to Video bloquea las imágenes fijas de apertura y cierre, para que usted controle el inicio y el final del clip. FLUX 3 Image to Video solo requiere una imagen inicial y continúa el movimiento desde ese único fotograma sin necesidad de un fotograma final.
Sí. Generar audio está activado de forma predeterminada, por lo que FLUX 3 First Last Frame to Video puede generar voz sincronizada, SFX y ambiente con la imagen. Apágalo cuando necesites un vídeo silencioso.
La duración es un número entero de segundos, de 5 a 20. Una duración explícita ayuda a colocar el cuadro final correctamente para el ritmo de transición.
Las opciones de resolución son 720p (predeterminada) y 1080p. La relación de aspecto predeterminada es automática, o puede bloquear 21:9, 2:1, 16:9, 4:3, 1:1, 3:4 o 9:16 para formatos de entrega conocidos.
Se requieren start_image_url, end_image_url y aviso. Los campos opcionales son aspect_ratio, resolución, duración (5–20, predeterminado 5), generate_audio y safety_tolerance (0–4, predeterminado 2). Las imágenes de inicio y fin deben ser URL PNG, JPEG o WebP.
Haga un prototipo en la interfaz de usuario del modelo RunComfy, luego llame a la misma plantilla a través de la API RunComfy usando campos de entrada idénticos (start_image_url, end_image_url, aviso, aspect_ratio, resolución, duración, generate_audio, safety_tolerance). Primero valide las indicaciones y los fotogramas clave en la interfaz de usuario, luego use la clave API de su cuenta y los créditos para trabajos automatizados.
La facturación se basa en la duración y la resolución del video generado: $0,19 por segundo a 720p y $0,32 por segundo a 1080p. Consulte los precios que se muestran en esta página para conocer las tarifas más recientes.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.





