logo
RunComfy
  • ComfyUI
  • TrainerNew
  • Models
  • API
  • Pricing
discord logo
MODELS
Explore
All Models
LIBRARY
Generations
MODEL APIS
API Docs
API Keys
ACCOUNT
Usage

FLUX 3 Image to Video: imagen a vídeo con audio nativo en modelos y API | RunComfy

blackforestlabs/flux-3/image-to-video

FLUX 3 Image to Video anima una imagen inicial a un clip corto con audio nativo opcional a 720p o 1080p.

URL de la imagen de inicio del video (PNG, JPEG o WebP).
Texto que describe el video que quieres generar.
Relación de aspecto del video. auto deja que el modelo elija.
Resolución del video generado.
Duración del video en segundos. auto deja que el modelo elija.
Si se debe generar audio sincronizado para el video.
Nivel de tolerancia de seguridad. 0 es el más estricto y 4 el más permisivo.
Idle
The rate is $0.17 per second at 720p, and $0.29 per second at 1080p.

Introducción a FLUX 3 Image to Video

FLUX 3 Image to Video de Black Forest Labs parte de una imagen fija y un brief escrito, y genera un clip corto con audio nativo sincronizado opcional a 720p o 1080p, hasta 20 segundos por generación.
En lugar de animación manual en timeline y diseño de sonido aparte, FLUX 3 Image to Video guía el movimiento desde un fotograma inicial fijo para que marketing, producto y previz conviertan stills en clips útiles más rápido.
Los desarrolladores pueden usar FLUX 3 Image to Video en RunComfy en el navegador y vía API HTTP, sin alojar ni escalar el modelo.
Ideal for: Animación de stills de producto | Planos de apertura de personaje | Creatividad publicitaria desde key art

Black Forest Labs / FLUX 3 Image To Video#


FLUX 3 Image to Video toma un fotograma fijo más un brief y lo convierte en un clip corto con audio nativo sincronizado opcional. En RunComfy puedes ajustar el movimiento en la UI del modelo y reutilizar el mismo Input por HTTP API.


Formato de salida: Vídeo / parte de una imagen / hasta 20 segundos / 720p o 1080p / audio nativo opcional


Destacados#


  • De still a movimiento: Sube una imagen inicial; FLUX 3 Image to Video extiende ese fotograma a acción continua guiada por tu prompt.
  • Sonido en el mismo paso: Mantén Generate Audio activado para voz, ambiente y efectos sincronizados, o desactívalo para material silencioso.
  • Control de duración: Usa auto o fija 5–20 segundos para beats de producto y diálogo.
  • Opciones de encuadre: De ultrapanorámico 21:9 a vertical 9:16, más auto.
  • Dos niveles de entrega: Itera en 720p y pasa a 1080p cuando necesites finales más nítidos.
  • Dial de seguridad: Ajusta safety tolerance de 0 (más estricto) a 4 (más permisivo).

Parámetros#


ParámetroObligatorioTipoPor defectoRango / OpcionesDescripción
image_url*Sí (*)string—URL PNG, JPEG, WebPFotograma inicial del clip.
prompt*Sí (*)string——Texto de cómo debe desarrollarse el vídeo desde la imagen.
aspect_ratioNostringautoauto, 21:9, 2:1, 16:9, 4:3, 1:1, 3:4, 9:16Forma del fotograma; auto lo elige el modelo.
resolutionNostring720p720p, 1080pResolución de salida.
durationNostringautoauto, 5–20Duración en segundos; auto lo elige el modelo.
generate_audioNobooleantruetrue, falseSi generar audio sincronizado.
safety_toleranceNointeger20–40 más estricto; 4 más permisivo.

Precios#


La facturación de FLUX 3 Image to Video se basa en la duración del clip y la resolución elegida.


ResoluciónTarifa
720p$0.17 por segundo
1080p$0.29 por segundo

Ejemplos de coste estimado (720p)


DuraciónCoste aprox.
5 s~$0.85
10 s~$1.70
20 s~$3.40

Ejemplos de coste estimado (1080p)


DuraciónCoste aprox.
5 s~$1.45
10 s~$2.90
20 s~$5.80

Modelos relacionados

sync/lipsync/v2

Cree un video sincronizado con los labios a partir de las URL de audio y video requeridas. Elija `lipsync-2` o `lipsync-2-pro` (Pro cuesta aproximadamente 1,67 veces más por la misma duración) y seleccione uno de los cinco modos de duración no coincidente.

sync/lipsync/v2/pro

Cree un video sincronizado con los labios a partir de las URL de audio y video requeridas, con cinco modos para manejar duraciones de entrada que no coinciden.

gemini-omni-flash/video-edit

Edita un vídeo fuente mediante una instrucción de texto sin perder la coherencia de la escena.

gemini-omni-flash/text-to-video

Genera vídeos cinematográficos con audio sincronizado a partir de un prompt de texto.

seedance-2.0-mini/image-to-video

Anima una imagen inicial y crea un clip cinematográfico con audio nativo.

hunyuan-video-v1.5/text-to-video

Genera un vídeo de 5 u 8 segundos a partir de un prompt obligatorio, con un prompt negativo opcional, cuatro tamaños de salida exactos y control de semilla.

Frequently Asked Questions

¿Para qué se usa FLUX 3 Image to Video?

FLUX 3 Image to Video parte de una imagen fija y un prompt de texto y genera un clip corto con audio nativo sincronizado opcional. Encaja en animación de producto, aperturas de personaje y creatividad publicitaria cuando el primer fotograma ya está fijado.

¿En qué se diferencia FLUX 3 Image to Video del FLUX 3 texto a vídeo?

FLUX 3 Image to Video ancla la apariencia inicial a tu still subido y continúa el movimiento desde ese fotograma. El FLUX 3 texto a vídeo inventa todo el plano solo con el prompt, sin imagen inicial obligatoria.

¿FLUX 3 Image to Video admite audio nativo?

Sí. Generate Audio está activado por defecto, así que FLUX 3 Image to Video puede generar voz, SFX y ambiente sincronizados con la imagen. Desactívalo si necesitas vídeo silencioso.

¿Cuánto puede durar un clip de FLUX 3 Image to Video?

Puedes poner duration en auto o fijar de 5 a 20 segundos. auto deja elegir al modelo; longitudes fijas dan ritmo predecible para beats de producto y diálogo.

¿Qué resoluciones y relaciones de aspecto admite FLUX 3 Image to Video?

Resoluciones: 720p (por defecto) y 1080p. La relación de aspecto por defecto es auto; también puedes fijar 21:9, 2:1, 16:9, 4:3, 1:1, 3:4 o 9:16.

¿Qué entradas requiere FLUX 3 Image to Video?

image_url y prompt son obligatorios. Opcionales: aspect_ratio, resolution, duration, generate_audio y safety_tolerance (0–4, por defecto 2). La imagen inicial debe ser una URL PNG, JPEG o WebP.

¿Cómo paso de probar FLUX 3 Image to Video en el navegador a la API de producción?

Prototipa en la UI del modelo de RunComfy y luego llama a la misma plantilla por la API de RunComfy con los mismos campos Input (image_url, prompt, aspect_ratio, resolution, duration, generate_audio, safety_tolerance). Valida prompts y fotogramas iniciales en la UI primero; después usa la API key y créditos de tu cuenta para jobs automatizados.

¿Cuánto cuesta FLUX 3 Image to Video en RunComfy?

Se factura por duración y resolución: $0.17 por segundo a 720p y $0.29 por segundo a 1080p. Consulta las tarifas mostradas en esta página.

Follow us
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Support
  • Discord
  • Email
  • System Status
  • Affiliate
Video Models
  • MiniMax H3
  • Minimax H3 Image to Video
  • FLUX 3 Video
  • Happy Horse 1.1 reference to video
  • Wan 2.6 Flash
  • Hailuo 2.3 Fast Standard
  • View All Models →
Image Models
  • FLUX 3 Image
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • seedream 4.0
  • GPT Image 2 Image Edit
  • Nano Banana Pro
  • View All Models →
Legal
  • Terms of Service
  • Privacy Policy
  • Cookie Policy
RunComfy
Copyright 2026 RunComfy. All Rights Reserved.

RunComfy is the premier ComfyUI platform, offering ComfyUI online environment and services, along with ComfyUI workflows featuring stunning visuals. RunComfy also provides AI Models, enabling artists to harness the latest AI tools to create incredible art.

Ejemplos de FLUX 3 Image to Video

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...