logo
RunComfy
  • ComfyUI
  • EntrenadorNuevo
  • Modelos
  • API
  • Precios
discord logo
MODELOS
Explorar
Todos los modelos
BIBLIOTECA
Generaciones
APIS DE MODELOS
Documentación de la API
Claves API
CUENTA
Uso

Gemini Omni Flash Image to Video: anima imágenes fijas con audio sincronizado | RunComfy

google/gemini-omni-flash/image-to-video

Gemini Omni Flash Image to Video anima una imagen subida y crea un clip corto con audio nativo sincronizado. El texto controla el movimiento; admite 16:9 o 9:16 y duraciones de 3–10 segundos.

Describe cómo debe moverse o cambiar la imagen de entrada. En la instrucción puedes indicar el movimiento de cámara, el ritmo y el audio, por ejemplo «acercamiento lento de cámara», «viento suave y canto de pájaros» o «sin diálogo». También puedes añadir indicaciones negativas como «No mostrar texto».
La imagen de entrada para animar. Los formatos admitidos incluyen jpg, jpeg, png, webp.
La relación de aspecto del vídeo generado.
La duración del vídeo generado, en segundos.
Idle
The rate is $0.14 per second of generated video.

Introducción a Gemini Omni Flash Image to Video

Gemini Omni Flash Image to Video de Google da vida a una sola imagen fija y la convierte en un clip de 3–10 segundos con movimiento y audio sincronizado. La comprensión del mundo real de Gemini ayuda a mantener una animación creíble. Una única generación guiada por texto sustituye los pasos independientes de animación, fotogramas clave y diseño de sonido, por lo que resulta útil para marketing, cine, videojuegos y contenido social. En RunComfy puede usarse desde el navegador o mediante una API HTTP, sin alojar ni escalar el modelo.
Ideal para: clips sociales a partir de imágenes | pruebas de conceptos audiovisuales | planos cinematográficos basados en referencias

Google / Gemini Omni Flash Image to Video#


Este modelo toma una imagen y una instrucción escrita, luego anima la imagen en un clip cinematográfico corto con sonido incorporado. Se encuentra dentro de la familia Gemini Omni Flash de Google, que también abarca conversión de texto a video, edición de video y vídeo a partir de referencias; esta página RunComfy ejecuta la tarea de conversión de imagen a vídeo.


Debido a que el modelo razona sobre cómo se comporta el mundo físico, el movimiento se mantiene coherente desde el primer cuadro en adelante en lugar de desviarse o deformarse a medida que se desarrolla la toma.


Destacados#


  • Animación de una sola imagen: Comience desde una imagen fija y deje que el modelo infiera un movimiento natural y consciente de la física para el sujeto y la escena.
  • Audio nativo sincronizado: La voz, el sonido ambiental y la música se generan en sintonía con la imagen, por lo que un clip está listo para compartir sin un pase de audio separado.
  • Movimiento dirigido por indicaciones: Describe los movimientos, el ritmo y el estado de ánimo de la cámara en un lenguaje sencillo para dar forma a cómo cobra vida el encuadre.
  • Basado en conocimiento real: Los resultados se basan en la comprensión del mundo real de Gemini, lo que ayuda a que las escenas animadas sigan siendo creíbles y acordes al tema.
  • Encuadre flexible: Elija 16:9 horizontal o 9:16 vertical, con una duración de 3 a 10 segundos ajustable en segundos enteros.
  • Parte de una familia: La línea Gemini Omni Flash cubre varias tareas de video; Esta página se centra en convertir imágenes en movimiento.

Parámetros#


Las entradas coinciden con el esquema RunComfy OpenAPI Input para la tarea de imagen a vídeo.


ParámetroObligatorioTipoPredeterminadoRango / OpcionesDescripción
prompt*Sí (*)string—texto descriptivoDescribe cómo debe moverse o cambiar la imagen de entrada
image_url*Sí (*)string (URI de imagen)—jpg, jpeg, png, webpLa imagen fija que se animará
aspect_ratioNostring16:916:9, 9:16Relación de aspecto del vídeo generado
durationNointeger83–10 (segundos)Duración del vídeo generado en segundos enteros

Precios#


La facturación se basa en la duración del clip generado:


  • Video: $0.14 por segundo de video generado.

Modelos relacionados

wan-2-1/text-to-video

Crea un vídeo con Wan 2.1 a partir de un prompt de texto y configura resolución, relación de aspecto, fotogramas, frecuencia y otras opciones.

ltx-2-19b/text-to-video/lora

Crea clips sincronizados a partir de prompts con control preciso del audio y del estilo mediante LoRA.

kling-video-o3/standard/reference-to-video

Generación de vídeo de 3 a 15 segundos guiada por referencias por $0.084 por segundo.

kling-2-5/turbo/text-to-video

Crea un vídeo con Kling 2.5 Turbo desde un prompt y elige duración, relación de aspecto y prompt negativo.

kling/lipsync/text-to-video

Genera voz desde texto y sincronízala con un vídeo; permite elegir voz, idioma y velocidad.

hunyuan/image-to-video

Transforma imágenes en videos fluidos con escenas naturales y movimiento coherente.

Preguntas Frecuentes

¿Qué hace Gemini Omni Flash Image to Video?

Gemini Omni Flash Image to Video toma una sola imagen fija y un instrucción de texto, luego anima la imagen en un clip corto con audio sincronizado. Infiere el movimiento natural del sujeto y la escena, por lo que puedes convertir un fotograma en una toma en movimiento con respaldo de sonido sin una animación o un paso de audio por separado.

¿Cuáles son los mejores casos de uso para Gemini Omni Flash Image to Video?

Funciona bien para convertir fotografías fijas en clips sociales cortos, probar movimientos y ritmos de la cámara a partir de una imagen de referencia y crear prototipos de conceptos audiovisuales rápidamente. Los creadores, especialistas en marketing y equipos de cine o juegos suelen utilizar Gemini Omni Flash Image to Video para explorar el movimiento y la atmósfera antes de comprometerse con un pase de producción completo.

¿Cómo maneja Gemini Omni Flash Image to Video el audio?

El modelo genera sonido al ritmo de la imagen animada, incluido habla, efectos ambientales y música cuando corresponda. Puede controlar esto en la instrucción con Gemini Omni Flash Image to Video nombrando el tono de diálogo o el sonido de fondo que desee, o solicitando que no haya diálogo cuando necesite un clip silencioso.

¿En qué se diferencia Gemini Omni Flash Image to Video de la generación de texto a vídeo?

Comenzar desde una imagen cargada le brinda un control más estricto sobre la composición inicial y la identidad del sujeto que un instrucción basada solo en texto. Con Gemini Omni Flash Image to Video, la imagen fija la apariencia mientras la instrucción dirige cómo se mueve la escena, lo cual es útil cuando ya tienes un cuadro específico en mente.

¿Qué relaciones de aspecto y duraciones admite Gemini Omni Flash Image to Video?

Gemini Omni Flash Image to Video admite el encuadre horizontal 16:9 y el retrato 9:16, con longitudes de clip de 3 a 10 segundos completos. Consulte el panel de parámetros RunComfy actual para conocer las opciones exactas, ya que las configuraciones disponibles pueden cambiar con el tiempo.

¿Qué límites de entrada debo conocer antes de usar Gemini Omni Flash Image to Video?

Proporciona una imagen de entrada más un instrucción de texto que describe el movimiento; Los formatos de imagen admitidos incluyen jpg, jpeg, png y webp. Para cualquier límite que no aparezca en el panel, revise los campos de parámetros RunComfy, ya que algunas restricciones pueden variar según la configuración del proveedor.

¿Pueden los desarrolladores utilizar Gemini Omni Flash Image to Video a través de la API RunComfy?

Sí. Puede crear un prototipo de Gemini Omni Flash Image to Video en la interfaz de usuario del modelo de IA RunComfy y luego llamar al mismo modelo a través de RunComfy HTTP API con parámetros idénticos para automatización y producción. Esto le permite pasar de las pruebas a la integración sin alojar ni escalar el modelo usted mismo.

¿Cuánto cuesta generar con Gemini Omni Flash Image to Video en RunComfy?

El uso de Gemini Omni Flash Image to Video se factura según la duración del vídeo generado: $0.14 por segundo. El importe se descuenta del saldo en USD o de los créditos de tu cuenta de RunComfy. Los usuarios nuevos suelen recibir crédito de prueba; consulta el precio vigente en la sección de generación de esta página.

Síguenos
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Soporte
  • Discord
  • Correo electrónico
  • Estado del sistema
  • afiliado
Modelos de Video
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Ver todos los modelos →
Modelos de Imagen
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Ver todos los modelos →
Legal
  • Términos de servicio
  • Política de privacidad
  • Política de cookies
RunComfy
Derechos de autor 2026 RunComfy. Todos los derechos reservados.

RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.

Ejemplos de Gemini Omni Flash Image to Video

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...