Crea un vídeo con Wan 2.1 a partir de un prompt de texto y configura resolución, relación de aspecto, fotogramas, frecuencia y otras opciones.
Este modelo toma una imagen y una instrucción escrita, luego anima la imagen en un clip cinematográfico corto con sonido incorporado. Se encuentra dentro de la familia Gemini Omni Flash de Google, que también abarca conversión de texto a video, edición de video y vídeo a partir de referencias; esta página RunComfy ejecuta la tarea de conversión de imagen a vídeo.
Debido a que el modelo razona sobre cómo se comporta el mundo físico, el movimiento se mantiene coherente desde el primer cuadro en adelante en lugar de desviarse o deformarse a medida que se desarrolla la toma.
Las entradas coinciden con el esquema RunComfy OpenAPI Input para la tarea de imagen a vídeo.
| Parámetro | Obligatorio | Tipo | Predeterminado | Rango / Opciones | Descripción |
|---|---|---|---|---|---|
| prompt* | Sí (*) | string | — | texto descriptivo | Describe cómo debe moverse o cambiar la imagen de entrada |
| image_url* | Sí (*) | string (URI de imagen) | — | jpg, jpeg, png, webp | La imagen fija que se animará |
| aspect_ratio | No | string | 16:9 | 16:9, 9:16 | Relación de aspecto del vídeo generado |
| duration | No | integer | 8 | 3–10 (segundos) | Duración del vídeo generado en segundos enteros |
La facturación se basa en la duración del clip generado:
Crea un vídeo con Wan 2.1 a partir de un prompt de texto y configura resolución, relación de aspecto, fotogramas, frecuencia y otras opciones.
Crea clips sincronizados a partir de prompts con control preciso del audio y del estilo mediante LoRA.
Generación de vídeo de 3 a 15 segundos guiada por referencias por $0.084 por segundo.
Crea un vídeo con Kling 2.5 Turbo desde un prompt y elige duración, relación de aspecto y prompt negativo.
Genera voz desde texto y sincronízala con un vídeo; permite elegir voz, idioma y velocidad.
Transforma imágenes en videos fluidos con escenas naturales y movimiento coherente.
Gemini Omni Flash Image to Video toma una sola imagen fija y un instrucción de texto, luego anima la imagen en un clip corto con audio sincronizado. Infiere el movimiento natural del sujeto y la escena, por lo que puedes convertir un fotograma en una toma en movimiento con respaldo de sonido sin una animación o un paso de audio por separado.
Funciona bien para convertir fotografías fijas en clips sociales cortos, probar movimientos y ritmos de la cámara a partir de una imagen de referencia y crear prototipos de conceptos audiovisuales rápidamente. Los creadores, especialistas en marketing y equipos de cine o juegos suelen utilizar Gemini Omni Flash Image to Video para explorar el movimiento y la atmósfera antes de comprometerse con un pase de producción completo.
El modelo genera sonido al ritmo de la imagen animada, incluido habla, efectos ambientales y música cuando corresponda. Puede controlar esto en la instrucción con Gemini Omni Flash Image to Video nombrando el tono de diálogo o el sonido de fondo que desee, o solicitando que no haya diálogo cuando necesite un clip silencioso.
Comenzar desde una imagen cargada le brinda un control más estricto sobre la composición inicial y la identidad del sujeto que un instrucción basada solo en texto. Con Gemini Omni Flash Image to Video, la imagen fija la apariencia mientras la instrucción dirige cómo se mueve la escena, lo cual es útil cuando ya tienes un cuadro específico en mente.
Gemini Omni Flash Image to Video admite el encuadre horizontal 16:9 y el retrato 9:16, con longitudes de clip de 3 a 10 segundos completos. Consulte el panel de parámetros RunComfy actual para conocer las opciones exactas, ya que las configuraciones disponibles pueden cambiar con el tiempo.
Proporciona una imagen de entrada más un instrucción de texto que describe el movimiento; Los formatos de imagen admitidos incluyen jpg, jpeg, png y webp. Para cualquier límite que no aparezca en el panel, revise los campos de parámetros RunComfy, ya que algunas restricciones pueden variar según la configuración del proveedor.
Sí. Puede crear un prototipo de Gemini Omni Flash Image to Video en la interfaz de usuario del modelo de IA RunComfy y luego llamar al mismo modelo a través de RunComfy HTTP API con parámetros idénticos para automatización y producción. Esto le permite pasar de las pruebas a la integración sin alojar ni escalar el modelo usted mismo.
El uso de Gemini Omni Flash Image to Video se factura según la duración del vídeo generado: $0.14 por segundo. El importe se descuenta del saldo en USD o de los créditos de tu cuenta de RunComfy. Los usuarios nuevos suelen recibir crédito de prueba; consulta el precio vigente en la sección de generación de esta página.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.





