Crea un vídeo con Wan 2.1 a partir de un prompt de texto y configura resolución, relación de aspecto, fotogramas, frecuencia y otras opciones.
Gemini Omni Flash es la familia de generación de vídeo multimodal de Google, basada en el conocimiento del mundo real de Gemini y una mayor comprensión de la física para lograr movimientos e interacciones más creíbles. La familia más amplia abarca cuatro tareas relacionadas: texto a vídeo, imagen a vídeo, edición de vídeo y referencia a vídeo. Esta página RunComfy ejecuta la tarea de conversión de texto a video, convirtiendo un mensaje escrito en un clip cinematográfico corto con audio sincronizado.
Debido a que razona sobre cómo se comporta realmente el mundo, el modelo mantiene los objetos, la iluminación y el movimiento coherentes a lo largo de una toma en lugar de desviarse fotograma a fotograma.
Las entradas coinciden con el esquema RunComfy OpenAPI Input para la tarea de conversión de texto a vídeo.
| Parámetro | Obligatorio | Tipo | Predeterminado | Rango / Opciones | Descripción |
|---|---|---|---|---|---|
| prompt* | Sí (*) | string | — | Texto descriptivo | Prompt del vídeo que se va a generar |
| aspect_ratio | No | string | 16:9 | 16:9, 9:16 | Relación de aspecto del vídeo |
| duration | No | integer | 8 | 3–10 (segundos) | Duración del vídeo en segundos enteros |
La facturación se basa en la duración del clip generado:
Crea un vídeo con Wan 2.1 a partir de un prompt de texto y configura resolución, relación de aspecto, fotogramas, frecuencia y otras opciones.
Modelo de video con IA multimodal y audio nativo para generación desde texto, imágenes y referencias.
FLUX 3 Draft Keyframes: vistas previas rápidas de vídeo con múltiples fotogramas clave a 720p
Sustituye una zona seleccionada de un vídeo mediante una máscara o una descripción, con imagen y prompt opcionales.
Cree un video sincronizado con los labios a partir de las URL de audio y video requeridas, con cinco modos para manejar duraciones de entrada que no coinciden.
Crea un vídeo con Seedance 1.0 desde un prompt y elige resolución, relación de aspecto y duración.
Gemini Omni Flash es el modelo de vídeo multimodal de Google que convierte un mensaje de texto en un clip cinematográfico corto con audio sincronizado. En esta página RunComfy, ejecuta la tarea de conversión de texto a video, lo que la hace adecuada para anuncios sociales, ritmos de historias y previsualizaciones rápidas donde tanto el movimiento como el sonido son importantes.
La familia Gemini Omni Flash abarca cuatro tareas relacionadas: texto a video, imagen a video, edición de video y referencia a video. Esta página RunComfy expone la tarea de texto a video, que genera un video solo a partir de un mensaje escrito, mientras que las otras tareas comienzan a partir de imágenes o metraje existentes.
Sí. Gemini Omni Flash produce audio sincronizado (como voz, efectos de sonido y música) alineado con la acción generada. Puede controlar el sonido desde el mensaje, por ejemplo pidiendo música de fondo tranquila o no especificando ningún diálogo.
Gemini Omni Flash se basa en el conocimiento del mundo real de Gemini y tiene una comprensión mejorada de la física, lo que le ayuda a mantener coherentes el movimiento, la iluminación y la interacción de los objetos en una toma. Esto reduce la deriva de cuadro a cuadro común en los modelos más antiguos de texto a video.
La tarea de texto a video requiere un mensaje requerido, una relación de aspecto de 16:9 o 9:16 y una duración de entre 3 y 10 segundos. Verifique el panel de parámetros RunComfy actual para conocer los valores predeterminados exactos y los límites del lado del proveedor antes de generar.
Sea descriptivo sobre el tema, la acción, la cámara, el estado de ánimo y la iluminación, y controle el ritmo directamente en el mensaje (por ejemplo, una única toma continua). Coloque exclusiones en el mensaje, como "no mostrar texto", ya que Gemini Omni Flash lee instrucciones negativas del mensaje.
Sí. Puede crear un prototipo de Gemini Omni Flash en la interfaz de usuario del modelo RunComfy y luego llamar al mismo modelo a través de la API RunComfy con parámetros idénticos. Eso le permite pasar de una prueba de navegador a una generación automatizada sin alojar ni escalar el modelo usted mismo.
Las generaciones con Gemini Omni Flash se facturan a $0,13 por segundo de vídeo generado y retiran su saldo de crédito o dólares de RunComfy. Los nuevos usuarios suelen comenzar con una cantidad de prueba gratuita; consulte la sección Generación en esta página para obtener detalles actuales.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.





