logo
RunComfy
  • ComfyUI
  • EntraîneurNouveau
  • Modèles
  • API
  • Tarification
discord logo
MODÈLES
Explorer
Tous les modèles
BIBLIOTHÈQUE
Générations
APIS DE MODÈLES
Documentation API
Clés API
COMPTE
Utilisation

Gemini Omni Flash Image to Video : animez des images fixes avec un son synchronisé | RunComfy

google/gemini-omni-flash/image-to-video

Gemini Omni Flash Image to Video anime une image importée en un court clip avec son natif synchronisé. L’invite texte contrôle le mouvement ; les formats 16:9 et 9:16 sont disponibles pour une durée de 3 à 10 secondes.

Décrivez le mouvement ou la transformation souhaités pour l’image d’entrée. L’invite peut préciser les mouvements de caméra, le rythme et le son, par exemple « lent mouvement avant de caméra », « vent doux et chants d’oiseaux » ou « sans dialogue ». Vous pouvez aussi ajouter une consigne négative comme « Ne pas afficher de texte ».
L’image d’entrée à animer. Les formats pris en charge incluent jpg, jpeg, png, webp.
Le rapport hauteur/largeur de la vidéo générée.
La durée de la vidéo générée, en secondes.
Idle
The rate is $0.14 per second of generated video.

Introduction à Gemini Omni Flash Image to Video

Gemini Omni Flash Image to Video de Google donne vie à une image fixe et la prolonge en un clip de 3 à 10 secondes avec mouvement et son synchronisés. La compréhension du monde réel de Gemini contribue à rendre l’animation crédible. Une seule génération pilotée par invite remplace les étapes séparées d’animation, d’images clés et de conception sonore, ce qui convient au marketing, au cinéma, au jeu vidéo et aux réseaux sociaux. Sur RunComfy, le modèle s’utilise dans le navigateur ou via une API HTTP, sans hébergement ni mise à l’échelle à gérer.
Idéal pour : clips sociaux à partir d’images fixes | tests de concepts audiovisuels | plans cinématographiques guidés par référence

Google / Gemini Omni Flash Image to Video#


Ce modèle prend une image et une instruction écrite, puis anime l'image dans un court clip cinématographique avec du son intégré. Il fait partie de la famille Gemini Omni Flash de Google, qui couvre également le texte en vidéo, le montage vidéo et la référence à la vidéo ; cette page RunComfy exécute la tâche de conversion d'image en vidéo.


Étant donné que le modèle raisonne sur le comportement du monde physique, le mouvement reste cohérent dès la première image au lieu de dériver ou de se déformer au fur et à mesure que le plan se déroule.


Points forts#


  • Animation sur une seule image : Commencez à partir d'une image fixe et laissez le modèle déduire un mouvement naturel et sensible à la physique pour le sujet et la scène.
  • Audio synchronisé natif : La parole, le son ambiant et la musique sont générés en phase avec l'image, de sorte qu'un clip est prêt à être partagé sans passe audio séparée.
  • Mouvement guidé par invite : Décrivez les mouvements de la caméra, le rythme et l'ambiance dans un langage simple pour donner vie au cadre.
  • Fondé sur des connaissances réelles : Les résultats s'appuient sur la compréhension du monde réel de Gemini, aidant ainsi les scènes animées à rester crédibles et pertinentes.
  • Cadrage flexible : Choisissez 16:9 paysage ou 9:16 portrait, avec une durée de 3 à 10 secondes réglable par seconde entière.
  • Fait partie d'une famille : La gamme Gemini Omni Flash couvre plusieurs tâches vidéo ; cette page se concentre sur la transformation des images en mouvement.

Paramètres#


Les entrées correspondent au schéma RunComfy OpenAPI Input pour la tâche de conversion d'image en vidéo.


ParamètreObligatoireTypeValeur par défautPlage / OptionsDescription
prompt*Oui (*)string—texte descriptifDécrit le mouvement ou la transformation souhaités pour l’image d’entrée
image_url*Oui (*)string (URI d’image)—jpg, jpeg, png, webpL’image fixe à animer
aspect_ratioNonstring16:916:9, 9:16Format de la vidéo générée
durationNoninteger83–10 (secondes)Durée de la vidéo générée, en secondes entières

Tarifs#


La facturation est basée sur la durée du clip généré :


  • Vidéo : $0.14 par seconde de vidéo générée.

Modèles associés

sora-2/pro/image-to-video

Animez une image de référence avec Sora 2 Pro à l’aide d’un prompt, puis choisissez le format et la durée.

sora-2/image-to-video

Générez des vidéos réalistes à partir d'images avec audio synchronisé.

wan-2.7/image-to-video

Transformez des images fixes en clips fluides avec contrôle de l’audio.

kling-1-6/pro/text-to-video

Générez une vidéo de 5 ou 10 secondes à partir d'une invite requise. Choisissez `16:9`, `9:16` ou `1:1`, ajoutez une invite négative facultative et ajustez la force de l'invite.

gemini-omni-flash/reference-to-video

Créez une courte vidéo avec son synchronisé à partir d’images de référence et d’une invite.

video-background-removal/video-to-video

Détourez des personnes ou des objets dans une vidéo et réglez le codec, les contours et le type de sujet.

Questions Fréquemment Posées

Que fait Gemini Omni Flash Image to Video ?

Gemini Omni Flash Image to Video prend une seule image fixe et une invite de texte, puis anime l'image dans un court clip avec audio synchronisé. Il déduit un mouvement naturel pour le sujet et la scène, de sorte que vous pouvez transformer une image en une prise de vue animée et sonore sans animation ou étape audio distincte.

Quels sont les meilleurs cas d’utilisation de Gemini Omni Flash Image to Video ?

Il fonctionne bien pour transformer des photos fixes en courts clips sociaux, tester les mouvements et le rythme de la caméra à partir d'une image de référence et prototyper rapidement des concepts audiovisuels. Les créateurs, les spécialistes du marketing et les équipes de cinéma ou de jeux utilisent souvent Gemini Omni Flash Image to Video pour explorer le mouvement et l'atmosphère avant de s'engager dans une phase de production complète.

Comment Gemini Omni Flash Image to Video gère-t-il l'audio ?

Le modèle génère un son en phase avec l'image animée, y compris la parole, les effets ambiants et la musique, le cas échéant. Vous pouvez contrôler cela dans l'invite avec Gemini Omni Flash Image to Video en nommant la tonalité de dialogue ou le son de fond souhaité, ou en demandant de ne pas dialoguer lorsque vous avez besoin d'un clip silencieux.

En quoi Gemini Omni Flash Image to Video est-il différent de la génération texte-vidéo ?

Commencer à partir d'une image téléchargée vous donne un contrôle plus strict sur la composition d'ouverture et l'identité du sujet qu'une invite contenant uniquement du texte. Avec Gemini Omni Flash Image to Video, l'image fixe ancre le look tandis que l'invite indique le mouvement de la scène, ce qui est utile lorsque vous avez déjà une image spécifique en tête.

Quels formats d'image et durées Gemini Omni Flash Image to Video prend-il en charge ?

Gemini Omni Flash Image to Video prend en charge le cadrage paysage 16:9 et portrait 9:16, avec des durées de clip de 3 à 10 secondes entières. Vérifiez le panneau de paramètres RunComfy actuel pour connaître les options exactes, car les paramètres disponibles peuvent changer au fil du temps.

Quelles limites d'entrée dois-je connaître avant d'utiliser Gemini Omni Flash Image to Video ?

Vous fournissez une image d'entrée plus une invite de texte décrivant le mouvement ; les formats d'image pris en charge incluent jpg, jpeg, png et webp. Pour toute limite non répertoriée dans le panneau, examinez les champs de paramètre RunComfy, car certaines contraintes peuvent varier selon les paramètres du fournisseur.

Les développeurs peuvent-ils utiliser Gemini Omni Flash Image to Video via l'API RunComfy ?

Oui. Vous pouvez prototyper Gemini Omni Flash Image to Video dans l'interface utilisateur du modèle AI RunComfy, puis appeler le même modèle via RunComfy HTTP API avec des paramètres identiques pour l'automatisation et la production. Cela vous permet de passer du test à l'intégration sans héberger ni mettre à l'échelle le modèle vous-même.

Combien ça coûte de générer avec Gemini Omni Flash Image to Video sur RunComfy ?

L’utilisation de Gemini Omni Flash Image to Video est facturée selon la durée de la vidéo générée, à raison de $0.14 par seconde. Le montant est déduit du solde en USD ou des crédits de votre compte RunComfy. Les nouveaux utilisateurs bénéficient généralement d’un crédit d’essai ; consultez le tarif actuel dans la section de génération de cette page.

Suivez-nous
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Support
  • Discord
  • Email
  • État du système
  • affilié
Modèles vidéo
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Voir tous les modèles →
Modèles d'images
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Voir tous les modèles →
Légal
  • Conditions d'utilisation
  • Politique de confidentialité
  • Politique relative aux cookies
RunComfy
Droits d'auteur 2026 RunComfy. Tous droits réservés.

RunComfy est la première ComfyUI plateforme, offrant des ComfyUI en ligne environnement et services, ainsi que des workflows ComfyUI proposant des visuels époustouflants. RunComfy propose également AI Models, permettant aux artistes d'utiliser les derniers outils d'IA pour créer des œuvres d'art incroyables.

Exemples de Gemini Omni Flash Image to Video

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...