Erstelle lebensechte Szenen mit präzisem Audio und beeindruckender Bildtreue.
Dieses Modell nimmt ein Bild und eine schriftliche Anweisung entgegen und verwandelt die Aufnahme in einen kurzen filmischen Clip mit integriertem Ton. Es ist Teil der Gemini Omni Flash-Familie von Google, die auch Text-zu-Video, Videobearbeitung und Referenzbild-zu-Video umfasst; Auf dieser RunComfy-Seite wird die Bild-zu-Video-Aufgabe ausgeführt.
Da das Modell darüber nachdenkt, wie sich die physische Welt verhält, bleibt die Bewegung vom ersten Bild an kohärent, anstatt zu driften oder sich zu verziehen, während die Aufnahme abläuft.
Die Eingaben entsprechen dem RunComfy OpenAPI Input-Schema für die Bild-zu-Video-Aufgabe.
| Parameter | Erforderlich | Typ | Standard | Bereich / Optionen | Beschreibung |
|---|---|---|---|---|---|
| prompt* | Ja (*) | string | — | Beschreibungstext | Beschreibt, wie sich das Eingabebild bewegen oder verändern soll |
| image_url* | Ja (*) | string (Bild-URI) | — | jpg, jpeg, png, webp | Das zu animierende Standbild |
| aspect_ratio | Nein | string | 16:9 | 16:9, 9:16 | Seitenverhältnis des generierten Videos |
| duration | Nein | integer | 8 | 3–10 (Sekunden) | Länge des generierten Videos in ganzen Sekunden |
Die Abrechnung richtet sich nach der Länge des generierten Clips:
Erstelle lebensechte Szenen mit präzisem Audio und beeindruckender Bildtreue.
Erzeuge kinoreife Videoclips mit präziser Steuerung und natürlichem Sound
Erzeugen Sie aus einer Audiospur und einem Bild ein Video; Prompt und Seed sind optional.
Erzeugen Sie mit Seedance 1.0 ein Video aus einem Prompt und wählen Sie Auflösung, Seitenverhältnis und Dauer.
Verwandeln Sie ein Porträt und eine Audiospur mit einem optionalen Prompt in ein Video mit einem sprechenden Avatar für Bewegungs- oder Sprechhinweise.
Erzeugen Sie aus einem Bild, einer Audiodatei und einem Prompt ein Video mit einstellbarer Text- und Audiosteuerung.
Gemini Omni Flash Image to Video nimmt ein einzelnes Standbild und eine Textaufforderung auf und animiert das Bild dann zu einem kurzen Clip mit synchronisiertem Ton. Es leitet die natürliche Bewegung des Motivs und der Szene ab, sodass Sie ein Einzelbild in eine bewegte, mit Ton unterlegte Aufnahme umwandeln können, ohne einen separaten Animations- oder Audioschritt.
Es eignet sich gut, um Standbilder in kurze soziale Clips umzuwandeln, Kamerabewegungen und -tempo anhand eines Referenzbilds zu testen und schnell Prototypen audiovisueller Konzepte zu erstellen. Schöpfer, Vermarkter und Film- oder Spieleteams nutzen Gemini Omni Flash Image to Video häufig, um Bewegung und Atmosphäre zu erkunden, bevor sie sich auf einen vollständigen Produktionsdurchlauf festlegen.
Das Modell erzeugt Ton im Einklang mit dem animierten Bild, einschließlich Sprache, Umgebungseffekten und gegebenenfalls Musik. Sie können dies in der Eingabeaufforderung mit Gemini Omni Flash Image to Video steuern, indem Sie den gewünschten Dialogton oder Hintergrundton benennen oder nach keinem Dialog fragen, wenn Sie einen ruhigen Clip benötigen.
Wenn Sie von einem hochgeladenen Bild ausgehen, haben Sie eine bessere Kontrolle über die Eröffnungskomposition und die Identität des Betreffs als bei einer reinen Textaufforderung. Mit Gemini Omni Flash Image to Video verankert das Standbild den Look, während die Eingabeaufforderung angibt, wie sich die Szene bewegt. Dies ist nützlich, wenn Sie bereits ein bestimmtes Bild im Kopf haben.
Gemini Omni Flash Image to Video unterstützt 16:9-Querformat- und 9:16-Hochformatrahmen mit Cliplängen von 3 bis 10 ganzen Sekunden. Überprüfen Sie das aktuelle RunComfy-Parameterfeld auf die genauen Optionen, da sich die verfügbaren Einstellungen im Laufe der Zeit ändern können.
Sie stellen ein Eingabebild sowie eine Textaufforderung bereit, die die Bewegung beschreibt. Zu den unterstützten Bildformaten gehören jpg, jpeg, png und webp. Überprüfen Sie für alle Grenzwerte, die nicht im Panel aufgeführt sind, die Parameterfelder RunComfy, da einige Einschränkungen je nach Anbietereinstellungen variieren können.
Ja. Sie können Gemini Omni Flash Image to Video in der Benutzeroberfläche des AI-Modells RunComfy prototypisieren und dann dasselbe Modell über RunComfy HTTP API mit identischen Parametern für Automatisierung und Produktion aufrufen. Dadurch können Sie vom Testen zur Integration übergehen, ohne das Modell selbst hosten oder skalieren zu müssen.
Die Nutzung von Gemini Omni Flash Image to Video wird nach der Länge des generierten Videos abgerechnet: $0.14 pro Sekunde. Der Betrag wird vom USD- oder Credit-Guthaben Ihres RunComfy-Kontos abgezogen. Neue Nutzer erhalten üblicherweise ein kostenloses Testguthaben; die aktuellen Preise finden Sie im Generierungsbereich dieser Seite.
RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.





