logo
RunComfy
  • ComfyUI
  • TrainerNeu
  • Modelle
  • API
  • Preise
discord logo
MODELLE
Erkunden
Alle Modelle
BIBLIOTHEK
Generierungen
MODELL-APIS
API-Dokumentation
API-Schlüssel
KONTO
Nutzung

Gemini Omni Flash Image to Video: Standbilder mit synchronisiertem Audio animieren | RunComfy

google/gemini-omni-flash/image-to-video

Gemini Omni Flash Image to Video animiert ein hochgeladenes Bild zu einem kurzen Clip mit nativ synchronisiertem Ton. Ein Textprompt steuert die Bewegung; verfügbar sind 16:9 oder 9:16 und 3–10 Sekunden Länge.

Beschreiben Sie, wie sich das Eingabebild bewegen oder verändern soll. Im Prompt können Sie Kameraführung, Tempo und Ton vorgeben, etwa „langsame Kamerafahrt nach vorn“, „sanfter Wind und Vogelgezwitscher“ oder „kein Dialog“. Negative Anweisungen wie „Keinen Text anzeigen“ sind ebenfalls möglich.
Das zu animierende Eingabebild. Zu den unterstützten Formaten gehören JPG, JPEG, PNG und WebP.
Das Seitenverhältnis des generierten Videos.
Die Dauer des generierten Videos in Sekunden.
Idle
The rate is $0.14 per second of generated video.

Einführung in Gemini Omni Flash Image to Video

Googles Gemini Omni Flash Image to Video erweckt ein einzelnes Standbild zum Leben und erweitert es zu einem 3–10 Sekunden langen Clip mit synchronisiertem Ton und stimmiger Bewegung. Geminis Verständnis der realen Welt hilft dabei, die Animation glaubwürdig zu halten. Ein einziger promptgesteuerter Durchlauf ersetzt separate Schritte für Animation, Keyframes und Sounddesign – ideal für Marketing, Film, Spiele und Social Media. Auf RunComfy lässt sich das Modell im Browser oder über eine HTTP-API nutzen, ohne dass Sie es selbst hosten oder skalieren müssen.
Ideal für: Social-Clips aus Standbildern | Audiovisuelle Konzepttests | Referenzbasierte filmische Aufnahmen

Google / Gemini Omni Flash Image to Video#


Dieses Modell nimmt ein Bild und eine schriftliche Anweisung entgegen und verwandelt die Aufnahme in einen kurzen filmischen Clip mit integriertem Ton. Es ist Teil der Gemini Omni Flash-Familie von Google, die auch Text-zu-Video, Videobearbeitung und Referenzbild-zu-Video umfasst; Auf dieser RunComfy-Seite wird die Bild-zu-Video-Aufgabe ausgeführt.


Da das Modell darüber nachdenkt, wie sich die physische Welt verhält, bleibt die Bewegung vom ersten Bild an kohärent, anstatt zu driften oder sich zu verziehen, während die Aufnahme abläuft.


Highlights#


  • Einzelbildanimation: Beginnen Sie mit einem Standbild und lassen Sie das Modell natürliche, physikbewusste Bewegungen für das Motiv und die Szene ableiten.
  • Nativ synchronisiertes Audio: Sprache, Umgebungsgeräusche und Musik werden im Gleichschritt mit dem Bild generiert, sodass ein Clip ohne separaten Audiodurchlauf zum Teilen bereit ist.
  • Promptgesteuerte Bewegung: Beschreiben Sie Kamerabewegungen, Tempo und Stimmung in einfacher Sprache, um zu gestalten, wie das Bild lebendig wird.
  • Basiert auf echtem Wissen: Die Ausgaben basieren auf Geminis realem Verständnis und tragen dazu bei, dass animierte Szenen glaubwürdig und thematisch bleiben.
  • Flexibler Rahmen: Wählen Sie 16:9 im Querformat oder 9:16 im Hochformat mit einer in ganzen Sekunden einstellbaren Länge von 3 bis 10 Sekunden.
  • Teil einer Familie: Die Gemini Omni Flash-Reihe deckt mehrere Videoaufgaben ab; Diese Seite konzentriert sich auf die Umsetzung von Bildern in Bewegung.

Parameter#


Die Eingaben entsprechen dem RunComfy OpenAPI Input-Schema für die Bild-zu-Video-Aufgabe.


ParameterErforderlichTypStandardBereich / OptionenBeschreibung
prompt*Ja (*)string—BeschreibungstextBeschreibt, wie sich das Eingabebild bewegen oder verändern soll
image_url*Ja (*)string (Bild-URI)—jpg, jpeg, png, webpDas zu animierende Standbild
aspect_ratioNeinstring16:916:9, 9:16Seitenverhältnis des generierten Videos
durationNeininteger83–10 (Sekunden)Länge des generierten Videos in ganzen Sekunden

Preise#


Die Abrechnung richtet sich nach der Länge des generierten Clips:


  • Video: $0.14 pro Sekunde generiertem Video.

Verwandte Modelle

sora-2/image-to-video

Erstelle lebensechte Szenen mit präzisem Audio und beeindruckender Bildtreue.

veo-3-1/text-to-video

Erzeuge kinoreife Videoclips mit präziser Steuerung und natürlichem Sound

infinite-talk/fast

Erzeugen Sie aus einer Audiospur und einem Bild ein Video; Prompt und Seed sind optional.

seedance-1.0/text-to-video

Erzeugen Sie mit Seedance 1.0 ein Video aus einem Prompt und wählen Sie Auflösung, Seitenverhältnis und Dauer.

ai-avatar/v2/standard

Verwandeln Sie ein Porträt und eine Audiospur mit einem optionalen Prompt in ein Video mit einem sprechenden Avatar für Bewegungs- oder Sprechhinweise.

aurora

Erzeugen Sie aus einem Bild, einer Audiodatei und einem Prompt ein Video mit einstellbarer Text- und Audiosteuerung.

Häufig gestellte Fragen

Was macht Gemini Omni Flash Image to Video?

Gemini Omni Flash Image to Video nimmt ein einzelnes Standbild und eine Textaufforderung auf und animiert das Bild dann zu einem kurzen Clip mit synchronisiertem Ton. Es leitet die natürliche Bewegung des Motivs und der Szene ab, sodass Sie ein Einzelbild in eine bewegte, mit Ton unterlegte Aufnahme umwandeln können, ohne einen separaten Animations- oder Audioschritt.

Was sind die besten Anwendungsfälle für Gemini Omni Flash Image to Video?

Es eignet sich gut, um Standbilder in kurze soziale Clips umzuwandeln, Kamerabewegungen und -tempo anhand eines Referenzbilds zu testen und schnell Prototypen audiovisueller Konzepte zu erstellen. Schöpfer, Vermarkter und Film- oder Spieleteams nutzen Gemini Omni Flash Image to Video häufig, um Bewegung und Atmosphäre zu erkunden, bevor sie sich auf einen vollständigen Produktionsdurchlauf festlegen.

Wie geht Gemini Omni Flash Image to Video mit Audio um?

Das Modell erzeugt Ton im Einklang mit dem animierten Bild, einschließlich Sprache, Umgebungseffekten und gegebenenfalls Musik. Sie können dies in der Eingabeaufforderung mit Gemini Omni Flash Image to Video steuern, indem Sie den gewünschten Dialogton oder Hintergrundton benennen oder nach keinem Dialog fragen, wenn Sie einen ruhigen Clip benötigen.

Wie unterscheidet sich Gemini Omni Flash Image to Video von der Text-zu-Video-Generierung?

Wenn Sie von einem hochgeladenen Bild ausgehen, haben Sie eine bessere Kontrolle über die Eröffnungskomposition und die Identität des Betreffs als bei einer reinen Textaufforderung. Mit Gemini Omni Flash Image to Video verankert das Standbild den Look, während die Eingabeaufforderung angibt, wie sich die Szene bewegt. Dies ist nützlich, wenn Sie bereits ein bestimmtes Bild im Kopf haben.

Welche Seitenverhältnisse und Dauern unterstützt Gemini Omni Flash Image to Video?

Gemini Omni Flash Image to Video unterstützt 16:9-Querformat- und 9:16-Hochformatrahmen mit Cliplängen von 3 bis 10 ganzen Sekunden. Überprüfen Sie das aktuelle RunComfy-Parameterfeld auf die genauen Optionen, da sich die verfügbaren Einstellungen im Laufe der Zeit ändern können.

Welche Eingabegrenzen sollte ich kennen, bevor ich Gemini Omni Flash Image to Video verwende?

Sie stellen ein Eingabebild sowie eine Textaufforderung bereit, die die Bewegung beschreibt. Zu den unterstützten Bildformaten gehören jpg, jpeg, png und webp. Überprüfen Sie für alle Grenzwerte, die nicht im Panel aufgeführt sind, die Parameterfelder RunComfy, da einige Einschränkungen je nach Anbietereinstellungen variieren können.

Können Entwickler Gemini Omni Flash Image to Video über die RunComfy-API verwenden?

Ja. Sie können Gemini Omni Flash Image to Video in der Benutzeroberfläche des AI-Modells RunComfy prototypisieren und dann dasselbe Modell über RunComfy HTTP API mit identischen Parametern für Automatisierung und Produktion aufrufen. Dadurch können Sie vom Testen zur Integration übergehen, ohne das Modell selbst hosten oder skalieren zu müssen.

Wie viel kostet die Generierung mit Gemini Omni Flash Image to Video auf RunComfy?

Die Nutzung von Gemini Omni Flash Image to Video wird nach der Länge des generierten Videos abgerechnet: $0.14 pro Sekunde. Der Betrag wird vom USD- oder Credit-Guthaben Ihres RunComfy-Kontos abgezogen. Neue Nutzer erhalten üblicherweise ein kostenloses Testguthaben; die aktuellen Preise finden Sie im Generierungsbereich dieser Seite.

Folge uns
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Support
  • Discord
  • E-Mail
  • Systemstatus
  • Partner
Videomodelle
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Alle Modelle anzeigen →
Bildmodelle
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Alle Modelle anzeigen →
Rechtliches
  • Nutzungsbedingungen
  • Datenschutzrichtlinie
  • Cookie-Richtlinie
RunComfy
Urheberrecht 2026 RunComfy. Alle Rechte vorbehalten.

RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.

Beispiele für Gemini Omni Flash Image to Video

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...