Animieren Sie ein Ausgangsbild anhand eines Prompts und steuern Sie LoRAs, Frames, FPS, Auflösung, Seitenverhältnis, Steps und Seed.
Gemini Omni Flash ist die multimodale Videogenerierungsfamilie von Google, die auf dem realen Wissen von Gemini und einem besseren Verständnis der Physik für glaubwürdigere Bewegungen und Interaktionen basiert. Die größere Familie umfasst vier verwandte Aufgaben: Text-zu-Video, Bild-zu-Video, Videobearbeitung und Referenz-zu-Video. Diese RunComfy-Seite führt die Text-zu-Video-Aufgabe aus und verwandelt eine schriftliche Aufforderung in einen kurzen Filmclip mit synchronisiertem Ton.
Da es darüber nachdenkt, wie sich die Welt tatsächlich verhält, sorgt das Modell dafür, dass Objekte, Beleuchtung und Bewegung über eine Aufnahme hinweg kohärent bleiben, anstatt von Bild zu Bild zu driften.
Die Eingaben entsprechen dem RunComfy OpenAPI Input für die Text-zu-Video-Aufgabe.
| Parameter | Erforderlich | Typ | Standard | Bereich / Optionen | Beschreibung |
|---|---|---|---|---|---|
| prompt* | Ja (*) | string | — | Beschreibender Text | Text-Prompt für das zu erzeugende Video |
| aspect_ratio | Nein | string | 16:9 | 16:9, 9:16 | Seitenverhältnis des Videos |
| duration | Nein | integer | 8 | 3–10 (Sekunden) | Videolänge in ganzen Sekunden |
Die Abrechnung richtet sich nach der Länge des generierten Clips:
Animieren Sie ein Ausgangsbild anhand eines Prompts und steuern Sie LoRAs, Frames, FPS, Auflösung, Seitenverhältnis, Steps und Seed.
Erzeugen Sie aus einem Bild, einer Audiodatei und einem Prompt ein Video mit einstellbarer Text- und Audiosteuerung.
Erstelle fließende Videos aus zwei Bildern mit realistischer Bewegung
Animiert ein Standbild per Prompt zu einem flüssigen Video in 720P oder 1080P.
KI-gestützte Bildanimationen in 1080p mit präziser Kontrolle und Effekten
Animieren Sie mit Hailuo 02 Pro ein Ausgangsbild anhand eines Prompts zu einem sechssekündigen Video.
Gemini Omni Flash ist das multimodale Videomodell von Google, das eine Textaufforderung in einen kurzen Filmclip mit synchronisiertem Ton umwandelt. Auf dieser RunComfy-Seite wird die Text-zu-Video-Aufgabe ausgeführt, wodurch sie sich für soziale Anzeigen, Story-Beats und schnelle Vorvisualisierungen eignet, bei denen Bewegung und Ton gleichermaßen wichtig sind.
Die Gemini Omni Flash-Familie umfasst vier verwandte Aufgaben: Text-zu-Video, Bild-zu-Video, Videobearbeitung und Referenz-zu-Video. Auf dieser RunComfy-Seite wird die Text-zu-Video-Aufgabe vorgestellt, die ein Video allein aus einer schriftlichen Eingabeaufforderung generiert, während die anderen Aufgaben mit vorhandenen Bildern oder Filmmaterial beginnen.
Ja. Gemini Omni Flash erzeugt synchronisiertes Audio – wie Sprache, Soundeffekte und Musik – abgestimmt auf die generierte Aktion. Sie können den Ton von der Ansage aus steuern, indem Sie beispielsweise nach ruhiger Hintergrundmusik fragen oder keinen Dialog festlegen.
Gemini Omni Flash basiert auf dem realen Wissen von Gemini und verfügt über ein verbessertes Verständnis der Physik, das dabei hilft, Bewegung, Beleuchtung und Objektinteraktion während einer Aufnahme kohärent zu halten. Dadurch wird die bei älteren Text-zu-Video-Modellen übliche Bild-zu-Bild-Drift reduziert.
Die Text-zu-Video-Aufgabe erfordert eine erforderliche Eingabeaufforderung, ein Seitenverhältnis von 16:9 oder 9:16 und eine Dauer zwischen 3 und 10 Sekunden. Überprüfen Sie vor der Generierung das aktuelle RunComfy-Parameterfeld auf die genauen Standardwerte und etwaige anbieterseitige Einschränkungen.
Beschreiben Sie Motiv, Aktion, Kamera, Stimmung und Beleuchtung und steuern Sie das Tempo direkt in der Eingabeaufforderung (z. B. eine einzelne Serienaufnahme). Fügen Sie Ausschlüsse in die Eingabeaufforderung selbst ein, z. B. „Keinen Text anzeigen“, da Gemini Omni Flash negative Anweisungen aus der Eingabeaufforderung liest.
Ja. Sie können Gemini Omni Flash in der Benutzeroberfläche des RunComfy-Modells prototypisieren und dann dasselbe Modell über die RunComfy-API mit identischen Parametern aufrufen. Dadurch können Sie von einem Browsertest zur automatisierten Generierung übergehen, ohne das Modell selbst hosten oder skalieren zu müssen.
Generationen mit Gemini Omni Flash werden mit 0,13 US-Dollar pro Sekunde des generierten Videos in Rechnung gestellt und Ihr RunComfy-USD-Guthaben oder Ihr Guthaben in Anspruch genommen. Neue Benutzer beginnen normalerweise mit einem kostenlosen Testbetrag; Aktuelle Einzelheiten finden Sie im Abschnitt „Generierung“ auf dieser Seite.
RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.





