FLUX 3 Draft FLF: Schnelle Start-End-Frame-Videovorschau mit 720p
Dieses Modell nimmt ein Bild und eine schriftliche Anweisung entgegen und verwandelt die Aufnahme in einen kurzen filmischen Clip mit integriertem Ton. Es ist Teil der Gemini Omni Flash-Familie von Google, die auch Text-zu-Video, Videobearbeitung und Referenzbild-zu-Video umfasst; Auf dieser RunComfy-Seite wird die Bild-zu-Video-Aufgabe ausgeführt.
Da das Modell darüber nachdenkt, wie sich die physische Welt verhält, bleibt die Bewegung vom ersten Bild an kohärent, anstatt zu driften oder sich zu verziehen, während die Aufnahme abläuft.
Die Eingaben entsprechen dem RunComfy OpenAPI Input-Schema für die Bild-zu-Video-Aufgabe.
| Parameter | Erforderlich | Typ | Standard | Bereich / Optionen | Beschreibung |
|---|---|---|---|---|---|
| prompt* | Ja (*) | string | — | Beschreibungstext | Beschreibt, wie sich das Eingabebild bewegen oder verändern soll |
| image_url* | Ja (*) | string (Bild-URI) | — | jpg, jpeg, png, webp | Das zu animierende Standbild |
| aspect_ratio | Nein | string | 16:9 | 16:9, 9:16 | Seitenverhältnis des generierten Videos |
| duration | Nein | integer | 8 | 3–10 (Sekunden) | Länge des generierten Videos in ganzen Sekunden |
Die Abrechnung richtet sich nach der Länge des generierten Clips:
FLUX 3 Draft FLF: Schnelle Start-End-Frame-Videovorschau mit 720p
Animieren Sie das Bild einer Referenzfigur mit Bewegungen aus einem Fahrvideo und sorgen Sie dabei dafür, dass die Figur erkennbar bleibt.
Erstellen Sie aus Referenzbildern und einem Prompt ein kurzes Video mit synchronisiertem Ton.
Vertonen Sie ein vorhandenes Video mit einer Audiospur; Prompt und Seed sind optional.
MiniMax H3 Max: Text oder Bild zu Video mit nativem Audio bei 480p/768p
Erzeugen Sie Videos zwischen Start- und Endbildern mit optionalem Audio
Gemini Omni Flash Image to Video nimmt ein einzelnes Standbild und eine Textaufforderung auf und animiert das Bild dann zu einem kurzen Clip mit synchronisiertem Ton. Es leitet die natürliche Bewegung des Motivs und der Szene ab, sodass Sie ein Einzelbild in eine bewegte, mit Ton unterlegte Aufnahme umwandeln können, ohne einen separaten Animations- oder Audioschritt.
Es eignet sich gut, um Standbilder in kurze soziale Clips umzuwandeln, Kamerabewegungen und -tempo anhand eines Referenzbilds zu testen und schnell Prototypen audiovisueller Konzepte zu erstellen. Schöpfer, Vermarkter und Film- oder Spieleteams nutzen Gemini Omni Flash Image to Video häufig, um Bewegung und Atmosphäre zu erkunden, bevor sie sich auf einen vollständigen Produktionsdurchlauf festlegen.
Das Modell erzeugt Ton im Einklang mit dem animierten Bild, einschließlich Sprache, Umgebungseffekten und gegebenenfalls Musik. Sie können dies in der Eingabeaufforderung mit Gemini Omni Flash Image to Video steuern, indem Sie den gewünschten Dialogton oder Hintergrundton benennen oder nach keinem Dialog fragen, wenn Sie einen ruhigen Clip benötigen.
Wenn Sie von einem hochgeladenen Bild ausgehen, haben Sie eine bessere Kontrolle über die Eröffnungskomposition und die Identität des Betreffs als bei einer reinen Textaufforderung. Mit Gemini Omni Flash Image to Video verankert das Standbild den Look, während die Eingabeaufforderung angibt, wie sich die Szene bewegt. Dies ist nützlich, wenn Sie bereits ein bestimmtes Bild im Kopf haben.
Gemini Omni Flash Image to Video unterstützt 16:9-Querformat- und 9:16-Hochformatrahmen mit Cliplängen von 3 bis 10 ganzen Sekunden. Überprüfen Sie das aktuelle RunComfy-Parameterfeld auf die genauen Optionen, da sich die verfügbaren Einstellungen im Laufe der Zeit ändern können.
Sie stellen ein Eingabebild sowie eine Textaufforderung bereit, die die Bewegung beschreibt. Zu den unterstützten Bildformaten gehören jpg, jpeg, png und webp. Überprüfen Sie für alle Grenzwerte, die nicht im Panel aufgeführt sind, die Parameterfelder RunComfy, da einige Einschränkungen je nach Anbietereinstellungen variieren können.
Ja. Sie können Gemini Omni Flash Image to Video in der Benutzeroberfläche des AI-Modells RunComfy prototypisieren und dann dasselbe Modell über RunComfy HTTP API mit identischen Parametern für Automatisierung und Produktion aufrufen. Dadurch können Sie vom Testen zur Integration übergehen, ohne das Modell selbst hosten oder skalieren zu müssen.
Die Nutzung von Gemini Omni Flash Image to Video wird nach der Länge des generierten Videos abgerechnet: $0.14 pro Sekunde. Der Betrag wird vom USD- oder Credit-Guthaben Ihres RunComfy-Kontos abgezogen. Neue Nutzer erhalten üblicherweise ein kostenloses Testguthaben; die aktuellen Preise finden Sie im Generierungsbereich dieser Seite.
RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.





