Erstelle aus Texten beeindruckende KI-Videos mit flüssigen Bewegungen und lebendigen Details.
| Parameter | Erforderlich | Geben Sie | ein Standard | Sortiment / Optionen | Beschreibung |
|---|---|---|---|---|---|
| Eingabeaufforderung * | Ja (*) | Zeichenfolge | Musterbrief | Text | Szene, Bewegung, Kamera und Audio. Zitieren Sie Bild 1 / Video 1 / Audio 1 und sagen Sie, was jede Referenz liefert. |
| reference_images * | Ja (*) | Array (Bild-URL) | Probefoto | Bis zu 12 kombinierte Schiedsrichter | Themen- oder Stilbilder, zitiert als Bild 1, Bild 2, … |
| reference_videos | Nein | Array (Video-URL) | Keine | Bis zu 12 kombinierte Schiedsrichter; jeweils ~2-15 Sek., ≤15 Sek. zusammen | Bewegungsclips zitiert als Video 1, Video 2, … |
| reference_audios | Nein | Array (Audio-URL) | Keine | Bis zu 12 kombinierte Schiedsrichter; jeweils ~2-15 Sek., ≤15 Sek. zusammen | Stimme oder Ambiente; kann nicht die einzige Referenz sein. |
| aspect_ratio | Nein | Zeichenfolge | adaptive | adaptive, 21:9, 16:9, 4:3, 1:1, 3:4, 9:16 | Ausgaberahmen. |
| Auflösung | Nein | Zeichenfolge | 768p | 480p, 768p | Auflösung der nativen Generation. |
| Dauer | Nein | Ganzzahl | 5 | 5-15 | Cliplänge in ganzen Sekunden. |
| prompt_expansion_mode * | Ja (*) | Zeichenfolge | balanced | balanced, quality | Sofortige Umschreibungsbemühungen vor der Generierung. |
| Samen | Nein | Ganzzahl | -1 (zufällig) | Ganzzahl | Festes Saatgut zur Reproduzierbarkeit. |
| enable_safety_checker | Nein | boolescher Wert | wahr | wahr, falsch | Aktiviert den Sicherheitschecker, wenn „true“ ist. |
| Artikel | Preis |
|---|---|
| Ausgabevideo | $0.09 pro Sekunde |
| Referenzbild | $0.03 pro Bild |
Die Auflösung ändert nichts an der Rate pro Sekunde. Beispiel: Ein 5s-Clip mit 2 Referenzbildern kostet $0.51. Die Live-Kreditschätzung finden Sie im Abschnitt „Generierung“ auf dieser Seite.
Erstelle aus Texten beeindruckende KI-Videos mit flüssigen Bewegungen und lebendigen Details.
Animieren Sie ein Referenzbild mit Bewegung aus einem Bewegungsvideo mithilfe positiver und negativer Eingabeaufforderungen sowie anpassbarer Generierungseinstellungen.
Skalieren Sie ein Quellvideo auf eine gewählte Zielauflösung und Bildrate hoch.
Erstelle aus Bildern mit Pika 2.2 mühelos lebendige Videos.
Schnelle Clip-Erstellung mit Ton, Text und visuellem Stil
Animieren Sie ein Referenzbild einer Figur mit Bewegung aus einem Bewegungsvideo mithilfe von Eingabeaufforderungs-, Auflösungs-, Inferenz-, Bildführungs- und Posenführungssteuerungen.
MiniMax H3 Max Reference to video generiert kurze Clips aus einer Eingabeaufforderung sowie Bild-, Video- und/oder Audioreferenzen. Es eignet sich hervorragend, wenn Sie bei allen Aufnahmen Konsistenz von Charakter, Produkt oder Stil benötigen, während Bild und nativer Ton gemeinsam produziert werden.
Bei der Bild-zu-Video-Animation wird normalerweise ein Eröffnungsbild animiert. MiniMax H3 Max Reference to video Bedingungen für mehrere multimodale Referenzen – Bilder für Identität oder Aussehen, optionale Videos für Bewegung, optionales Audio für Stimme oder Atmosphäre – sodass Sie mehrere Hinweise in einem Brief steuern können.
Clips dauern 5–15 Sekunden bei 480p oder 768p. Referenzbilder, Videos und Audios zusammen dürfen höchstens 12 Dateien umfassen; Video- und Audio-Referenzen dauern in der Regel jeweils etwa 2–15 Sekunden mit einer Gesamtdauer von bis zu 15 Sekunden. Audio kann nicht die einzige Referenz sein – schließen Sie mindestens ein Bild oder Video ein. Überprüfen Sie das Parameterfeld auf Live-Grenzwerte.
Benennen Sie jedes Asset der Reihe nach (Bild 1, Video 1, Audio 1) und sagen Sie, was es bietet – Identität, Garderobe, Bewegung oder Stimme. Fügen Sie klare Kamera- und Audiolinien hinzu, damit MiniMax H3 Max Reference to video die Lippensynchronisation, die Atmosphäre und den Bildausschnitt mit den Referenzen in Einklang hält.
Ja. MiniMax H3 Max Reference to video rendert natives Audio im selben Durchgang wie das Video. Sie können auch Referenzaudio hinzufügen, wenn Sie eine bestimmte Stimme oder Atmosphäre benötigen, sofern auch eine Bild- oder Videoreferenz vorhanden ist.
MiniMax H3 Max Reference to video unterstützt 480p und 768p mit Seitenverhältnissen wie adaptive, 21:9, 16:9, 4:3, 1:1, 3:4 und 9:16. Adaptiv folgt nach Möglichkeit dem Referenzrahmen.
Ja. Erstellen Sie einen Prototyp für MiniMax H3 Max Reference to video in der Web-Benutzeroberfläche RunComfy und rufen Sie dann zur Automatisierung dasselbe Modell und dieselben Parameter über RunComfy HTTP API auf. Neue Konten erhalten in der Regel ein kostenloses Testguthaben in US-Dollar, um mit dem Testen zu beginnen.
Am RunComfy wird MiniMax H3 Max Reference to video mit $0.09 pro Sekunde ausgegebenes Video plus $0.03 pro Referenzbild abgerechnet. Beispielsweise kostet ein 5-Sekunden-Clip mit 2 Referenzbildern $0.51. Generationen verbrauchen USD/Credits; Den Live-Schätzwert finden Sie im Abschnitt „Generierung“ auf der Modellseite.
RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.





