Verwandeln Sie statische Motive in flüssige Videoclips mit kontrollierbarer Audiogenerierung.
Minimax H3 Image to Video is MiniMax's H3-series model for turning one picture into moving footage. You hand it the opening frame and describe what should happen; the model resolves motion, camera behavior, and scene development, then renders at 768p or 2K.
Because the first frame is pinned by your upload, subject identity, wardrobe, palette, and framing carry through the clip. Minimax H3 Image to Video therefore fits work where the look is settled and only movement is missing.
768p for cheaper drafts or 2k when faces, packaging text, and fine texture need to survive a full-screen crop.These are the live fields for Minimax H3 Image to Video on this page.
| Parameter | Required | Type | Default | Range / Options | Description |
|---|---|---|---|---|---|
| image * | Yes (*) | string (URL) | Sample first frame | 256-5760 px per side, aspect ratio 0.4-2.5 | Opening frame that anchors subject, composition, and style. |
| prompt * | Yes (*) | string | Sample motion brief | 1-4000 characters | What should move, how the camera behaves, how the scene develops. |
| last_image | No | string (URL) | None | Same image constraints as image | Closing frame used to steer where the clip ends. |
| duration * | Yes (*) | integer | 5 | 4-15 | Clip length in whole seconds. |
| resolution * | Yes (*) | string | 768p | 768p, 2k | Output resolution tier. |
Minimax H3 Image to Video bills on resolution and the length of the finished clip:
| Resolution | Price per second | 5s | 10s | 15s |
|---|---|---|---|---|
| 768p | $0.11 | $0.55 | $1.10 | $1.65 |
| 2K | $0.16 | $0.80 | $1.60 | $2.40 |
1) Upload the opening frame — Pick an image where the subject reads clearly and the composition matches the shot you want.
2) Write the motion brief — Say what moves, how fast, and what the camera does. Minimax H3 Image to Video answers to verbs and camera language, not adjective lists.
3) Add a closing frame (optional) — Supply a last image when the ending matters, and keep it compatible with the first frame.
4) Set the length — Start at 5 seconds while tuning wording, then extend toward 15 once the motion behaves.
5) Choose the resolution — Use 768p for drafts; switch to 2k for final deliveries that need more detail.
6) Generate — Submit and review the Minimax H3 Image to Video result at full size.
7) Iterate one variable at a time — Swap the prompt, image, duration, or resolution separately so you can tell what changed the take.
When Minimax H3 Image to Video is not the right fit, these are worth a pass:
Verwandeln Sie statische Motive in flüssige Videoclips mit kontrollierbarer Audiogenerierung.
Verwandle Standbilder in flüssige 1080p-Videos mit realistischer Tiefe und Stilkontrolle.
Erstelle aus Bildern mit Pika 2.2 mühelos lebendige Videos.
Erstellen Sie aus einem Text-Prompt kurze Videos mit wählbarer Dauer, Bildformat und optionaler Tonspur.
Erstellen Sie lebensechte Videoszenen aus Standbildern mit Bewegung, Dialogsynchronisierung und flexibler kreativer Kontrolle.
Animieren Sie ein Ausgangsbild anhand eines Prompts und steuern Sie LoRAs, Frames, FPS, Auflösung, Seitenverhältnis, Steps und Seed.
Minimax H3 Image to Video nimmt ein Standbild plus einen schriftlichen Bewegungsbrief auf und gibt einen 768p- oder 2K-Videoclip zurück. Es wurde entwickelt, um Kunstwerke, Produktfotografien oder ein gerendertes Bild in eine bewegte Aufnahme umzuwandeln, ohne die Szene in einem 3D- oder Compositing-Tool neu erstellen zu müssen. Das hochgeladene Bild legt den Eröffnungsrahmen fest, sodass das von Ihnen bereits genehmigte Motiv und der Rahmen in den Clip übernommen werden.
Neben dem erforderlichen ersten Bild akzeptiert Minimax H3 Image to Video optional ein letztes Bild, das das Ende des Clips bestimmt. Das Modell berechnet die Bewegung zwischen den beiden Standbildern, anstatt auf einen willkürlichen Endzustand zuzusteuern. Sorgen Sie dafür, dass die beiden Bilder in Bezug auf Beleuchtung, Farbpalette und Bildausschnitt optisch kompatibel sind, sonst wirkt der Übergang erzwungen.
Die Ausgabeauflösung kann zwischen „768p“ oder „2k“ gewählt werden, und die Dauer kann zwischen 4 und 15 Sekunden in ganzen Sekunden gewählt werden. Kürzere Clips sind die praktische Wahl, während Sie mit Minimax H3 Image to Video noch die Textformulierung testen, und längere Clips geben einer Szene Raum zur Entwicklung. Überprüfen Sie das Parameterfeld auf dieser Seite auf die genauen Werte, die derzeit verfügbar sind.
Das Quellbild sollte auf jeder Seite zwischen 256 und 5760 Pixel groß sein und ein Seitenverhältnis zwischen 0,4 und 2,5 haben. Die Eingabeaufforderung akzeptiert 1 bis 4000 Zeichen. Minimax H3 Image to Video stellt ein schlecht zugeschnittenes Motiv nicht neu zusammen. Stellen Sie daher ein Bild bereit, das bereits zu Ihrem beabsichtigten Bildausschnitt passt. Die Grenzwerte können je nach Modus oder Anbietereinstellungen variieren. Überprüfen Sie dies daher anhand des Live-Panels.
Beschreiben Sie zuerst, was sich physisch bewegt, dann das Kameraverhalten, dann Beleuchtung und Stimmung. Minimax H3 Image to Video reagiert besser auf konkrete Verben und benannte Kamerabewegungen wie ein langsames Einschieben oder eine Umlaufbahn als auf gestapelte Adjektive. Vermeiden Sie es, zwei konkurrierende visuelle Stile in einer Eingabeaufforderung zu vermischen, da das Ergebnis dazu neigt, sie auszugleichen.
Beim Text-to-Video werden Thema, Komposition und Stil von Grund auf festgelegt, was es schwierig macht, zweimal einen genehmigten Look zu erzielen. Minimax H3 Image to Video entfernt diese Variable, indem der Eröffnungsrahmen an Ihren Upload gebunden wird, was sich für Produktaufnahmen, Charakterarbeiten und Kampagnenmaterial eignet, bei denen die künstlerische Leitung bereits festgelegt ist. Es ist von Natur aus ein engeres Tool mit einer kurzen Eingabeliste und einer schnellen Iterationsschleife.
Ja. Erstellen Sie einen Prototyp in der Web-Benutzeroberfläche von RunComfy AI Playground, um Ihr Bild, Ihre Eingabeaufforderung, Ihre Auflösung und Ihre Dauer festzulegen, und rufen Sie dann dasselbe Modell über die RunComfy-API mit identischen Parametern auf. Dadurch können Sie die Minimax H3-Bild-zu-Video-Einstellungen zwischen manueller Erkundung und Batch- oder geplanten Jobs in Ihrer eigenen Anwendung konsistent halten.
Generationen verbrauchen USD oder Credits von Ihrem RunComfy-Guthaben. Die Rate beträgt 0,11 $ pro Sekunde bei 768p und 0,16 $ pro Sekunde bei 2K. Ein 5-Sekunden-Clip kostet daher 0,55 $ bei 768p oder 0,80 $ bei 2K; 10 Sekunden kosten 1,10 $ oder 1,60 $; 15 Sekunden kosten 1,65 $ oder 2,40 $. Neue Benutzer erhalten in der Regel einen kostenlosen Testbetrag zum Testen; Bei Fragen zur Rechnung wenden Sie sich bitte an hi@runcomfy.com.
RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.





