ComfyUI>Workflows>MiniMax H3 Langvideogenerierung | Motion Context V2

MiniMax H3 Langvideogenerierung | Motion Context V2

Workflow Name: RunComfy/MiniMax-H3-Long-Video
Workflow ID: 0000...1526
Verwandeln Sie ein Bild in eine erweiterte H3-Kinosequenz. Sie verknüpfen Eingabeaufforderungen, um jede Szene zu leiten. Der Motion Context trägt Bilder und Ton über Übergänge hinweg. Ihr Charakter bleibt konsistent. Natives Audio fließt ohne sichtbare Schnitte. Erstellen Sie Verfolgungsjagden, Reisesequenzen und Dialogszenen schneller.

ComfyUI MiniMax H3 Long Video Workflow

MiniMax H3 Long Video | Motion Context V2
Want to run this workflow?
  • Fully operational workflows
  • No missing nodes or models
  • No manual setups required
  • Features stunning visuals

ComfyUI MiniMax H3 Long Video Examples

MiniMax H3 Langvideo: nahtlose Langzeit-Referenz-zu-Video in ComfyUI#

MiniMax H3 Langvideo ist ein speziell entwickelter ComfyUI-Workflow zum Erstellen einer kontinuierlichen, ungeschnittenen Aufnahme, indem mehrere MiniMax H3-Referenz-zu-Video-Generierungen aneinandergereiht werden. Basierend auf einem Mehrspur-Editor mit Bewegungs-Kontext erbt jedes neue Segment die letzten Frames und das aktive Audio des vorherigen, sodass Kamerabewegung, Charakterdarstellung und Ambiente sauber über Übergänge hinwegfließen. Mit einem einzigen gemeinsamen Referenzbild, um Gesicht, Haare, Outfit und Palette zu fixieren, sowie einer Einzelabpassung pro Segment liest sich das Ergebnis wie eine Aufnahme ohne sichtbare Nähte.

Verwenden Sie MiniMax H3 Langvideo, wenn Sie Verfolgungsszenen, Dialoge, Reisesequenzen und andere narrative Langzeitaufnahmen aus einem Bild und einigen verknüpften Eingabeaufforderungen benötigen. Es hält Identität und Ton konsistent, während Sie die Geschichte Schlag für Schlag durch Segmentaufforderungen und -dauern steuern.

Wichtige Modelle im Comfyui MiniMax H3 Langvideo-Workflow#

  • MiniMax H3 Referenz-zu-Video-Modell. Treibt jedes Segment von einem gemeinsamen Referenzbild und der aktuellen Eingabeaufforderung an und produziert zeitlich kohärentes Video mit nativem Audio. Seine Rolle in diesem Workflow besteht darin, die Subjektidentität über Segmente hinweg zu bewahren, während es Eingabeaufforderungsänderungen akzeptiert, die Aktion, Kamera und Szene weiterentwickeln, ohne die Kontinuität zu unterbrechen.

So verwenden Sie den Comfyui MiniMax H3 Langvideo-Workflow#

Dieser Workflow organisiert die Produktion wie eine Zeitleiste: Richten Sie globale Vermögenswerte ein, erstellen Sie eine Reihe von Segmenten und lassen Sie den Bewegungs-Kontext Bild und Ton bei jedem Übergang weitertragen. Sie entscheiden, was sich pro Segment über Eingabeaufforderungen ändert, während das gemeinsame Referenzbild und die Einzelabpassung die Kontinuität wahren.

  • Globale Einrichtung und Referenzbild
    • Laden Sie ein hochqualitatives Referenzbild hoch. Dies wird zum kanonischen Look für die gesamte Aufnahme, wählen Sie also ein scharfes, frontbeleuchtetes Bild mit dem Charakter, der ähnlich wie Ihr beabsichtigter Winkel gerahmt ist.
    • Geben Sie eine Basis-Eingabeaufforderung ein und, falls erforderlich, eine negative Eingabeaufforderung, die für alle Segmente gilt. Behalten Sie Beschreibungen des Charakters und der Garderobe in der Basis-Eingabeaufforderung bei, um die Identität zu verstärken.
    • Legen Sie Ihre Ausgabeauflösung, Bildrate und das Ziel für die Gesamtlaufzeit fest. MiniMax H3 Langvideo wird diese Dauer durch Aneinanderreihung von Segmenten füllen.
  • Segment-Zeitleisten-Autorenschaft
    • Erstellen Sie Segmente in der Reihenfolge. Jedes Segment hat eine kurze, fokussierte Eingabeaufforderung, die die Änderung für diesen Schlag darstellt: Bewegung ("sprintet an geparkten Autos vorbei"), Kamera ("handgehaltene Kamera folgt von hinten") oder Szenendetail ("Regen nimmt zu, Neonreflexionen auf Asphalt").
    • Halten Sie Eingabeaufforderungen additiv und spezifisch. Bestätigen Sie das Subjekt und die Garderobe in frühen Segmenten erneut, dann verkürzen Sie spätere Eingabeaufforderungen auf Aktionen und Kinematografie, sobald die Identität gesichert ist.
    • Weisen Sie Dauern zu, damit der Rhythmus natürlich wirkt. Längere Schläge helfen dem Betrachter, Szenenänderungen zu registrieren; kürzere Schläge betonen die Aktion. Der Workflow wird sie nahtlos zusammensetzen.
  • Übergabe des Bewegungs-Kontextes
    • Die letzten Frames von Segment N werden als Bewegungs-Kontext in Segment N+1 übergeben. Das bedeutet, dass Körperhaltung, Kameraverlauf und Szenenlayout nahtlos fortgesetzt werden.
    • Da das Sampling pro Segment einmalig ist, gibt es keine erneute Rendering-Schleife an den Übergängen. Sie erhalten saubere Übergaben ohne zeitliche Unschärfe oder halluzinierte Wiedereintritte.
    • Wenn Sie einen sichtbaren Drehpunkt möchten, schreiben Sie ihn. Zum Beispiel: "Der Charakter stoppt am Zebrastreifen, Kamera umkreist zu einer Frontalaufnahme" weist das nächste Segment an, sich natürlich zu drehen, anstatt zu schneiden.
  • Audio-Kontinuität
    • Natives Audio von MiniMax H3 Langvideo begleitet die Zeitleiste mit sanften Überblendungen zwischen den Segmenten. Umgebungsbetten und Stimmen gehen über die Übergänge hinweg weiter, es sei denn, Ihre nächste Eingabeaufforderung führt eine klare Audioänderung ein.
    • Um einen hörbaren Übergang zu betonen, fügen Sie ihn in die Eingabeaufforderung für die ersten Sekunden des nächsten Segments ein, wie "Menschenmenge wird lauter, Sirene verblasst von links nach rechts", damit das Modell die Klangbühne steuert, während sich das Bild entwickelt.
  • Rendern und Exportieren
    • Stellen Sie die gesamte Zeitleiste in die Warteschlange, sobald Sie mit den Eingabeaufforderungen und der Segmentreihenfolge zufrieden sind. Der Workflow generiert jedes Segment in der Reihenfolge und fügt sie zu einer einzigen Videodatei bei Ihrer gewählten Bildrate und Ihrem Codec zusammen.
    • Überprüfen Sie die endgültige Aufnahme von Anfang bis Ende. Wenn ein Übergang als Schnitt gelesen wird, passen Sie nur die Eingabeaufforderungen um diese Grenze herum an oder balancieren Sie die Dauer der angrenzenden Segmente leicht neu aus.

Wichtige Knoten im Comfyui MiniMax H3 Langvideo-Workflow#

  • MiniTrack-Zeitleisten-Editorgruppe
    • Dient als Ihr Storyboard und Ihre Zeitleiste. Verwenden Sie es, um die Segmentreihenfolge, -dauern und -aufforderungen an einem Ort zu arrangieren, damit Sie über den Handlungsfluss nachdenken können, ohne den Generierungsstapel zu berühren.
    • Halten Sie das Referenzbild und die globalen Eingabeaufforderungen im Zeitleistenkopf fixiert. Dies stellt sicher, dass jedes Segment denselben Identitätsanker zieht, während Ihre schlagspezifischen Eingabeaufforderungen darüber geschichtet werden.
  • Bewegungs-Kontext-Brücke
    • Handhabt die End-zu-Start-Frame-Weitergabe zwischen Segmenten. Sie müssen hier selten etwas ändern; es existiert, um die Übergänge unsichtbar zu machen.
    • Wenn Sie ein leichtes Zittern an einer Grenze bemerken, glätten Sie es, indem Sie das ausgehende Segment leicht verlängern oder das nächste Segment mit einer Mikroaktion öffnen, die das Modell animieren kann, wie "Atem beruhigt sich, Schritte setzen sich fort".
  • Audio-Stitcher
    • Richten Sie natives Audio aus aufeinanderfolgenden Segmenten mit kurzen Überblendungen aus. Verwenden Sie Segmentaufforderungen, um bemerkenswerte Audioänderungen zu beschreiben, nicht die internen Details dieser Gruppe.
    • Für einen deutlichen Szenenwechsel fügen Sie ein schnelles hörbares Ereignis am Anfang der neuen Segmentaufforderung ein, wie "Tür schlägt zu, Flurhall".

Optionale Extras#

  • Eingabeaufforderungsschreiben, das reist
    • Verwenden Sie eine kompakte "Subjekt + Szene + Aktion + Kamera"-Formel pro Segment. Beispiele: "derselbe Läufer, Nachtmarktgasse, beschleunigt in einen Sprint, Handkamera folgt"; "derselbe Läufer, erhöhte Bahnplattform, verlangsamt auf einen Spaziergang, dolly nach links".
    • Wiederholen Sie Ankerphrasen wie "derselbe Läufer", um Abweichungen zu vermeiden.
  • Referenzbilddisziplin
    • Beschneiden Sie auf konsistente Kopffreiheit und Linsengefühl. Vermeiden Sie extreme Fischaugen- oder Schwachlicht-Rauschen in Ihrem Referenzbild, das sich über die gesamte Aufnahme ausbreiten kann.
  • Segment-Timing
    • Planen Sie 3 bis 6 Segmente für kurze Tests und skalieren Sie dann auf. Beginnen Sie mit breiteren Schlägen, überarbeiten Sie Eingabeaufforderungen und erweitern Sie dann nur die Zeitleiste, um Ihre Zieldauer zu erreichen.
  • Diagnose eines sichtbaren Übergangs
    • Wenn eine Grenze auffällt, schubsen Sie die ausgehende Eingabeaufforderung, um die nächste Aktion vorwegzunehmen, oder fügen Sie eine einfache Übergangsaktion zur eingehenden Eingabeaufforderung hinzu. Kleine textliche Hinweise beheben oft zeitliche Störungen.

MiniMax H3 Langvideo verwandelt ein einzelnes Bild und eine Handvoll verknüpfter Eingabeaufforderungen in eine kontinuierliche Aufnahme mit nativem Audio, bereit für Geschichtenerzählung. Verwenden Sie den Comfyui MiniMax H3 Langvideo-Workflow, um Langzeitsequenzen zu blockieren, zu verfeinern und zu liefern, die gefilmt und nicht zusammengefügt wirken.

Danksagungen#

Dieser Workflow implementiert und baut auf den folgenden Arbeiten und Ressourcen auf. Wir danken MiniMax für den H3 Langvideo-Workflow-Quellcode für ihre Beiträge und Wartung. Für autoritative Details verweisen wir auf die originale Dokumentation und die unten verlinkten Repositories.

Ressourcen#

Hinweis: Die Nutzung der referenzierten Modelle, Datensätze und des Codes unterliegt den jeweiligen Lizenzen und Bedingungen der Autoren und Verwalter.

RunComfy
Urheberrecht 2026 RunComfy. Alle Rechte vorbehalten.

RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.