ComfyUI>Workflows>Minimax H3 I2V Dual Clock 8-Step| Ultra-schnelles Hochwertiges Video

Minimax H3 I2V Dual Clock 8-Step| Ultra-schnelles Hochwertiges Video

Workflow Name: RunComfy/Minimax-H3-I2V-Dual-Clock
Workflow ID: 0000...1496
Verwandeln Sie ein Bild in eine kurze Audio-Video-Szene. Sie steuern Bewegung und Ton mit einfachen Eingaben. Duale Uhren halten visuelle und stereo Audio synchron. Das 8-Step Turbo-Setup verkürzt die Renderzeit. Animieren Sie Charaktere, Produkte, Fahrzeuge oder Landschaften. Erreichen Sie filmische Bewegung mit weniger Aufwand.

ComfyUI Minimax H3 I2V Dual Clock 8-Step High-Quality Ultra-Fast Workflow

Minimax H3 I2V ComfyUI | 8-Step Dual Clock Audio Video
Want to run this workflow?
  • Fully operational workflows
  • No missing nodes or models
  • No manual setups required
  • Features stunning visuals

ComfyUI Minimax H3 I2V Dual Clock 8-Step High-Quality Ultra-Fast Examples

Minimax H3 I2V Dual Clock 8-Step Hochwertiges Ultra-Schnell#

Dieser RunComfy-fähige ComfyUI-Workflow verwandelt ein einzelnes Referenzbild und eine kombinierte Bewegungs- und Audio-Eingabeaufforderung in ein kurzes, synchronisiertes Video mit nativem Stereoton. Basierend auf MiniMax H3 Ref2VA-Conditioning und einem 8-Step Dual Clock-Sampler liefert er schnelle Bildanimationen und eng gekoppelte Sounds ohne visuelle Kohärenz zu opfern.

Verwenden Sie den Minimax H3 I2V Dual Clock 8-Step Hochwertiges Ultra-Schnell-Workflow für filmische Bildanimationen, Charakterdarstellungen, Fahrzeuge, Produktaufnahmen und atmosphärische Szenen, die von synchronisierter Bewegung und generiertem Audio profitieren. Der Graph integriert SageAttention für speichereffiziente Inferenz und die MiniMax-H3 Turbo LoRA für beschleunigte Generierung, während die benutzerfreundliche I2V-Erfahrung einfach bleibt.

Schlüsselmodelle im Comfyui Minimax H3 I2V Dual Clock 8-Step Hochwertiges Ultra-Schnell-Workflow#

  • MiniMax-H3 AV Foundation Model. Der Kern-Audiovisuelle Transformer, der die Referenzbild-Conditioning, Bewegungsgenerierung und native Audiosynthese antreibt. Siehe die offizielle Modellkarte auf Hugging Face: MiniMaxAI/MiniMax-H3.
  • MiniMax-H3 Turbo LoRA V4 step600. Ein leichter Adapter, der MiniMax-H3 für 8-Step-Sampling beschleunigt und stabilisiert, während die Wiedergabetreue erhalten bleibt. Modellkarte: larryvrh/MiniMax-H3-Turbo-Lora.
  • MiniMax-H3 Video VAE und Audio VAE. Paarweise Decoder, die audiovisuelle Latenten in RGB-Frames und Stereo-Wellenformen umwandeln. Sie gewährleisten einen effizienten Latententransport während des Samplings und eine hochwertige Decodierung am Ende.

So verwenden Sie den Comfyui Minimax H3 I2V Dual Clock 8-Step Hochwertiges Ultra-Schnell-Workflow#

Dieser Workflow läuft von links nach rechts in drei gruppierten Phasen: Modell- und Asset-Setup, Dual-Clock-Sampling und Dekodierung plus MP4-Muxing. Sie stellen ein Referenzbild und eine einzige Eingabeaufforderung bereit, die sowohl die visuelle Richtung als auch einen "Audio:"-Abschnitt mit der gewünschten Klangbeschreibung enthält.

H3 Loader + Turbo LoRA (EMA)#

Diese Gruppe bereitet den MiniMax-H3-Stack vor und wendet das Turbo LoRA für Geschwindigkeit an. Laden Sie Ihr Referenzbild in LoadImage, dann schreiben Sie eine beschreibende Bewegungsaufforderung, die mit einem "Audio: ..."-Absatz in CR Prompt Text endet. Wählen Sie Ihre Ausgabengröße mit ResolutionSelector, der die Dimensionen auf Vielfache von 32 für Videostabilität hält. Stellen Sie Ihre Zieldauer in Sekunden mit der Steuerung Float (duration) ein; die interne Mathematik des Graphen wandelt diese in eine Frameanzahl um, die mit dem Timing des Modells übereinstimmt, sodass der Sampler reibungslos läuft. Ein SageAttention-Patch wird auf das Modell angewendet, um den VRAM-Verbrauch zu reduzieren und den Durchsatz zu verbessern, ohne das endgültige Aussehen zu verändern.

STABIL: Video 4 / Audio 4#

Diese Gruppe führt das Kernstück der Generierung mit einem 8-Schritt MiniMax H3 Dual Clock-Sampler durch. Der Conditioning-Block verwendet Ref2VA, um Ihr Referenzbild und den Textprompt in ein AV-Latent zu verschmelzen, das Identität, Komposition und hochrangige Sound-Cues verankert. Der Dual Clock-Sampler führt Video und Audio mit separaten, aber synchronisierten Uhren fort, sodass Bewegung und Ton sich natürlich synchronisiert anfühlen. Wenn Sie eine wahrgenommene Vor- oder Nachlaufkorrektur benötigen, passen Sie die Video- und Audiouhrverschiebungen an, um entweder den Stream vorwärts oder rückwärts zu bewegen, bis die Leistung synchron ist. Ein grundlegender CFG-Stil-Guider balanciert die Treue zu Ihrem Prompt mit den erlernten Prioren des Modells für saubere, filmische Bewegungen.

Dekodieren + synchronisiertes MP4#

Der Decoder wandelt das finale AV-Latent in eine Frame-Sequenz und einen Stereo-Audiotrack mit den dedizierten MiniMax-H3 VAEs um. Die VHS_VideoCombine-Stufe verpackt Frames und Audio in ein einzelnes H.264 MP4 mit Ihrer gewählten Bildrate und speichert ein sofort teilbares Video. Wenn Sie später Ihr eigenes Audio hinzufügen, können Sie auf die Audiolänge zuschneiden oder nur Bilder für externe Bearbeitung exportieren. Das Ergebnis ist ein kompaktes, synchronisiertes Clip, das das Aussehen Ihres Referenzbildes bewahrt und gleichzeitig lebensechte Bewegung und Ton hinzufügt.

Schlüssel-Knoten im Comfyui Minimax H3 I2V Dual Clock 8-Step Hochwertiges Ultra-Schnell-Workflow#

MiniMaxH3AudioConditioningT8 (#6)#

Dieser Knoten implementiert Ref2VA-Conditioning, indem er Ihre Eingabeaufforderung, das Referenzbild, die Zielbreite, Höhe und Länge verwendet, um ein audiovisuelles Latent und positive Konditionierung zu erstellen. Verwenden Sie es, um die kreative Absicht festzulegen: Beschreiben Sie Bewegung, Kameraverhalten und Szenenkontinuität, und fügen Sie dann ein "Audio:"-Segment hinzu, das Instrumente, Timbre, Ambiente und Dynamik spezifiziert. Halten Sie Breite und Höhe konsistent mit dem Seitenverhältnis Ihres Referenzbildes für die kohärentesten Layouts. Die Längensteuerung ordnet Ihre Dauer den Frames zu, die mit dem internen Timing des Samplers übereinstimmen, was hilft, eine gleichmäßige Bewegung und stabiles Audio zu erhalten. Bereitgestellt vom ComfyUI MiniMax H3 Turbo-Projekt: Larryvrh/ComfyUI-MiniMax-H3-Turbo.

MiniMaxH3DualClockSamplerT8 (#7)#

Ein 8-Schritt-Sampler, der speziell für MiniMax-H3 AV-Generierung mit separaten Video- und Audiouhren entwickelt wurde. Er liefert schnelle, hochwertige Ergebnisse, indem er beide Zeitachsen koordiniert und gleichzeitig Ihre Ref2VA-Einschränkungen respektiert. Wenn sich visuelle Inhalte leicht früh oder spät im Verhältnis zum Beat oder zur Aktion anfühlen, passen Sie die Video- und Audiouhrverschiebungen in kleinen Schritten an, um die Synchronisation neu zu zentrieren. Halten Sie die Anzahl der Schritte auf acht für das beabsichtigte Hochwertige Ultra-Schnell-Gleichgewicht. Implementiert im selben Plugin: Larryvrh/ComfyUI-MiniMax-H3-Turbo.

LoraLoaderBypassModelOnly (#2)#

Injiziert die MiniMax-H3 Turbo LoRA in das Basismodell, um die Konvergenz zu beschleunigen und die Stabilität bei niedrigen Schritten zu verbessern. Wenn Sie eine Überverschärfung oder Identitätsdrift bei bestimmten Bildern bemerken, reduzieren Sie die LoRA-Stärke leicht, um Neutralität zurückzugewinnen. Für detailliertere Details oder stärkere zeitliche Bindung erhöhen Sie die Stärke moderat. LoRA-Referenz: larryvrh/MiniMax-H3-Turbo-Lora.

MiniMaxH3MemoryEfficientSageAttentionPatch (#17)#

Wendet eine speichereffiziente Aufmerksamkeitsimplementierung auf das MiniMax-H3-Modell an, um den Durchsatz auf typischen GPUs zu verbessern. Verwenden Sie es unverändert, um den VRAM-Druck bei größeren Auflösungen und längeren Dauern zu verringern. Der Patch ist Teil der KJNodes-Suite für ComfyUI: kijai/ComfyUI-KJNodes.

MiniMaxH3AVDecodeT8 (#11)#

Dekodiert das audiovisuelle Latent in RGB-Frames und Stereo-Audio mit den gepaarten MiniMax-H3 VAEs. Hier wird die endgültige Wiedergabetreue realisiert, daher halten Sie die Auflösungswahl realistisch für Ihre GPU, um Dekodierungsengpässe zu vermeiden. Der Knoten gibt Frames und ein Audiosignal aus, die mit den Uhren des Samplers zeitlich abgestimmt sind, bereit für das Muxing. Bereitgestellt vom MiniMax H3 Turbo-Plugin: Larryvrh/ComfyUI-MiniMax-H3-Turbo.

VHS_VideoCombine (#12)#

Kombiniert dekodierte Frames und Stereo-Audio zu einem einzigen MP4 unter Verwendung der Video Helper Suite. Stellen Sie Ihre bevorzugte Bildrate ein und aktivieren Sie das Trimmen, wenn Sie später benutzerdefiniertes Audio ersetzen. Dieser Knoten finalisiert die Lieferung, sodass Sie schnell eine Vorschau anzeigen und exportieren können. Projektreferenz: Kosinkadink/ComfyUI-VideoHelperSuite.

Optionale Extras#

  • Prompting funktioniert am besten, wenn Sie visuelle Richtung und Sounddesign trennen. Schreiben Sie zuerst die Szene und fügen Sie dann "Audio:" mit Instrumenten, Stil, Raumtyp und Intensität hinzu.
  • Beginnen Sie mit moderaten Größen, die Ihrem Bildverhältnis entsprechen. Vergrößern Sie, sobald Ihnen die Bewegung und das Timing gefallen.
  • Wenn die Synchronisation nicht stimmt, verschieben Sie den Video- oder Audiouhr-Shift anstelle der Änderung der Dauer. Kleine Anpassungen können die Leistung auf den Beat fixieren.
  • Für Charakteraufnahmen wählen Sie Bilder mit klarer Subjekttrennung und konsistenter Beleuchtung, um die Identität durch Bewegung zu bewahren.
  • Reseed, um Mikro-Variationen in Phrasierung und Timing zu erkunden, während Sie das gleiche Setup beibehalten.

Danksagungen#

Dieser Workflow implementiert und baut auf den folgenden Werken und Ressourcen auf. Wir danken RunningHub für die Source-Workflow-Vorlage, MiniMaxAI für MiniMax-H3-Modellgewichte und Larryvrh für MiniMax-H3 Turbo LoRA und das ComfyUI MiniMax H3 Turbo-Projekt für ihre Beiträge und Wartung. Für autoritative Details verweisen Sie bitte auf die Originaldokumentation und die unten verlinkten Repositories.

Ressourcen#

Hinweis: Die Nutzung der referenzierten Modelle, Datensätze und Codes unterliegt den jeweiligen Lizenzen und Bedingungen, die von ihren Autoren und Wartungen bereitgestellt werden.

RunComfy
Urheberrecht 2026 RunComfy. Alle Rechte vorbehalten.

RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.