ComfyUI>Workflows>MiniMax H3 ComfyUI Image to Video 4-Schritt Turbo

MiniMax H3 ComfyUI Image to Video 4-Schritt Turbo

Workflow Name: RunComfy/MiniMax-H3-Turbo
Workflow ID: 0000...1484
Verwandeln Sie ein Standbild in ein kurzes Hailuo H3-Video. Sie steuern Bewegung und Dialog mit einem Prompt. Natives Stereo-Audio wird mit den visuellen Elementen erzeugt. Ein 4-Schritt-Turbo-LoRA beschleunigt Entwürfe. Sie können Charaktere, Produkte oder die Natur animieren. Alles kann auf RunComfy ausgeführt und verfeinert werden.

MiniMax H3 ComfyUI Image to Video 4-step Turbo Workflow

MiniMax H3 ComfyUI I2V | 4-Step Turbo Stereo Audio
Want to run this workflow?
  • Fully operational workflows
  • No missing nodes or models
  • No manual setups required
  • Features stunning visuals

MiniMax H3 ComfyUI Image to Video 4-step Turbo Examples

MiniMax H3 ComfyUI Image to Video 4-Schritt Turbo#

MiniMax H3 ComfyUI Image to Video 4-Schritt Turbo ist ein RunComfy-fähiger Workflow, der ein einzelnes Standbild in ein kurzes Video mit nativem Stereo-Audio direkt in ComfyUI umwandelt. Er führt die MiniMax H3 (Hailuo) Image-to-Video-Pipeline aus und wendet einen Turbo LoRA an, sodass Sie Bewegung und Dialog mit weit weniger Abtastschritten als im Standardzeitplan vorschauen können.

Dieses Diagramm ist für Kreative gebaut, die schnelle I2V-Entwürfe ohne Verlassen der ComfyUI-Leinwand wünschen: sprechende Charaktere, schnelle Produktdrehungen oder Ambient-Szenen mit synchronisiertem Sound. Geben Sie ein Startbild und einen Bewegungs-/Dialog-Prompt ein; der Workflow erzeugt Videoframes und Stereo-Audio zusammen und fügt sie dann zu einem fertigen Clip zusammen, den Sie herunterladen können.

Schlüsselmodelle im Comfyui MiniMax H3 ComfyUI Image to Video 4-Schritt Turbo-Workflow#

  • MiniMaxAI/MiniMax-H3 multimodales Videomodell. Das offizielle H3-Modell erzeugt Video mit synchronisiertem Stereo-Audio und unterstützt das erste Frame I2V; dieser Workflow verwendet das Comfy-Org-Repack für ComfyUI. MiniMaxAI/MiniMax-H3 und Comfy-Org/MiniMax-H3
  • MiniMax H3 Video VAE. Kodiert/dekodiert Videolatents, die vom Diffusions-Backbone von H3 verwendet werden. Im Comfy-Org-Repack enthalten. Comfy-Org/MiniMax-H3
  • MiniMax H3 Audio VAE. Dekodiert die Audiolatents des Modells zu nativen Stereo-Waveforms, die an die Frames ausgerichtet sind. Im Comfy-Org-Repack enthalten. Comfy-Org/MiniMax-H3
  • Qwen3‑VL 32B Text-Encoder (MiniMax H3-Variante). Analysiert Ihren Bewegungs- und Dialog-Prompt zu einer Konditionierung für H3. Verpackt mit der Comfy-Org-Veröffentlichung unter text_encoders. Comfy-Org/MiniMax-H3
  • MiniMax‑H3 Turbo LoRA (4‑Schritt). Ein LoRA, das die H3-Abtastung beschleunigt, sodass scharfe Vorschauen mit sehr niedrigen Schrittzahlen möglich sind. larryvrh/MiniMax-H3-Turbo-Lora und das LoRA Konzeptpapier LoRA: Low‑Rank Adaptation

Verwendung des Comfyui MiniMax H3 ComfyUI Image to Video 4-Schritt Turbo-Workflows#

Gesamtfluss. Das Diagramm skaliert Ihr hochgeladenes Bild, wandelt Ihre Dauer in eine gültige H3-Frame-Anzahl um und speist dann das Start-Frame und den Prompt in H3 mit dem angewendeten Turbo LoRA ein. Der Sampler erzeugt gemeinsame Video- und Audiolatents, die dekodiert und in einen herunterladbaren Clip gemischt werden.

Bild hochladen. Verwenden Sie LoadImage (#114), um das erste Bild bereitzustellen, das Sie animieren möchten. Das Bild wird automatisch von LayerUtility: ImageScaleByAspectRatio V2 (#167) auf eine Ziel-Langseite skaliert, während das Seitenverhältnis erhalten bleibt; die abgeleitete width/height füttern den Kern-H3-Knoten. Letterboxing wird verwendet, wenn nötig, um Verzerrungen zu vermeiden. Dies hält Ihre Komposition intakt, während es dem bevorzugten Raster von H3 entspricht.

Parameter und Prompt. Stellen Sie die Clip-Länge mit der Dauersteuerung (Label "Duration (sec)") ein, die einen kleinen Mathematikknoten, ComfyMathExpression (#134), speist, der Sekunden in Frames bei Filmrate umwandelt und am gültigen Raster von H3 einrastet. Geben Sie Ihre Bewegung und Ihren Dialog im grünen easy positive-Prompt-Knoten (#152) ein; Sie können natürliche Sätze und zitierte Reden schreiben. Der Prompt wird vom Qwen3‑VL-Text-Encoder über CLIPLoader (#130) kodiert, um die Konditionierung für das Modell vorzubereiten.

Kern-Generierung. UNETLoader (#129) lädt das MiniMax H3-Diffusions-Backbone und VAELoader (#121, #122) laden die Video- und Audio-VAEs. Der Turbo LoRA wird zur Laufzeit von LoraLoaderModelOnly (#171) zusammengeführt und ein speichereffizienter Aufmerksamkeits-Patch (MiniMaxH3MemoryEfficientSageAttentionPatch (#170)) hilft, VRAM zu reduzieren. Der Hauptknoten, MiniMaxH3ImageToVideo (#133), erhält Ihr Start-Frame, den Prompt und die berechnete Breite/Höhe/Länge und erzeugt synchronisierte Video- und Audiolatents.

Abtastung und Dekodierung. Ein kompakter Abtaststapel (KSamplerSelect (#125), BasicScheduler (#126), BasicGuider (#128), SamplerCustomAdvanced (#127), RandomNoise (#131)) führt Entstörung über sehr wenige Iterationen durch, dank des Turbo LoRA. VAEDecode (#124) wandelt Videolatents in Frames um, und VAEDecodeAudio (#123) erzeugt Stereo-Audio, das an diese Frames ausgerichtet ist. Sie müssen die Dekodierungseinstellungen nicht anpassen; sie sind für saubere Vorschauen verdrahtet.

Ausgabe. CreateVideo (#132) mischt die Frames und das Audio in einen einzelnen Clip bei der Arbeitsframerate, und SaveVideo (#92) schreibt es mit dem konfigurierten Dateinamenpräfix, sodass Sie es sofort von RunComfy herunterladen können. Das Ergebnis ist ein kurzes, synchronisiertes Video, das Ihr Start-Frame, Ihren Bewegungs-Prompt und Ihren Dialog widerspiegelt.

Schlüsselnoten im Comfyui MiniMax H3 ComfyUI Image to Video 4-Schritt Turbo-Workflow#

MiniMaxH3ImageToVideo (#133). Das Herz des Diagramms: es konsumiert das Start-Frame, den kodierten Prompt und Ihre Zielgröße/-länge und erzeugt gemeinsame Video- und Audiolatents. Passen Sie nur die wenigen Eingaben an, die Ihnen in diesem Workflow zur Verfügung stehen: Geben Sie einen starken, beschreibenden Prompt an (einschließlich zitiertem Dialog) und stellen Sie eine realistische Dauer ein; der Knoten erledigt den Rest mit dem H3-Modell und VAEs aus dem Comfy-Org-Repack. Comfy-Org/MiniMax-H3

LoraLoaderModelOnly (#171). Integriert den MiniMax‑H3 Turbo LoRA, damit der Sampler in sehr wenigen Schritten hohe Schärfe erreichen kann. Wenn Sie Artefakte gegen Geschwindigkeit tauschen müssen, senken Sie die LoRA-Stärke leicht; wenn Sie Bewegungsschmier sehen, erhöhen Sie sie leicht. Der LoRA ist so konzipiert, dass er über die üblichen H3-Basismodelle hinweg funktioniert, einschließlich beschnittener und quantisierter Repacks. larryvrh/MiniMax-H3-Turbo-Lora

BasicScheduler (#126) und SamplerCustomAdvanced (#127). Gemeinsam steuern sie den Entstörungszeitplan und das Schrittverhalten. Mit dem Turbo LoRA an Ort und Stelle können Sie mit sehr niedrigen Schrittzahlen für schnelle Vorschauen arbeiten; die Erhöhung der Schritte wird die Stabilität geringfügig verbessern, wenn Sie die Zeit dafür haben. Halten Sie die Planer- und Abtasterauswahl konventionell, es sei denn, Sie haben einen bestimmten Look im Sinn.

LayerUtility: ImageScaleByAspectRatio V2 (#167). Stellt sicher, dass das hochgeladene Standbild auf eine saubere, modellfreundliche Auflösung skaliert wird, während das Seitenverhältnis erhalten bleibt. Verwenden Sie dies beim Wechseln von Ausgangsbildern, um unerwartete Zuschnitte oder Verzerrungen zu vermeiden; der Knoten gibt die genaue width/height aus, die der Kern-H3-Knoten verbraucht. ComfyUI_LayerStyle

ComfyMathExpression (#134). Wandelt Sekunden in Frames um und rastet die Anzahl am gültigen Frame-Raster von H3 ein, sodass Audio phasenverriegelt zum Video bleibt. Sie können es als eine "Sicherheitsvorkehrung" betrachten, die Frame-Anzahlen vermeidet, die H3 nicht unterstützt, und subtile Desynchronisationen in der Muxing-Phase verhindert. Der Eingang ist die plain-English-Dauer, die Sie oben auf der Leinwand festlegen.

MiniMaxH3MemoryEfficientSageAttentionPatch (#170). Wendet eine experimentelle Aufmerksamkeitsoptimierung an, die den Spitzen-VRAM während der Abtastung auf H3 senkt. Schalten Sie es ein, wenn Sie mit größeren Größen oder auf GPUs mit begrenztem Speicher arbeiten; es bewahrt die kreative Absicht, während es die Passform verbessert. ComfyUI‑KJNodes

Optionale Extras#

  • Prompting für Lippen-Synchronisation: Schreiben Sie den tatsächlichen Satz in Anführungszeichen (zum Beispiel, "Dinner’s up — try this carbonara."), und beschreiben Sie Ambiente und Kamerabewegung in einfacher Sprache.
  • Komposition zuerst: Wählen Sie ein Start-Frame, das Ihr Subjekt bereits in der beabsichtigten Entfernung einrahmt; die Animation wird diese Komposition respektieren.
  • Geschwindigkeit vs. Politur: Das MiniMax H3 ComfyUI Image to Video 4-Schritt Turbo-Setup ist auf schnelle Vorschauen abgestimmt; wenn ein Shot wichtig ist, fügen Sie ein paar Schritte hinzu oder reduzieren Sie die LoRA-Stärke leicht, um über-scharfes Korn zu zähmen.
  • Laufzeit-Spielraum: Wenn Sie VRAM-Grenzen erreichen, versuchen Sie, die maximale Bildseitenlänge zu verkleinern, die Dauer zu verkürzen oder den speichereffizienten Aufmerksamkeits-Patch zu aktivieren.
  • Grundlagen erkunden: Der Workflow ist kompatibel mit den Comfy‑Org H3 Repack-Varianten (bf16, int8 convrot, pruned). Wenn Sie die Basis ändern, halten Sie den Turbo LoRA zwischen dem Modell-Lader und dem Sampler verbunden, um denselben Beschleunigungseffekt zu erzielen. Comfy-Org/MiniMax-H3

Danksagungen#

Dieser Workflow implementiert und baut auf den folgenden Arbeiten und Ressourcen auf. Wir danken MiniMax für das MiniMax H3-Modell, Comfy.org für das MiniMax H3 ComfyUI-Workflow-Tutorial, Comfy-Org für die MiniMax-H3-Modellgewichte und larryvrh für das MiniMax-H3 Turbo LoRA für ihre Beiträge und Pflege. Für autoritative Details verweisen wir auf die Originaldokumentation und die unten verlinkten Repositories.

Ressourcen#

Hinweis: Die Nutzung der referenzierten Modelle, Datensätze und Codes unterliegt den jeweiligen Lizenzen und Bedingungen, die von ihren Autoren und Betreuern bereitgestellt werden.

RunComfy
Urheberrecht 2026 RunComfy. Alle Rechte vorbehalten.

RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.