ComfyUI>Рабочие процессы>MiniMax H3 ComfyUI Image to Video 4-шаговый Turbo

MiniMax H3 ComfyUI Image to Video 4-шаговый Turbo

Workflow Name: RunComfy/MiniMax-H3-Turbo
Workflow ID: 0000...1484
Превратите одно изображение в короткое видео Hailuo H3. Вы направляете движение и диалог с помощью подсказки. Родное стерео аудио создается вместе с визуализацией. 4-шаговый Turbo LoRA ускоряет черновики. Вы можете анимировать персонажей, продукты или природу. Запустите и уточняйте всё на RunComfy.

MiniMax H3 ComfyUI Image to Video 4-step Turbo Workflow

MiniMax H3 ComfyUI I2V | 4-Step Turbo Stereo Audio
Want to run this workflow?
  • Fully operational workflows
  • No missing nodes or models
  • No manual setups required
  • Features stunning visuals

MiniMax H3 ComfyUI Image to Video 4-step Turbo Examples

MiniMax H3 ComfyUI Image to Video 4-шаговый Turbo#

MiniMax H3 ComfyUI Image to Video 4-шаговый Turbo — это готовый к RunComfy процесс, который превращает одно изображение в короткое видео с родным стерео аудио, непосредственно в ComfyUI. Он запускает конвейер MiniMax H3 (Hailuo) image-to-video и применяет Turbo LoRA, чтобы вы могли просмотреть движение и диалог за гораздо меньшее количество шагов, чем в стандартном расписании.

Этот график создан для создателей, которые хотят быстрые черновики I2V, не покидая холст ComfyUI: говорящие персонажи, быстрые повороты продукта или атмосферные сцены с синхронизированным звуком. Предоставьте один начальный кадр и подсказку движения/диалога; процесс генерирует видео кадры и стерео аудио вместе, затем объединяет их в готовый клип, который вы можете скачать.

Ключевые модели в Comfyui MiniMax H3 ComfyUI Image to Video 4-шаговый Turbo процессе#

  • MiniMaxAI/MiniMax-H3 мультимодальная видео модель. Официальная H3 модель производит видео с синхронизированным стерео аудио и поддерживает I2V с первого кадра; этот процесс использует Comfy-Org репак для ComfyUI. MiniMaxAI/MiniMax-H3 и Comfy-Org/MiniMax-H3
  • MiniMax H3 Video VAE. Кодирует/декодирует латенты видео, используемые диффузионной основой H3. Включен в Comfy-Org репак. Comfy-Org/MiniMax-H3
  • MiniMax H3 Audio VAE. Декодирует аудио латенты модели в родные стерео волны, синхронизированные с кадрами. Включен в Comfy-Org репак. Comfy-Org/MiniMax-H3
  • Qwen3‑VL 32B текстовый энкодер (вариант MiniMax H3). Парсит вашу подсказку движения и диалога в кондиционирование для H3. Поставляется с выпуском Comfy-Org под text_encoders. Comfy-Org/MiniMax-H3
  • MiniMax‑H3 Turbo LoRA (4‑шаговый). LoRA, который ускоряет выбор H3, так что резкие предпросмотры возможны при очень малом количестве шагов. larryvrh/MiniMax-H3-Turbo-Lora и концептуальная статья LoRA LoRA: Low‑Rank Adaptation

Как использовать Comfyui MiniMax H3 ComfyUI Image to Video 4-шаговый Turbo процесс#

Общий поток. График масштабирует загруженное изображение, преобразует вашу длительность в допустимое количество кадров H3, затем подает начальный кадр и подсказку в H3 с применением Turbo LoRA. Семплер производит совместные видео и аудио латенты, которые декодируются и объединяются в загружаемый клип.

Загрузите изображение. Используйте LoadImage (#114), чтобы предоставить первый кадр, который вы хотите анимировать. Изображение автоматически масштабируется LayerUtility: ImageScaleByAspectRatio V2 (#167) до целевой длинной стороны с сохранением пропорций; полученные width/height подаются в главный H3 узел. Леттербоксинг используется при необходимости, чтобы избежать искажения. Это сохраняет вашу композицию в целости, соответствуя предпочтительной сетке H3.

Параметры и подсказка. Установите длину клипа, используя контроль Длительности (метка "Duration (sec)"), который подает в небольшой математический узел, ComfyMathExpression (#134), что преобразует секунды в кадры по скорости пленки и привязывает к допустимой сетке H3. Введите ваше движение и диалог в зеленом узле подсказки easy positive (#152); вы можете писать естественные предложения и цитируемую речь. Подсказка кодируется текстовым энкодером Qwen3‑VL через CLIPLoader (#130), подготавливая кондиционирование для модели.

Основное создание. UNETLoader (#129) загружает диффузионную основу MiniMax H3 и VAELoader (#121, #122) загружают видео и аудио VAE. Turbo LoRA объединяется во время выполнения LoraLoaderModelOnly (#171), и патч для памяти‑эффективного внимания (MiniMaxH3MemoryEfficientSageAttentionPatch (#170)) помогает снизить VRAM. Основной узел, MiniMaxH3ImageToVideo (#133), получает ваш начальный кадр, подсказку и вычисленную ширину/высоту/длину, затем производит синхронизированные видео и аудио латенты.

Сэмплирование и декодирование. Компактный стек сэмплеров (KSamplerSelect (#125), BasicScheduler (#126), BasicGuider (#128), SamplerCustomAdvanced (#127), RandomNoise (#131)) выполняет денойзинг за очень малое количество итераций благодаря Turbo LoRA. VAEDecode (#124) превращает латенты видео в кадры, а VAEDecodeAudio (#123) производит стерео аудио, синхронизированное с этими кадрами. Вам не нужно изменять настройки декодирования; они настроены для чистых предпросмотров.

Вывод. CreateVideo (#132) объединяет кадры и аудио в один клип на рабочей частоте кадров, а SaveVideo (#92) записывает его с настроенным префиксом имени файла, чтобы вы могли сразу скачать его с RunComfy. Результат — короткое, синхронизированное видео, отражающее ваш начальный кадр, подсказку движения и диалога.

Ключевые узлы в Comfyui MiniMax H3 ComfyUI Image to Video 4-шаговый Turbo процессе#

MiniMaxH3ImageToVideo (#133). Сердце графика: он потребляет начальный кадр, закодированную подсказку и вашу целевую размер/длину и производит совместные видео и аудио латенты. Настройте только несколько входов, доступных вам в этом процессе: предоставьте сильную, описательную подсказку (включая цитируемый диалог) и установите реалистичную длительность; узел обрабатывает остальное, используя модель H3 и VAE из Comfy-Org репака. Comfy-Org/MiniMax-H3

LoraLoaderModelOnly (#171). Внедряет MiniMax‑H3 Turbo LoRA, чтобы сэмплер мог достичь высокой резкости за очень малое количество шагов. Если вам нужно обменять артефакты на скорость, немного уменьшите силу LoRA; если вы видите размытие движения, немного увеличьте его. LoRA разработан для работы с общими вариантами базы H3, включая обрезанные и квантизированные репаки. larryvrh/MiniMax-H3-Turbo-Lora

BasicScheduler (#126) и SamplerCustomAdvanced (#127). Вместе они контролируют расписание денойзинга и поведение шагов. С Turbo LoRA вы можете работать при очень малом количестве шагов для быстрых предпросмотров; увеличение шагов немного улучшит стабильность, если вы можете позволить себе время. Держите выбор расписания и сэмплера традиционным, если у вас нет конкретного вида на уме.

LayerUtility: ImageScaleByAspectRatio V2 (#167). Обеспечивает, чтобы загруженное изображение было изменено на чистое разрешение, удобное для модели, при сохранении пропорций. Используйте это при переключении исходных изображений, чтобы избежать неожиданных обрезок или искажений; узел выводит точную width/height, которую потребляет основной H3 узел. ComfyUI_LayerStyle

ComfyMathExpression (#134). Преобразует секунды в кадры и привязывает количество к допустимой сетке кадров H3, так что аудио остается синфазным с видео. Вы можете думать об этом как о "защитнике", который избегает количества кадров, которые H3 не поддерживает, предотвращая тонкие десинхронизации на стадии объединения. Вход — это простая английская длительность, которую вы устанавливаете в верхней части холста.

MiniMaxH3MemoryEfficientSageAttentionPatch (#170). Применяет экспериментальную оптимизацию внимания, которая снижает пиковый VRAM во время сэмплирования на H3. Включите его при работе с большими размерами или на GPU с ограниченной памятью; он сохраняет творческий замысел, улучшая посадку. ComfyUI‑KJNodes

Дополнительные возможности#

  • Подсказка для синхронизации губ: напишите фактическую фразу в кавычках (например, "Ужин готов — попробуйте эту карбонару.") и опишите атмосферу и движение камеры на простом языке.
  • Сначала композиция: выберите начальный кадр, который уже кадрирует ваш объект на нужном расстоянии; анимация будет уважать эту композицию.
  • Скорость против полировки: настройка MiniMax H3 ComfyUI Image to Video 4-шаговый Turbo настроена для быстрых предпросмотров; если кадр важен, добавьте еще несколько шагов или слегка уменьшите силу LoRA, чтобы укротить чрезмерно резкое зерно.
  • Запас по времени: если вы достигли пределов VRAM, попробуйте уменьшить максимальную длину стороны изображения, сократить длительность или включить патч для памяти‑эффективного внимания.
  • Исследуйте базы: процесс совместим с вариантами репака Comfy‑Org H3 (bf16, int8 convrot, обрезанный). Если вы измените базу, оставьте Turbo LoRA подключенным между загрузчиком модели и сэмплером для того же ускоряющего эффекта. Comfy-Org/MiniMax-H3

Признания#

Этот процесс реализует и основывается на следующих работах и ресурсах. Мы с благодарностью признаем MiniMax за модель MiniMax H3, Comfy.org за учебник по процессу MiniMax H3 ComfyUI, Comfy-Org за веса модели MiniMax-H3 и larryvrh за MiniMax-H3 Turbo LoRA за их вклад и поддержку. Для авторитетных деталей, пожалуйста, обратитесь к оригинальной документации и репозиториям, приведенным ниже.

Ресурсы#

Примечание: Использование упомянутых моделей, наборов данных и кода подлежит соответствующим лицензиям и условиям, предоставленным их авторами и поддерживающими.

Want More ComfyUI Workflows?

RunComfy
Авторское право 2026 RunComfy. Все права защищены.

RunComfy - ведущая ComfyUI платформа, предлагающая ComfyUI онлайн среду и услуги, а также рабочие процессы ComfyUI с потрясающей визуализацией. RunComfy также предоставляет AI Models, позволяя художникам использовать новейшие инструменты AI для создания невероятного искусства.