MiniMax H3 Замена Персонажей ComfyUI#
MiniMax H3 Замена Персонажей ComfyUI — это процесс видеомонтажа с использованием референсов для замены человека или персонажа в исходном клипе, сохраняя оригинальное движение, тайминг камеры и план сцены нетронутыми. Он сочетает обнаружение и маскирование объектов SAM3 с MiniMax H3 Ref2VA, чтобы замещающая личность оставалась последовательной на протяжении всех кадров без ручной доработки.
Создан для создателей, которым необходима надежная замена персонажей, замена личностей, вариации нарядов или редактирование на основе референсов внутри ComfyUI, этот рабочий процесс принимает исходное видео, одно или несколько референсных изображений и необязательное референсное аудио. Результат — замена, сохраняющая движение, которая кажется естественной для кадра, полностью поддерживаемая логикой MiniMax H3 Замена Персонажей ComfyUI.
Ключевые модели в процессе Comfyui MiniMax H3 Замена Персонажей ComfyUI#
- MiniMax H3 Ref2VA диффузионная основа. Обеспечивает генерацию референс‑аудио‑видео, которая передает личность и внешний вид, уважая движение и тайминг. См. официальную карточку модели для возможностей и руководства по подсказкам здесь и готовые веса и VAE для рабочих процессов здесь.
- MiniMax H3 Видео VAE и Аудио VAE. Кодируют и декодируют латенты видео и аудио для эффективной выборки и точной реконструкции. Включены в пакет Comfy‑Org MiniMax H3 выше.
- Qwen3‑VL 32B текстовый энкодер. Служит мультимодальным текстовым энкодером, используемым MiniMax H3 для интерпретации подсказок и референсов для последовательной передачи личности.
- SAM 3.1 Мультиплекс. Высококачественная модель сегментации, используемая для обнаружения и маскирования объекта на экране, чтобы рабочий процесс мог изолировать сигналы движения и подготовить более чистый референс для замены персонажей. Контрольная точка размещена Comfy‑Org здесь.
Как использовать рабочий процесс Comfyui MiniMax H3 Замена Персонажей ComfyUI#
Рабочий процесс переходит от маскирования и подготовки референсов к H3 кондиционированию, выборке и финальному рендерингу. Группы выполняются последовательно, чтобы создать замену, сохраняющую движение, которая заменяет только исполнителя.
Маскирование#
Эта группа загружает ваш исходный клип, при необходимости обрезает его и подготавливает маски для каждого кадра. LoadVideo (#459) подает в Video Slice (#483), чтобы вы могли установить время начала и длительность. Кадры и аудио распаковываются с помощью GetVideoComponents (#460, #505). SAM3_Detect (#503) использует короткий текст категории из CLIPTextEncode (#502), например "person", чтобы найти объект и вывести маски. Маска предварительно просматривается через MaskToImage (#491), затем ImageCompositeMasked (#454) и ImageScaleToTotalPixels (#456) подготавливают легкий референс движения, выделяющий исполнителя для MiniMax H3.
Модели#
Эта группа загружает основные активы MiniMax H3, используемые при выводе. UNETLoader (#463) инициализирует веса диффузии H3 Ref2VA, CLIPLoader (#465) настраивает текстовый энкодер Qwen3‑VL, а VAELoader (#470, #474) загружает видео и аудио VAE. Вместе они определяют контекст модели, который будет использовать семплер для передачи личности и декодирования.
Кондиционирование#
Эта группа превращает ваши референсы и подсказку в кондиционирование H3 и начальный латент. MiniMaxH3ReferenceToVideo (#464) принимает изображение замещающей личности, подготовленный референс движения из группы Маскирование и необязательное референсное аудио из источника. Ширина и высота берутся из ResolutionSelector (#501); длина в кадрах автоматически вычисляется ComfyMathExpression (#481) из удобной для человека длительности, установленной с помощью Float (Duration) (#480), привязываясь к количеству кадров, удобному для модели. Структурированная подсказка генерируется DapaoH3VideoPromptNode (#517) и передается через easy showAnything (#515), или вы можете написать свою собственную в соответствии с официальным руководством по видео на основе референсов MiniMax H3 здесь.
Семплирование#
Эта группа выполняет удаление шума с вашим выбранным семплером и расписанием. RandomNoise (#467) задает процесс для воспроизводимости. BasicScheduler (#473) и KSamplerSelect (#468) определяют расписание шагов и алгоритм, в то время как BasicGuider (#466) объединяет модель с положительным кондиционированием из узла H3. SamplerCustomAdvanced (#469) выполняет итерационное улучшение для получения финальных латентов видео.
Декодирование и создание видео#
Эта группа превращает латенты в воспроизводимый результат. VAEDecode (#472) реконструирует кадры, которые объединяются с аудио вашего клипа в CreateVideo (#476) для сохранения тайминга и атмосферы. SaveVideo (#482) записывает выходной файл с выбранным форматом и кодеком, чтобы ваш рендер MiniMax H3 Замена Персонажей ComfyUI был готов для просмотра или публикации.
Протестировано с этими настройками#
Эта вспомогательная зона содержит примечания к подсказкам и пример метаданных, использованных во время написания. Она не обязательна для работы, но может вдохновить на создание собственной структуры подсказок и выбор тайминга.
Ключевые узлы в процессе Comfyui MiniMax H3 Замена Персонажей ComfyUI#
MiniMaxH3ReferenceToVideo (#464)#
Центральный для передачи личности. Он принимает изображение замены, видеореференс, сохраняющий движение, и необязательное референсное аудио, затем выдает как положительное кондиционирование, так и начальный латент. Полезные параметры для рассмотрения: prompt, width, height, и length. Если вы предоставляете несколько референсов, сохраняйте их визуально последовательными, чтобы избежать дрейфа личности.
SAM3_Detect (#503)#
Находит и сегментирует объект на экране, который будет заменен. Короткая категория подсказки через CLIPTextEncode (#502) направляет обнаружение. Настраивайте параметры качества маски, только если выбор по умолчанию пропускает объект или включает фон; более чистые маски обычно обеспечивают более стабильные замены.
ImageCompositeMasked (#454)#
Создает референс, ориентированный на исполнителя, из нарезанных кадров и маски SAM3. Используйте x, y, и resize_source, только если вам нужно выровнять наложения или адаптировать масштабирование кадров перед отправкой изображений на вход референса H3. Цель — сигналы движения, которые изолируют актера, оставляя геометрию сцены нетронутой.
ResolutionSelector (#501)#
Контролирует целевой размер рендеринга несколькими кликами. Выберите соотношение сторон и бюджет мегапикселей, которые соответствуют вашему оборудованию или потребностям в сроках. Начните скромно, подтвердите стабильность личности, затем увеличьте разрешение для финального прохода.
SamplerCustomAdvanced (#469)#
Выполняет удаление шума с использованием планировщика, семплера, гайдера, шума и начального латента. Для быстрого предварительного просмотра попробуйте более легкое расписание или семплер, настроенный на скорость, затем переключитесь на предпочитаемые качественные настройки, когда личность и тайминг будут выглядеть правильно.
Дополнительные опции#
- Выбор референсов
- Используйте 1-3 четких, хорошо освещенных изображения, которые ясно показывают лицо и наряд цели. Избегайте смешанных личностей или экстремальных поз.
- Поддерживайте возраст, прическу и одежду референсного объекта последовательными, чтобы минимизировать дрейф во время длинных движений.
- Советы по маскированию
- Если SAM3 включает фон, уточните текст категории или повторите с другим порогом. Чистые маски уменьшают ореолы и сохраняют стабильное освещение сцены.
- Подсказки
- Описывайте только личность и гардероб в замене, в то время как сообщайте H3 сохранить оригинальное движение и сцену. Официальное руководство имеет краткие примеры здесь.
- Шаблоны
- Если вам нужна минимальная отправная точка, сравните свою графику с официальным шаблоном ComfyUI MiniMax H3 R2V здесь.
- Права и безопасность
- Используйте только образы, исполнение и аудио, которые вы имеете право трансформировать. MiniMax H3 Замена Персонажей ComfyUI мощна, поэтому применяйте ее ответственно.
Благодарности#
Этот рабочий процесс реализует и основывается на следующих работах и ресурсах. Мы с благодарностью признаем MiniMaxAI за модель MiniMax-H3 и руководство по видео на основе референсов, Comfy-Org за официальный шаблон ComfyUI MiniMax H3 R2V, и RunningHub.ai за источник рабочего процесса и референс за их вклад и поддержку. Для авторитетных деталей, пожалуйста, обратитесь к оригинальной документации и репозиториям, указанным ниже.
Ресурсы#
- RunningHub.ai/Источник рабочего процесса и референс
- Документация / Примечания к выпуску: Источник рабочего процесса и референс
- MiniMaxAI/MiniMax H3 официальная модель
- GitHub: MiniMax-AI/MiniMax-H3
- Hugging Face: MiniMaxAI/MiniMax-H3
- MiniMaxAI/MiniMax H3 руководство по видео на основе референсов
- GitHub: MiniMax-AI/MiniMax-H3
- Hugging Face: MiniMaxAI/MiniMax-H3
- Документация / Примечания к выпуску: MiniMax H3 руководство по видео на основе референсов
- Comfy-Org/Официальный шаблон ComfyUI MiniMax H3 R2V
- GitHub: Comfy-Org/workflow_templates (video_minimax_h3_r2v.json)
- Hugging Face: Comfy-Org/MiniMax-H3
Примечание: Использование указанных моделей, наборов данных и кода подчиняется соответствующим лицензиям и условиям, предоставленным их авторами и поддерживающими.

