MiniMax H3 Reemplazo de Personajes ComfyUI#
MiniMax H3 Reemplazo de Personajes ComfyUI es un flujo de trabajo de edición de video guiado por referencia para intercambiar una persona o personaje en un clip fuente mientras se mantiene intacto el movimiento original, el tiempo de la cámara y el diseño de la escena. Combina la detección y enmascaramiento de sujetos SAM3 con MiniMax H3 Ref2VA para que la identidad de reemplazo se mantenga consistente a través de los fotogramas sin repintado manual.
Diseñado para creadores que necesitan intercambios de personajes confiables, reemplazos de identidad, variaciones de vestuario o ediciones guiadas por referencia dentro de ComfyUI, este flujo de trabajo acepta un video fuente, una o más imágenes de referencia y audio de referencia opcional. El resultado es un reemplazo que preserva el movimiento y que se siente nativo a la toma, impulsado por la lógica de MiniMax H3 Reemplazo de Personajes ComfyUI de principio a fin.
Modelos clave en el flujo de trabajo de Comfyui MiniMax H3 Reemplazo de Personajes ComfyUI#
- MiniMax H3 Ref2VA columna vertebral de difusión. Proporciona generación de referencia a audio-video que transfiere identidad y apariencia mientras respeta el movimiento y el tiempo. Vea la tarjeta del modelo oficial para capacidades y orientación de solicitud aquí y los pesos listos para Comfy y los VAEs empaquetados para flujos de trabajo aquí.
- MiniMax H3 Video VAE y Audio VAE. Codifica y decodifica latentes de video y audio para un muestreo eficiente y una reconstrucción fiel. Incluido con el paquete MiniMax H3 de Comfy-Org arriba.
- Qwen3-VL 32B codificador de texto. Sirve como el codificador de texto multimodal utilizado por MiniMax H3 para interpretar solicitudes y referencias para una transferencia coherente de identidad.
- SAM 3.1 Multiplex. Un modelo de segmentación de alta calidad utilizado para detectar y enmascarar el sujeto en pantalla para que el flujo de trabajo pueda aislar señales de movimiento y preparar una referencia más limpia para el reemplazo de personajes. Punto de control alojado por Comfy-Org aquí.
Cómo usar el flujo de trabajo de Comfyui MiniMax H3 Reemplazo de Personajes ComfyUI#
El flujo de trabajo se mueve desde la preparación de enmascaramiento y referencia hasta el acondicionamiento, muestreo y renderizado final de H3. Los grupos se ejecutan en secuencia para producir un intercambio que preserva el movimiento y que reemplaza solo al intérprete.
Enmascaramiento#
Este grupo carga tu clip fuente, opcionalmente lo recorta y prepara máscaras por fotograma. LoadVideo (#459) alimenta Video Slice (#483) para que puedas establecer el tiempo de inicio y la duración. Los fotogramas y el audio se desempaquetan con GetVideoComponents (#460, #505). SAM3_Detect (#503) usa un texto de categoría corto de CLIPTextEncode (#502), como "persona", para encontrar el sujeto y generar máscaras. La máscara se previsualiza a través de MaskToImage (#491), luego ImageCompositeMasked (#454) y ImageScaleToTotalPixels (#456) preparan una referencia de movimiento ligera que destaca al intérprete para MiniMax H3.
Modelos#
Este grupo carga los activos principales de MiniMax H3 utilizados en la inferencia. UNETLoader (#463) inicializa los pesos de difusión de H3 Ref2VA, CLIPLoader (#465) configura el codificador de texto Qwen3-VL, y VAELoader (#470, #474) trae los VAEs de video y audio. Juntos definen el contexto del modelo que el muestreador usará para la transferencia de identidad y decodificación.
Acondicionamiento#
Este grupo convierte tus referencias y solicitud en el acondicionamiento de H3 y un latente inicial. MiniMaxH3ReferenceToVideo (#464) acepta una imagen de identidad de reemplazo, la referencia de movimiento preparada del grupo de Enmascaramiento, y audio de referencia opcional de la fuente. El ancho y la altura provienen de ResolutionSelector (#501); la longitud en fotogramas se calcula automáticamente por ComfyMathExpression (#481) a partir de una duración amigable para humanos establecida con Float (Duration) (#480), ajustándose a un recuento de fotogramas amigable para el modelo. Una solicitud estructurada es generada por DapaoH3VideoPromptNode (#517) y pasada a través de easy showAnything (#515), o puedes escribir la tuya propia según la guía oficial de referencia de video MiniMax H3 aquí.
Muestreo#
Este grupo realiza desruido con el muestreador y el cronograma seleccionados. RandomNoise (#467) inicia el proceso para la reproducibilidad. BasicScheduler (#473) y KSamplerSelect (#468) definen el cronograma de pasos y el algoritmo, mientras que BasicGuider (#466) fusiona el modelo con el acondicionamiento positivo del nodo H3. SamplerCustomAdvanced (#469) ejecuta el refinamiento iterativo para producir los latentes de video finales.
Decodificación y creación de video#
Este grupo convierte latentes en un resultado reproducible. VAEDecode (#472) reconstruye los fotogramas, que se combinan con el audio de tu clip en CreateVideo (#476) para preservar el tiempo y el ambiente. SaveVideo (#482) escribe un archivo de salida con el formato y códec elegidos para que tu renderizado de MiniMax H3 Reemplazo de Personajes ComfyUI esté listo para revisar o publicar.
Probado con estas configuraciones#
Esta área de ayuda contiene notas de solicitud y metadatos de ejemplo utilizados durante la autoría. No es necesario para la operación pero puede inspirar tu propia estructura de solicitud y elecciones de tiempo.
Nodos clave en el flujo de trabajo de Comfyui MiniMax H3 Reemplazo de Personajes ComfyUI#
MiniMaxH3ReferenceToVideo (#464)#
Central para la transferencia de identidad. Acepta una imagen de reemplazo, una referencia de video que preserva el movimiento, y audio de referencia opcional, luego emite tanto el acondicionamiento positivo como un latente inicial. Los parámetros útiles a considerar son prompt, width, height, y length. Si proporcionas múltiples referencias, mantenlas visualmente consistentes para evitar el desvío de identidad.
SAM3_Detect (#503)#
Encuentra y segmenta el sujeto en pantalla que será reemplazado. Una solicitud de categoría corta a través de CLIPTextEncode (#502) guía la detección. Ajusta las opciones de calidad de máscara solo cuando la selección predeterminada no capture al sujeto o incluya el fondo; las máscaras más limpias suelen producir intercambios más estables.
ImageCompositeMasked (#454)#
Construye una referencia centrada en el intérprete a partir de los fotogramas cortados y la máscara SAM3. Usa x, y, y resize_source solo si necesitas alinear superposiciones o adaptar la escala de fotogramas antes de enviar imágenes a la entrada de referencia de H3. El objetivo es una señal de movimiento que aísle al actor mientras deja la geometría de la escena intacta.
ResolutionSelector (#501)#
Controla el tamaño de renderizado objetivo en unos pocos clics. Elige un aspecto y un presupuesto de megapíxeles que se adapten a tu hardware o necesidades de entrega. Comienza modesto, confirma la estabilidad de identidad, luego aumenta la resolución para tu pase final.
SamplerCustomAdvanced (#469)#
Ejecuta el desruido utilizando el programador, el muestreador, el guía, el ruido, y el latente inicial. Para un desarrollo visual más rápido, prueba un cronograma más ligero o un muestreador ajustado para velocidad, luego cambia a tus configuraciones de calidad preferidas una vez que la identidad y el tiempo se vean correctos.
Extras opcionales#
- Selección de referencia
- Usa de 1 a 3 imágenes nítidas y bien iluminadas que muestren claramente el rostro y vestuario del objetivo. Evita identidades mixtas o poses extremas.
- Mantén la edad, peinado y vestimenta del sujeto de referencia consistentes para minimizar el desvío durante movimientos largos.
- Consejos de enmascaramiento
- Si SAM3 incluye fondo, refina tu texto de categoría o vuelve a ejecutar con un umbral diferente. Las máscaras limpias reducen el efecto halo y mantienen la iluminación de la escena estable.
- Solicitud
- Describe solo la identidad y el vestuario en el reemplazo mientras le dices a H3 que preserve el movimiento original y la escena. La guía oficial tiene ejemplos concisos aquí.
- Plantillas
- Si deseas un punto de partida mínimo, compara tu gráfico con la plantilla oficial de ComfyUI MiniMax H3 R2V aquí.
- Derechos y seguridad
- Solo usa semejanzas, interpretaciones y audio que tienes derecho a transformar. MiniMax H3 Reemplazo de Personajes ComfyUI es poderoso, así que aplícalo responsablemente.
Reconocimientos#
Este flujo de trabajo implementa y se basa en los siguientes trabajos y recursos. Agradecemos a MiniMaxAI por el modelo MiniMax-H3 y la guía de solicitud de video de referencia, a Comfy-Org por la plantilla oficial de ComfyUI MiniMax H3 R2V, y a RunningHub.ai por la fuente del flujo de trabajo y referencia por sus contribuciones y mantenimiento. Para detalles autorizados, consulte la documentación y repositorios originales enlazados a continuación.
Recursos#
- RunningHub.ai/Fuente del flujo de trabajo y referencia
- Documentos / Notas de lanzamiento: Fuente del flujo de trabajo y referencia
- MiniMaxAI/Modelo oficial de MiniMax H3
- GitHub: MiniMax-AI/MiniMax-H3
- Hugging Face: MiniMaxAI/MiniMax-H3
- MiniMaxAI/Guía de solicitud de video de referencia de MiniMax H3
- GitHub: MiniMax-AI/MiniMax-H3
- Hugging Face: MiniMaxAI/MiniMax-H3
- Documentos / Notas de lanzamiento: Guía de solicitud de video de referencia de MiniMax H3
- Comfy-Org/Plantilla oficial de ComfyUI MiniMax H3 R2V
- GitHub: Comfy-Org/workflow_templates (video_minimax_h3_r2v.json)
- Hugging Face: Comfy-Org/MiniMax-H3
Nota: El uso de los modelos, conjuntos de datos y código referenciados está sujeto a las respectivas licencias y términos proporcionados por sus autores y mantenedores.

