MiniMax H3 Remplacement de Personnage ComfyUI#
MiniMax H3 Remplacement de Personnage ComfyUI est un workflow de montage vidéo guidé par référence pour échanger une personne ou un personnage dans un clip source tout en conservant le mouvement original, le timing de la caméra et la disposition de la scène. Il associe la détection et le masquage de sujet SAM3 avec MiniMax H3 Ref2VA pour que l'identité de remplacement reste cohérente à travers les images sans repeinture manuelle.
Conçu pour les créateurs qui ont besoin d'échanges de personnages fiables, de remplacements d'identité, de variations de tenue ou de montages guidés par référence à l'intérieur de ComfyUI, ce workflow accepte une vidéo source, une ou plusieurs images de référence, et éventuellement un audio de référence. Le résultat est un remplacement préservant le mouvement qui semble natif à la prise, alimenté par la logique MiniMax H3 Remplacement de Personnage ComfyUI de bout en bout.
Modèles clés dans le workflow Comfyui MiniMax H3 Remplacement de Personnage ComfyUI#
- MiniMax H3 Ref2VA diffusion backbone. Fournit la génération de référence-à-audio-vidéo qui transfère l'identité et l'apparence tout en respectant le mouvement et le timing. Voir la fiche du modèle officiel pour les capacités et les conseils de prompt ici et les poids et VAEs prêts pour Comfy emballés pour les workflows ici.
- MiniMax H3 Video VAE et Audio VAE. Encoder et décoder les latents vidéo et audio pour un échantillonnage efficace et une reconstruction fidèle. Inclus avec le bundle Comfy-Org MiniMax H3 ci-dessus.
- Qwen3-VL 32B encodeur de texte. Sert d'encodeur de texte multimodal utilisé par MiniMax H3 pour interpréter les prompts et les références pour un transfert d'identité cohérent.
- SAM 3.1 Multiplex. Un modèle de segmentation de haute qualité utilisé pour détecter et masquer le sujet à l'écran afin que le workflow puisse isoler les indices de mouvement et préparer une référence plus propre pour le remplacement de personnage. Point de contrôle hébergé par Comfy-Org ici.
Comment utiliser le workflow Comfyui MiniMax H3 Remplacement de Personnage ComfyUI#
Le workflow passe de la préparation de masquage et de référence à la conditionnement H3, à l'échantillonnage et au rendu final. Les groupes s'exécutent en séquence pour produire un échange préservant le mouvement qui ne remplace que le performer.
Masquage#
Ce groupe charge votre clip source, le coupe éventuellement, et prépare les masques par image. LoadVideo (#459) alimente Video Slice (#483) pour que vous puissiez définir l'heure de début et la durée. Les images et l'audio sont déballés avec GetVideoComponents (#460, #505). SAM3_Detect (#503) utilise un texte court de catégorie de CLIPTextEncode (#502), tel que "personne", pour trouver le sujet et produire des masques. Le masque est prévisualisé via MaskToImage (#491), puis ImageCompositeMasked (#454) et ImageScaleToTotalPixels (#456) préparent une référence de mouvement légère qui met en évidence le performer pour MiniMax H3.
Modèles#
Ce groupe charge les actifs MiniMax H3 de base utilisés à l'inférence. UNETLoader (#463) initialise les poids de diffusion H3 Ref2VA, CLIPLoader (#465) configure l'encodeur de texte Qwen3-VL, et VAELoader (#470, #474) intègrent les VAEs vidéo et audio. Ensemble, ils définissent le contexte du modèle que l'échantillonneur utilisera pour le transfert d'identité et le décodage.
Conditionnement#
Ce groupe transforme vos références et prompt en conditionnement H3 et un latent de départ. MiniMaxH3ReferenceToVideo (#464) accepte une image d'identité de remplacement, la référence de mouvement préparée du groupe Masquage, et éventuellement un audio de référence de la source. La largeur et la hauteur proviennent de ResolutionSelector (#501); la longueur en images est calculée automatiquement par ComfyMathExpression (#481) à partir d'une durée conviviale définie avec Float (Duration) (#480), s'ajustant à un nombre d'images convivial pour le modèle. Un prompt structuré est généré par DapaoH3VideoPromptNode (#517) et passé à travers easy showAnything (#515), ou vous pouvez écrire le vôtre selon le guide officiel de référence vidéo MiniMax H3 ici.
Échantillonnage#
Ce groupe effectue le débruitage avec l'échantillonneur et le calendrier sélectionnés. RandomNoise (#467) amorce le processus pour la reproductibilité. BasicScheduler (#473) et KSamplerSelect (#468) définissent le calendrier des étapes et l'algorithme, tandis que BasicGuider (#466) fusionne le modèle avec le conditionnement positif du nœud H3. SamplerCustomAdvanced (#469) exécute le raffinement itératif pour produire les latents vidéo finaux.
Décodage et création de vidéo#
Ce groupe transforme les latents en un résultat lisible. VAEDecode (#472) reconstruit les images, qui sont combinées avec l'audio de votre clip dans CreateVideo (#476) pour préserver le timing et l'ambiance. SaveVideo (#482) écrit un fichier de sortie avec le format et le codec choisis pour que votre rendu MiniMax H3 Remplacement de Personnage ComfyUI soit prêt à être revu ou publié.
Testé avec ces paramètres#
Cette zone d'aide contient des notes de prompt et des métadonnées d'exemple utilisées lors de la création. Elle n'est pas requise pour le fonctionnement mais peut inspirer votre propre structure de prompt et vos choix de timing.
Nœuds clés dans le workflow Comfyui MiniMax H3 Remplacement de Personnage ComfyUI#
MiniMaxH3ReferenceToVideo (#464)#
Central au transfert d'identité. Il accepte une image de remplacement, une référence vidéo préservant le mouvement, et éventuellement un audio de référence, puis émet à la fois le conditionnement positif et un latent initial. Les paramètres utiles à considérer sont prompt, width, height, et length. Si vous fournissez plusieurs références, gardez-les visuellement cohérentes pour éviter la dérive d'identité.
SAM3_Detect (#503)#
Trouve et segmente le sujet à l'écran qui sera remplacé. Un prompt de catégorie court via CLIPTextEncode (#502) guide la détection. Ajustez les options de qualité du masque uniquement lorsque la sélection par défaut manque le sujet ou inclut l'arrière-plan; des masques plus propres produisent généralement des échanges plus stables.
ImageCompositeMasked (#454)#
Construit une référence centrée sur le performer à partir des images découpées et du masque SAM3. Utilisez x, y, et resize_source uniquement si vous devez aligner les superpositions ou adapter le redimensionnement des images avant d'envoyer les images à l'entrée de référence H3. Le but est un indice de mouvement qui isole l'acteur tout en laissant la géométrie de la scène intacte.
ResolutionSelector (#501)#
Contrôle la taille de rendu cible en quelques clics. Choisissez un aspect et un budget de mégapixels qui conviennent à votre matériel ou à vos besoins de délai d'exécution. Commencez modestement, confirmez la stabilité de l'identité, puis augmentez la résolution pour votre passage final.
SamplerCustomAdvanced (#469)#
Exécute le débruitage en utilisant le calendrier, l'échantillonneur, le guide, le bruit et le latent de départ. Pour un développement plus rapide, essayez un calendrier plus léger ou un échantillonneur optimisé pour la vitesse, puis passez à vos paramètres de qualité préférés une fois que l'identité et le timing semblent corrects.
Extras optionnels#
- Sélection de référence
- Utilisez 1 à 3 images nettes et bien éclairées qui montrent clairement le visage et la tenue cible. Évitez les identités mixtes ou les poses extrêmes.
- Gardez l'âge, la coiffure et les vêtements du sujet de référence constants pour minimiser la dérive lors des mouvements longs.
- Conseils de masquage
- Si SAM3 inclut l'arrière-plan, affinez votre texte de catégorie ou relancez avec un seuil différent. Les masques propres réduisent l'effet halo et maintiennent l'éclairage de la scène stable.
- Prompting
- Décrivez uniquement l'identité et la garde-robe dans le remplacement tout en disant à H3 de préserver le mouvement et la scène originaux. Le guide officiel contient des exemples concis ici.
- Modèles
- Si vous voulez un point de départ minimal, comparez votre graphe avec le modèle officiel ComfyUI MiniMax H3 R2V ici.
- Droits et sécurité
- Utilisez uniquement des ressemblances, des performances et de l'audio que vous avez le droit de transformer. MiniMax H3 Remplacement de Personnage ComfyUI est puissant, alors appliquez-le de manière responsable.
Remerciements#
Ce workflow met en œuvre et s'appuie sur les travaux et ressources suivants. Nous remercions chaleureusement MiniMaxAI pour le modèle MiniMax-H3 et le guide de prompt de référence vidéo, Comfy-Org pour le modèle officiel ComfyUI MiniMax H3 R2V, et RunningHub.ai pour la source du workflow et la référence pour leurs contributions et leur maintenance. Pour des détails autorisés, veuillez vous référer à la documentation originale et aux référentiels liés ci-dessous.
Ressources#
- RunningHub.ai/Source du workflow et référence
- Docs / Notes de version: Source du workflow et référence
- MiniMaxAI/Modèle officiel MiniMax H3
- GitHub: MiniMax-AI/MiniMax-H3
- Hugging Face: MiniMaxAI/MiniMax-H3
- MiniMaxAI/Guide de prompt de référence vidéo MiniMax H3
- GitHub: MiniMax-AI/MiniMax-H3
- Hugging Face: MiniMaxAI/MiniMax-H3
- Docs / Notes de version: Guide de prompt de référence vidéo MiniMax H3
- Comfy-Org/Modèle officiel ComfyUI MiniMax H3 R2V
- GitHub: Comfy-Org/workflow_templates (video_minimax_h3_r2v.json)
- Hugging Face: Comfy-Org/MiniMax-H3
Remarque : L'utilisation des modèles, ensembles de données et codes référencés est soumise aux licences et conditions respectives fournies par leurs auteurs et mainteneurs.


