MiniMax H3 Singularity Reference To Video: generación de video con múltiples referencias y preservación de identidad en ComfyUI#
El flujo de trabajo de MiniMax H3 Singularity Reference To Video ComfyUI convierte múltiples referencias de personajes, estilo y escenas en un video coherente y temporalmente estable. Está diseñado para preservar su sujeto en todos los fotogramas mientras permite un control creativo fuerte sobre la apariencia, el vestuario, la iluminación y el entorno.
Construido alrededor de una receta de difusión concisa de dos etapas con un escalado latente entre ellas, este flujo de trabajo equilibra el movimiento controlado con un alto nivel de detalle. Es ideal para películas de moda, actuaciones escénicas, viñetas de ciencia ficción y secuencias de personajes animados que deben mantener la identidad y el estilo consistentes de principio a fin.
Modelos clave en el flujo de trabajo de ComfyUI MiniMax H3 Singularity Reference To Video#
- MiniMax‑h3 Singularity v1.3 (punto de control de referencia a video) Modelo de referencia a video de la comunidad utilizado para fusionar indicaciones de texto con referencias de imágenes y generar clips temporalmente coherentes con una fuerte preservación de identidad y estilo. Model card
- Codificador de texto CLIP Mapea indicaciones en un espacio semántico que el modelo de video comprende, permitiendo el direccionamiento de la composición, iluminación y movimiento. Consulte el documento original para obtener información sobre la alineación de texto-imagen de CLIP: Learning Transferable Visual Models From Natural Language Supervision.
- Autoencoder (VAE) compatible con el punto de control Codifica fotogramas en espacio latente para una difusión rápida y decodifica latentes finales de vuelta a RGB mientras conserva el detalle fino.
Cómo usar el flujo de trabajo de ComfyUI MiniMax H3 Singularity Reference To Video#
Este gráfico de ComfyUI sigue un camino claro: ingresa referencias e indicaciones, genera un pase base de bajo costo para fijar la identidad y el movimiento, escala latentes para detalle, refina para nitidez, luego ensambla fotogramas en un video.
Configuración de referencias e indicaciones#
Proporcione múltiples imágenes de referencia que cubran el papel de su sujeto (vista frontal o 3/4 para la identidad), un fotograma de estilo que comunique la dirección artística y referencias de escena opcionales para el entorno o la paleta. Mantenga las caras desobstruidas y razonablemente nítidas para ayudar al modelo a anclar la identidad. Escriba una indicación positiva concisa que nombre al sujeto, vestuario, entorno e iluminación, además de una indicación negativa corta para descartar artefactos que no le gusten. Si planea varios disparos, mantenga las indicaciones estables y ajuste solo lo que debe cambiar para mantener la continuidad. El flujo de trabajo mezcla todas las referencias con la indicación para que el sujeto se lea consistentemente en todos los fotogramas.
Pase de generación base#
El pase base establece la semejanza del sujeto, la pose y el movimiento amplio mientras se mantiene económico en pasos. Cambia el microdetalle por una identidad confiable y un movimiento estable, lo que lo hace adecuado para la exploración iterativa. Establezca la semilla para la reproducibilidad en todas las ejecuciones y ajuste la fuerza de guía solo si el sujeto se desvía. Cuando le guste el movimiento general y el encuadre, mantenga la semilla fija para llevar la misma identidad a etapas posteriores. Si el sujeto aún fluctúa, fortalezca la imagen de referencia más relevante o simplifique la indicación.
Escalado latente#
La etapa de escalado latente amplía la resolución de trabajo en el espacio latente antes de introducir el detalle fino. Escalar en este punto preserva el movimiento que aprobó en el pase base mientras crea espacio para bordes nítidos, detalles de cabello y textura de tela. Dado que el escalado ocurre en latentes, añade detalle sin introducir un nuevo temblor de movimiento. Si planea producir resoluciones más altas, esta etapa es la palanca que prepara píxeles limpios para el refinamiento. Mantenga su semilla y referencias sin cambios para asegurar la continuidad.
Pase de refinamiento#
El pase de refinamiento agudiza texturas, contornos y pequeñas características sin reescribir la composición o el movimiento. Es intencionadamente breve para que realce en lugar de reimaginar su pase base, lo que preserva la identidad y el estilo de las referencias. Use este pase para resaltar propiedades materiales como el brillo de cuero, lentejuelas o paneles de ciencia ficción, y para reducir el desenfoque en caras y ojos. Si nota sobreagudización o parpadeo, disminuya ligeramente la intensidad de la indicación o reduzca cuán agresivamente se aplica el pase de refinamiento. La salida es un conjunto de fotogramas limpios y consistentes listos para ser codificados.
Ensamblaje y exportación#
La etapa final agrupa fotogramas en un clip de video a su tasa de fotogramas y resolución elegidas. Elija una duración y fps que se adapten al movimiento de su sujeto; el movimiento más lento y deliberado a menudo se ve mejor a tasas de fotogramas moderadas. Guarde en un contenedor común como MP4 o WebM para compartir fácilmente. Nombre las salidas metódicamente para que pueda comparar variaciones por semilla, referencias o notas de indicación. Si planea editar tomas juntas, exporte algunas tomas con la misma semilla para mantener la identidad bloqueada entre cortes.
Extras opcionales#
- Curar referencias por rol: 1–2 para identidad, 1 para estilo y 1 para entorno. Evite mezclar iluminación conflictiva entre referencias.
- Use recortes ajustados para referencias de identidad de modo que la cara domine el fotograma; use fotogramas de estilo o escena más amplios para apariencia y paleta.
- Mantenga las indicaciones modulares. Intercambie solo la parte que cambia por toma, como el ángulo de la cámara o el fondo, para mantener la identidad.
- Comience con clips cortos para validar movimiento y semejanza, luego escale la duración una vez que esté satisfecho con la apariencia.
- Si necesita una continuidad más fuerte entre tomas, reutilice la misma semilla y mantenga la imagen de referencia más influyente sin cambios.
Este flujo de trabajo de MiniMax H3 Singularity Reference To Video le ofrece una forma rápida y repetible de convertir referencias seleccionadas en video cinematográfico, consistente en identidad, directamente dentro de ComfyUI.
Agradecimientos#
Este flujo de trabajo implementa y se basa en los siguientes trabajos y recursos. Agradecemos a RunningHub por la fuente del flujo de trabajo y a WarmBloodAban por el modelo MiniMax H3 Singularity por sus contribuciones y mantenimiento. Para obtener detalles autorizados, consulte la documentación original y los repositorios vinculados a continuación.
Recursos#
- RunningHub/Fuente del flujo de trabajo
- Documentos / Notas de lanzamiento: Workflow source
- WarmBloodAban/Minimax-h3_Singularity
- Hugging Face: WarmBloodAban/Minimax-h3_Singularity
Nota: El uso de los modelos, conjuntos de datos y código referenciados está sujeto a las respectivas licencias y términos proporcionados por sus autores y mantenedores.


