Creador de Personajes Consistentes 4.0: Construye un conjunto de datos de personajes reutilizables a partir de una imagen#
Consistent Character Creator 4.0 es un flujo de trabajo modular de ComfyUI que convierte una imagen de referencia en un conjunto de datos de personajes de 24 tomas. Cubre vistas neutrales, primeros planos, expresiones, pruebas de iluminación, poses de acción y escenas de historias mientras mantiene el rostro, cuerpo, ropa y estilo visual del personaje reconocibles en todo el tablero.
Esta versión está construida alrededor de FLUX.2 Klein 9B FP8, un codificador de texto Qwen3 8B, el FLUX.2 VAE, un LoRA de consistencia dedicado y una guía de identidad en el espacio latente. La edición simple mantiene el gráfico práctico al omitir las etapas de escalado y detalle facial encontradas en la versión avanzada. Puedes previsualizar el lote completo, guardar solo las imágenes que pasen tu verificación de identidad y enrutar los resultados aceptados a una carpeta de conjunto de datos nombrada lista para la subtitulación y el entrenamiento de LoRA.
Modelos clave en el flujo de trabajo de Consistent Character Creator 4.0 ComfyUI#
- FLUX.2 Klein 9B FP8. El principal modelo de generación y edición de imágenes. Sigue la imagen de referencia y los avisos de escena a través de los 24 módulos del conjunto de datos mientras admite nuevas poses, ángulos de cámara, expresiones y entornos. El modelo 9B se publica bajo la Licencia No Comercial de FLUX, por lo que revisa sus términos antes de usar salidas o derivados comercialmente. Ver black-forest-labs/FLUX.2-klein-9b-fp8.
- Codificador de texto mixto Qwen3 8B FP8. Cargado en modo
flux2, traduce la instrucción de cada módulo en condicionamiento para FLUX.2 Klein. El gráfico utilizaqwen_3_8b_fp8mixed.safetensorsdel paquete de codificadores listo para ComfyUI: Comfy-Org/vae-text-encorder-for-flux-klein-9b. - FLUX.2 VAE.
flux2-vae.safetensorscodifica la imagen de referencia para la guía de identidad y decodifica latentes generados en las imágenes finales del conjunto de datos. El activo empaquetado está disponible en Comfy-Org/flux2-dev. - FLUX.2 Klein 9B Consistency V2 LoRA. Este adaptador refuerza la consistencia del personaje a través de diferentes poses, expresiones y escenas. El flujo de trabajo carga
Flux2-Klein-9B-consistency-V2.safetensorsa una fuerza de0.35; mantén ese valor para la primera ejecución antes de probar pequeños ajustes. Ver dx8152/Flux2-Klein-9B-Consistency. - Guía de Identidad FLUX.2 Klein. Este parche de modelo en tiempo de muestreo compara el latente actual desruido con la referencia codificada y empuja características de identidad coincidentes de vuelta hacia la fuente. El gráfico utiliza guía adaptativa para que el rostro y el diseño del personaje permanezcan anclados sin congelar la pose solicitada o el fondo. Ver capitan01R/ComfyUI-Flux2Klein-Enhancer.
Cómo usar el flujo de trabajo de Consistent Character Creator 4.0 ComfyUI#
El gráfico está organizado en controles de configuración compartidos a la izquierda y 24 módulos de generación independientes a la derecha. Configura la referencia, el nombre, el estilo y el modo de guardado una vez, luego coloca en cola el gráfico para construir un tablero de revisión que cubra al personaje desde tomas de documentación neutrales hasta escenas de iluminación y acción difíciles.
Selección de modelo#
El grupo MODELSELECTION carga los cuatro activos de modelo requeridos. UNETLoader (#527) selecciona FLUX.2 Klein 9B FP8, CLIPLoader (#528) carga Qwen3 8B con tipo flux2, y VAELoader (#529) carga el FLUX.2 VAE. LoraLoaderModelOnly (#664) luego aplica el LoRA de consistencia a 0.35, mientras que IdentityGuidance (#824) agrega corrección latente adaptativa. Deja estos valores predeterminados sin cambios para tu primer conjunto de datos para que puedas evaluar la referencia y los avisos antes de ajustar la pila de modelos.
Imagen de referencia y preparación facial#
Carga una imagen fuente clara en LoadImage (#535). Un retrato frontal o de tres cuartos con ropa visible, iluminación limpia y un rostro despejado proporciona al flujo de trabajo el ancla de identidad más fuerte. AutoCropFaces (#537) extrae una referencia facial cuadrada, y ImageResizeKJv2 (#562) prepara la imagen para la ruta de condicionamiento compartido. Un segundo recorte facial más adelante en el gráfico se utiliza cuando una salida de primer plano necesita una verificación de identidad más estrecha.
Usa los campos opcionales STYLE y CLOTHES para describir detalles que deben permanecer estables. Mantén estas descripciones cortas y concretas. Nombra el peinado, la prenda, el color, el material y el estilo de renderizado en lugar de repetir un aviso de escena largo en cada módulo.
Nomenclatura de salida y modo de guardado#
Establece NAME (CHARACTER) (#2905) antes de ejecutar el gráfico. El flujo de trabajo combina este valor con su carpeta raíz y tipo de salida, colocando las imágenes guardadas bajo ComfyUI/output/CCC/<NAME>/. Un nombre único y simple evita que múltiples personajes se mezclen en el mismo conjunto de entrenamiento.
Save Dataset (1 = save | 2 = preview only) (#2922) controla si el lote revisado se escribe en disco. Comienza con 2 para inspeccionar el tablero sin comprometer los archivos. Cambia a 1 cuando las salidas preserven la identidad deseada; Image Save (#2053) luego escribe el lote seleccionado usando la ruta y el prefijo de conjunto de datos configurados.
Anclas de identidad neutrales#
Ejecuta primero los módulos neutrales porque revelan el desplazamiento de identidad antes de que comiencen las escenas más difíciles:
T-POSEcrea una vista de estudio de cuerpo completo que expone proporciones, ropa y silueta.SIDE-WALKprueba un perfil lateral limpio mientras introduce movimiento corporal natural.BACK-VIEWverifica la longitud del cabello, la forma de la prenda y las proporciones del cuerpo trasero.CLOSE-FRONTyCLOSE-PROFILEestablecen anclas faciales detalladas para vistas frontales y laterales.
Estas salidas son especialmente útiles para hojas de personajes, referencias de aparejo, estudios de giro y el núcleo de un conjunto de datos LoRA. Si el rostro ya se desvía aquí, mejora la imagen fuente o aclara STYLE y CLOTHES antes de generar las escenas restantes.
Pruebas de expresiones e iluminación#
Los módulos de primer plano crean variantes CLOSE-SMILE, CLOSE-SAD y CLOSE-ANGRY sin cambiar el rostro subyacente. BACKLIT, LOW-ANGLE, HIGH-ANGLE y SKY-LOOKUP luego someten a prueba la identidad bajo una iluminación más difícil y posiciones de cámara. Juntas, estas imágenes ayudan a un futuro conjunto de entrenamiento a cubrir el rango emocional y cambios de punto de vista en lugar de sobreajustarse a un retrato neutral.
Revisa detalles finos como la forma de los ojos, la línea de la mandíbula, la línea del cabello, el tono de la piel y los accesorios recurrentes. Conserva solo las imágenes que aún parecen el mismo personaje; un conjunto de datos limpio más pequeño es más útil que un conjunto más grande con desviación de identidad obvia.
Escenas cotidianas y cobertura del entorno#
El flujo de trabajo incluye escenas prácticas como COFFEE, FOREST, DECKCHAIR, BED, OFFICE, NIGHTCLUB, PARK-SMOKE, BEACH y CANYON. Estos módulos varían la ubicación, el encuadre, los accesorios, el clima y la exposición de la ropa mientras reutilizan la misma pila de identidad. Son útiles para verificar si un personaje sigue siendo reconocible en contextos de estilo de vida, editoriales, cinematográficos y al aire libre.
Los avisos son editables. Cambia los detalles de la escena mientras preservas la instrucción para que coincida con el rostro, estilo y ropa del personaje de referencia. Cuando un accesorio o pose causa distorsión, simplifica el aviso de ese módulo en lugar de debilitar la guía de identidad en todo el gráfico.
Cobertura de acción y fantasía#
RUNNING, FLYING y FLYING-LAVA empujan al personaje a grandes cambios de pose y entorno. Estas son pruebas de consistencia deliberadamente difíciles: introducen movimiento, perspectiva inusual, iluminación fuerte y más libertad en el fondo. Úsalos después de que los grupos neutrales y de primer plano sean estables. Si se desvían, fortalece la descripción del personaje, reutiliza una salida neutral limpia como referencia adicional donde sea compatible, o elimina la toma fallida del conjunto de datos guardado.
Muestreo y ensamblaje de lotes#
Cada módulo de generación utiliza un subgráfico repetido Image Edit (Flux.2 Dev). Codifica imágenes de referencia disponibles en latentes de referencia, aplica el aviso del módulo, muestrea con el modelo compartido y controles de identidad, y decodifica el resultado. El gráfico suministrado utiliza un programa de 20 pasos FLUX.2 y muestreo de Euler como un punto de partida confiable. Los nodos ImageCollect recopilan las salidas del módulo, BatchImagesNode (#2893) ensambla el lote final, y el interruptor de guardado lo enruta ya sea a la vista previa o a la carpeta de conjunto de datos nombrada.
Nodos clave en el flujo de trabajo de Consistent Character Creator 4.0 ComfyUI#
IdentityGuidance (#824)#
Preserva la identidad durante el muestreo comparando el latente generado con la referencia codificada por el VAE. Los ajustes adaptativos proporcionados favorecen las regiones coincidentes mientras dejan espacio para cambios de pose, expresión y escena. Si la identidad es débil en la mayoría de los módulos, realiza pequeños cambios de fuerza solo después de confirmar que el recorte de referencia y el LoRA de consistencia son correctos.
LoraLoaderModelOnly (#664)#
Carga el LoRA de Consistencia V2 de FLUX.2 Klein a 0.35. Este es el control de consistencia compartido para cada módulo de generación. Aumentarlo demasiado puede hacer que las poses sean rígidas o copiar el encuadre de la fuente; disminuirlo puede aumentar la desviación. Mantén el valor original mientras estableces una línea base.
AutoCropFaces (#537 y #1895)#
Crea referencias faciales enfocadas a partir de la fuente y salidas seleccionadas. El primer recorte ancla la identidad en la configuración, mientras que el recorte posterior apoya las rutas de referencia de primer plano y descendentes. Usa una entrada con un rostro claramente visible para que el recorte automático no seleccione al sujeto incorrecto.
ResolutionSelector (#2903)#
Establece las dimensiones del lienzo común utilizadas por los módulos del conjunto de datos. El flujo de trabajo suministrado utiliza un formato cuadrado, que funciona bien para primeros planos mixtos y referencias de cuerpo completo. Mantén una resolución en todo un conjunto de datos a menos que tu canal de entrenamiento espere explícitamente múltiples relaciones de aspecto.
ImpactInversedSwitch (#2922)#
Separa la vista previa del comportamiento de guardado. Usa la salida 2 durante la revisión y la salida 1 solo después de que el tablero completo pase tu verificación de consistencia. Esto facilita la iteración sin llenar la carpeta de conjunto de datos final con generaciones rechazadas.
Image Save (#2053)#
Escribe el lote aceptado en la ruta construida a partir de la carpeta raíz, el nombre del personaje y el tipo de conjunto de datos. Establece el nombre antes de colocar en cola y mantenlo estable en las repeticiones para que las leyendas y los archivos de entrenamiento de LoRA futuros permanezcan organizados.
Extras opcionales#
- Comienza en modo de vista previa y juzga las vistas neutrales antes de los módulos de entorno o acción.
- Usa una referencia nítida con un rostro y señales corporales visibles; evita la oclusión pesada, el desenfoque extremo o múltiples personas.
- Describe al personaje en los campos opcionales de estilo y ropa para que los avisos de escena repetidos no tengan que llevar todos los detalles de identidad.
- Mantén el cargador CLIP en
flux2y el LoRA de consistencia a0.35para la primera ejecución. - Guarda solo las salidas que coincidan con el personaje. Rechaza ojos inconsistentes, proporciones faciales, peinados, detalles de ropa o forma corporal.
- Subtitula el conjunto de datos limpio después de la revisión, luego inspecciona esas leyendas antes de comenzar el entrenamiento de LoRA.
- FLUX.2 Klein 9B es no comercial bajo su licencia de modelo publicada. Verifica el modelo, LoRA y las licencias de nodos personalizados para tu uso previsto antes de distribuir salidas o derivados entrenados.
Agradecimientos#
Este flujo de trabajo fue creado y compartido por MickMumpitz como la edición simple de Consistent Character Creator 4.0. Se basa en FLUX.2 Klein 9B de Black Forest Labs, los activos de FLUX.2 ComfyUI de Comfy-Org, el LoRA de Consistencia FLUX.2 Klein de dx8152 y nodos de preservación de identidad de capitan01R. Agradecemos sinceramente a los autores y mantenedores de estos modelos, nodos y recursos de flujo de trabajo.
Recursos#
- MickMumpitz/Consistent Character Creator 4.0 source
- Guía de flujo de trabajo y descargas: The Consistent Character Creator 4.0 is here
- MickMumpitz/ComfyUI custom nodes
- Black Forest Labs/FLUX.2 Klein 9B FP8
- Hugging Face: black-forest-labs/FLUX.2-klein-9b-fp8
- Comfy-Org/FLUX.2 VAE and Qwen3 encoder assets
- VAE: Comfy-Org/flux2-dev
- Codificador de texto: Comfy-Org/vae-text-encorder-for-flux-klein-9b
- dx8152/FLUX.2 Klein 9B Consistency LoRA
- Hugging Face: dx8152/Flux2-Klein-9B-Consistency
- capitan01R/FLUX.2 Klein identity guidance nodes
Nota: El uso de los modelos, conjuntos de datos y código referenciados está sujeto a las licencias y términos proporcionados por sus autores y mantenedores.








