ComfyUI에서 참조 기반 구성을 위한 Qwen Image 2.1 다중 이미지 편집#
이 워크플로우는 여러 참조 이미지를 하나의 일관된 장면으로 조립하여 영어 편집 지침을 사용합니다. 주제, 객체, 환경을 융합하면서 인식 가능한 디자인 기능, 재료 및 조명을 유지합니다. 참조 인식 프롬프트 향상 단계는 생성 전에 지침을 확장하여 Qwen Image 2.1이 각 요소를 정확하게 배치하고 정체성을 유지할 수 있도록 합니다.
Qwen Image 2.1 다중 이미지 편집은 인테리어 스타일링, 조화로운 의상 시각화, 개별 사진에서 생성된 그룹 초상화에 이상적입니다. 각 참조가 어떻게 나타나고 상호작용해야 하는지를 설명하고, 워크플로우는 지시를 명시적인 편집 프롬프트로 다시 작성하며, 모델은 자연스럽게 구성된 단일 사진 실사 또는 스타일화된 이미지를 생성합니다.
Comfyui Qwen Image 2.1 다중 이미지 편집 워크플로우의 주요 모델#
- Qwen-Image-2.1. 생성에 사용되는 핵심 텍스트 및 이미지 조건 확산 모델입니다. 참조 인식 편집과 여러 시각적 입력의 강력한 배치를 가능하게 합니다. 기능 및 변형에 대한 모델 카드 및 프로젝트 개요를 참조하십시오: Hugging Face, GitHub.
- Qwen-Image-2.1-PE-I2I. 여기에서 참조 인식 프롬프트 향상에 사용되는 명령 조정 구성 요소입니다. 영어 지시를 제공된 이미지에 근거하여 간결하고 생성 준비가 된 편집 프롬프트로 다시 작성합니다: Hugging Face.
- Qwen-Image-2.1 VAE. 색상 충실도와 세부 사항을 유지하면서 잠재 값을 RGB로 디코딩하는 변이 오토인코더입니다: Hugging Face와 함께 Qwen-Image-2.1 릴리스에 포함되어 있습니다.
Comfyui Qwen Image 2.1 다중 이미지 편집 워크플로우 사용법#
워크플로우는 세 단계로 실행됩니다: 참조 및 간단한 영어 지침을 제공하고, 프롬프트는 이미지 기반으로 다시 작성되며, 생성기는 향상된 프롬프트와 참조를 결합하여 최종 이미지를 구성합니다.
사용자 입력#
기본 장면과 참조 요소를 위해 네 개의 LoadImage 노드를 사용하십시오: Image 1 - Reading Room (#470), Image 2 - Sage Armchair (#510), Image 3 - Side Table and Tea (#503), Image 4 - Cosmos Flowers (#511). 추가 소스가 필요한 경우 "Unused Reference"로 레이블이 붙은 추가 LoadImage 노드를 연결하십시오; 참조가 결과에 영향을 미치기를 원할 때 연결하십시오. 각 이미지의 역할, 보존할 특성, 객체 배치 위치 및 피해야 할 사항을 명확히 명시하는 Edit Instructions - English (#516)에 지시를 작성하십시오. ResolutionSelector (#13)에서 출력 비율 및 크기를 설정한 후 워크플로우는 생성할 해상도에서 EmptyLatentImage (#480)를 생성합니다.
프롬프트 다시 작성#
선택한 모든 이미지는 ZNGB_ImageBatchMulti (#531)에 의해 수집되고 TextGenerateLTX2Prompt (#502)를 통해 English Prompt Enhancement에 전달됩니다. 최종 프롬프트만 반환하도록 English Output Instruction (#517)에 짧은 보조 라인이 추가됩니다. 향상 단계는 역할, 배치, 조명 및 일관성 규칙을 단일 명시적 편집 지침으로 확장하기 위해 Qwen Image 2.1 PE 모델을 사용합니다. 이 개선된 텍스트는 생성이 자동으로 진행되기 전에 Enhanced Prompt Preview (#501)에서 미리 볼 수 있습니다.
모델#
Models 그룹은 생성 구성 요소를 로드합니다: Qwen-Image-2.1을 위한 UNETLoader (#477), 텍스트-비전 인코더를 위한 CLIPLoader (#533), 디코딩을 위한 VAELoader (#479). 그런 다음 TextEncodeQwenImage21 (#519)은 향상된 프롬프트, 선택적 부정적 프롬프트, 최대 10개의 참조 이미지를 다중 이미지 편집에 적합한 조건으로 병합합니다. 또한 선택 시 구조를 더 엄격하게 안내할 수 있는 선택적 참조 잠재를 생성할 수 있습니다.
샘플링 및 출력#
QwenImage21Cache (#484)는 효율적인 반복 샘플링을 위해 KSampler (#482)와 모델을 공유합니다. 기본적으로 ComfySwitchNode (#483)는 EmptyLatentImage (#480)에서 빈 잠재를 자유로운 조합을 위해 라우팅합니다; 참조 기하학이나 레이아웃에 대한 더 강한 준수를 원할 때 TextEncodeQwenImage21 잠재를 사용하도록 전환하십시오. KSampler를 조정하여 프롬프트 준수와 변형을 균형 있게 조정한 다음 VAEDecode (#481) 및 SaveImage (#534)가 선택한 파일 이름 접두사로 최종 이미지를 생성합니다.
Comfyui Qwen Image 2.1 다중 이미지 편집 워크플로우의 주요 노드#
TextGenerateLTX2Prompt (#502)#
이 노드는 Qwen Image 2.1 PE 모델을 사용하여 참조 인식 프롬프트 향상을 수행합니다. 지시와 조립된 이미지 배치를 제공하여 참조에 근거한 단일 명시적 편집 프롬프트를 얻습니다. 많은 객체 속성을 보존해야 할 때 허용 길이를 늘리고, 창의적 패러프레이징을 선호하거나 엄격하게 문자 그대로의 재작성을 선호하도록 샘플링 옵션을 조정합니다. 미리보기 노드는 생성기가 따를 정확한 내용을 보여줍니다.
TextEncodeQwenImage21 (#519)#
향상된 프롬프트와 최대 10개의 참조 이미지를 Qwen-Image-2.1에 대한 조건으로 인코딩합니다. negative_prompt를 사용하여 원하지 않는 중복, 콜라주 효과 또는 추가 사람을 금지하십시오. resolution 입력은 기능 추출을 위한 작업 규모를 설정합니다; 출력을 안정적으로 유지하기 위해 일치시킵니다. 이 노드는 또한 스위치를 통해 선택할 때 구성을 더 엄격하게 고정하는 초기 잠재를 방출할 수 있습니다.
ComfySwitchNode (#483)#
KSampler의 시작 전략을 전환합니다. 빈 잠재를 기본으로 유지하여 조건을 통해 참조 정체성을 여전히 존중하는 더 자유로운 조합을 허용합니다. 참조 기하학이나 레이아웃에 대한 더 강한 준수를 원할 때 TextEncodeQwenImage21에서 참조 잠재로 전환하십시오; 낮은 노이즈 감소와 결합하여 참조를 강조하십시오.
KSampler (#482)#
Qwen-Image-2.1의 노이즈 감소 프로세스를 구동합니다. 특정 배열을 재현하거나 변형을 탐색하기 위해 seed를 사용하십시오. 모델이 향상된 프롬프트를 얼마나 엄격하게 따르는지에 대해 cfg를 조정하고 steps를 품질-속도 트레이드오프를 위해 조정하십시오. sampler_name과 scheduler 선택은 질감과 선명도를 미세하게 변경할 수 있습니다; 외관을 반복할 때 일관된 쌍을 선택하십시오.
ResolutionSelector (#13)#
출력 너비와 높이에 대한 빠른 제어를 제공합니다. 모든 참조 요소를 편안하게 프레임에 맞추는 비율을 선택하십시오. 더 큰 해상도는 참조에서 더 많은 질감을 드러내지만 더 많은 계산이 필요하므로, 구성이 안정될 때 점진적으로 늘리십시오.
선택적 추가 기능#
- 지시를 작성할 때 각 이미지의 역할과 보존할 정확한 기능: 재료, 색상, 패턴, 실루엣 및 규모를 나열하십시오.
- 자연스러운 합성을 위해 참조 간 카메라 각도, 시간, 조명 방향을 일관되게 유지하십시오.
- 인테리어의 경우, 환경으로 하나의 기본 방을 선택하고 가구나 장식을 배치할 객체로 취급하십시오; 의상의 경우, 하나의 마네킹이나 모델을 기본으로 사용하고 의상을 객체 참조로 제공합니다.
- 중복이나 콜라주 아티팩트를 발견하면,
negative_prompt를 "중복 없음, 콜라주 없음"과 같은 용어로 강화하고 객체 수에 대해 명확히 하십시오. - 잠재 스위치를 두 가지 모드로 사용하십시오: 탐색 레이아웃을 위한 빈-잠재, 정밀 배치를 위한 참조-잠재.
- 유망한 외관을 고정된
seed로 잠그고, 지시만 변경하거나 참조 중 하나를 한 번에 교체하여 변형을 만드십시오. SaveImage파일 이름 접두사를 사용하여 장면별로 결과를 정리하여 반복 비교가 용이하도록 하십시오.
Qwen Image 2.1 다중 이미지 편집 워크플로우에 사용된 모델 패밀리 및 가중치에 대한 배경 정보는 공식 리소스를 참조하십시오: Qwen-Image-2.1 on Hugging Face, Qwen-Image-2.1-PE-I2I, 그리고 프로젝트 리포지토리 GitHub.
감사의 말#
이 워크플로우는 다음 작업 및 리소스를 구현하고 확장합니다. 우리는 워크플로우 소스를 제공한 RunningHub, Qwen-Image-2.1을 위한 QwenLM (Qwen), 그리고 참조 인식 프롬프트 향상을 위한 Qwen-Image-2.1-PE-I2I의 기여와 유지에 대해 Qwen에 감사드립니다. 권위 있는 세부 사항은 아래 링크된 원본 문서 및 리포지토리를 참조하십시오.
리소스#
- RunningHub/Workflow source
- 문서 / 릴리스 노트: Workflow source
- Qwen/Qwen-Image-2.1
- Hugging Face: Qwen/Qwen-Image-2.1
- GitHub: QwenLM/Qwen-Image-2.1
- QwenLM/Qwen-Image-2.1
- GitHub: QwenLM/Qwen-Image-2.1
- Hugging Face: Qwen/Qwen-Image-2.1
- Qwen/Qwen-Image-2.1-PE-I2I
- Hugging Face: Qwen/Qwen-Image-2.1-PE-I2I
참고: 참조된 모델, 데이터셋 및 코드의 사용은 해당 저자 및 유지 관리자가 제공한 라이센스 및 조건에 따릅니다.





