FLUX 3 Image는 참조 이미지 가이드와 선명한 텍스트 표현을 지원하는 멀티모달 이미지 모델입니다
이 콤팩트 스틸스 모델은 텍스트에서 새로운 이미지를 생성하고 이미 가지고 있는 사진을 수정합니다. 하나의 Qwen Image 2.1 가중치 세트가 텍스트-투-이미지와 이미지-투-이미지를 다루며, 1K 또는 2K에서 사용 가능하며, 선택적으로 네이티브 투명도를 지원합니다.
프롬프트 전용 생성에는 업로드가 필요 없습니다. 편집은 하나에서 열 개의 참조 이미지와 지침을 추가합니다. 이 페이지는 Qwen Image 2.1 참조 워크플로를 실행하며, 형제 페이지는 프롬프트 전용 생성을 실행합니다.
더 넓은 작업은 또한 Qwen Image 2.1와 함께 작동합니다: 셀카를 파노라마로 확장하거나, 제품 사진을 인포그래픽으로 바꾸거나, 삼면 캐릭터 시트에서 스토리보드를 만드는 것.
이 페이지에서 Qwen Image 2.1는 이미지 대 이미지를 실행합니다. 텍스트 대 이미지는 참조 이미지나 마스크 없이 동일한 해상도, 비율, 배경, 형식, 프롬프트 재작성 및 시드 선택을 사용합니다.
| 매개변수 | 필수 | 유형 | 기본값 | 범위 / 옵션 | 설명 |
|---|---|---|---|---|---|
image_urls* | 예 (*) | 배열 | 샘플 이미지 | 1–10 이미지 | 프롬프트 순서의 참조 이미지. JPEG, PNG, 또는 WebP; 각 파일 최대 30MB 및 25MP. 신원이 선명하게 유지되어야 할 때는 네 개 이하로 유지하세요. |
prompt* | 예 (*) | 문자열 | 예시 지침 | 최대 5,000자 | 새로운 스틸 이미지나 편집을 설명하세요. 이미지 내 텍스트가 있으면 인용하세요. 마스크가 있을 경우, 흰색 영역에 나타나야 할 내용을 설명하세요. |
mask_url | 아니요 | 문자열 (이미지) | — | 선택 사항 | 흑백 로컬 편집 마스크. 흰색은 변경, 검은색은 유지. 정확히 하나의 참조가 필요합니다. 종횡비와 프롬프트 재작성은 무시됩니다. 투명 배경과 함께 사용할 수 없습니다. |
aspect_ratio | 아니요 | 문자열 | auto | auto, 1:1, 4:3, 3:4, 3:2, 2:3, 16:9, 9:16, 21:9, 9:21 | auto는 첫 번째 참조에 맞춰집니다. 마스크 모드에서는 무시됩니다. 텍스트-투-이미지에서는 기본값이 1:1입니다. |
resolution | 아니요 | 문자열 | 1K | 1K, 2K | 1K가 더 빠릅니다; 2K는 약 4배의 픽셀을 가지며, 특히 참조 이미지가 있을 때 시간이 더 걸립니다. |
background | 아니요 | 문자열 | opaque | opaque, transparent | transparent는 새로운 정지 이미지나 컷아웃에 실제 알파 채널을 작성합니다. 오직 주제만 설명하세요. JPEG와 함께 사용할 수 없습니다. |
output_format | 아니요 | 문자열 | png | png, webp, jpeg | PNG와 WebP는 알파 채널을 지원할 수 있습니다. JPEG는 지원하지 않습니다. |
enhance_prompt | 아니요 | 부울 | true | true, false | 생성 또는 편집 전에 짧은 프롬프트를 다시 작성합니다. 이미 정확하면 끄세요. 마스크 모드에서는 무시됩니다. |
seed | 아니요 | 정수 | -1 | -1 또는 0–2147483647 | 결과를 재현하기 위해 시드를 고정합니다; 새로운 변형을 위해 -1을 사용합니다. |
이 이미지-투-이미지 페이지에서, Qwen Image 2.1는 $0.029 per 1K 이미지이고 $0.119 per 2K 이미지입니다. 텍스트-투-이미지는 자체 페이지에서 $0.020 per 1K 이미지이고 $0.079 per 2K 이미지입니다. 추가 참조는 명시된 추가 요금을 부과하지 않습니다. 배치의 경우, 선택한 등급 요금을 출력 수로 곱하십시오.
Qwen Image 2.1은 중국어와 영어가 혼합된 프롬프트를 수용합니다. 짧고 구체적인 명사가 긴 무드보드보다 낫습니다.
Qwen Image 2.1이 올바른 시작점이 아니라면, RunComfy에서 이 모델들을 비교하세요:
FLUX 3 Image는 참조 이미지 가이드와 선명한 텍스트 표현을 지원하는 멀티모달 이미지 모델입니다
프롬프트에서 중국어와 영어 문자를 정확히 표현하고 구도가 안정적인 사실적 이미지를 생성합니다.
필수 프롬프트에 따라 원본 이미지 1~10장을 합성하거나 편집합니다. 여섯 가지 출력 크기, 추론 단계, 가이던스 스케일, 결과 이미지 1~4장, 시드와 JPEG 또는 PNG 출력을 설정할 수 있습니다.
Nano Banana 2로 빠르고 고품질의 텍스트→이미지 생성。종횡비, 안전 허용도, 출력 형식을 세밀하게 제어할 수 있습니다.
텍스트 프롬프트로 이미지를 생성하고 6가지 크기, 시드, JPEG 또는 PNG 출력을 설정할 수 있습니다.
필수 JPEG 또는 PNG 이미지 1~10장을 필수 프롬프트에 따라 편집하거나 결합합니다. `1K`, `2K`, `4K` 또는 고정 해상도 8종 중에서 선택할 수 있습니다.
Qwen Image 2.1는 신원, 제품 형태 및 레이아웃을 유지하면서 서면 지침에 따라 사진을 수정합니다. 일반적인 작업에는 배경 교체, 가상 착용, 그룹 합성, 국소 보정 및 투명한 제품 컷아웃이 포함됩니다.
참고 이미지를 하나에서 열 개까지 업로드할 수 있습니다. Qwen Image 2.1는 배열 순서대로 이미지를 읽기 때문에, 프롬프트에서 '첫 번째 이미지'와 '두 번째 이미지'가 해당 목록에 해당합니다. 얼굴이나 로고가 선명하게 유지되어야 할 때는 개수를 네 장 이하로 유지하세요.
예. 배경을 투명으로 설정하여 Qwen Image 2.1가 실제 알파 채널을 작성하게 하거나, 일반 RGB 사진에서 피사체를 투명 레이어로 분리하도록 요청하세요. PNG 또는 WebP을 사용하세요; JPEG는 알파를 담을 수 없으며, 마스크는 투명 배경과 결합할 수 없습니다.
Qwen Image 2.1는 원, 칠해진 표시 또는 별도의 흑백 마스크(흰색은 변경, 검은색은 유지)를 따라갈 수 있습니다. 마스크 모드는 정확히 하나의 참조가 필요하며, 해당 이미지의 비율을 따르고, 종횡비와 프롬프트 재작성은 무시합니다. 흰색 영역에 나타나야 할 내용을 설명하세요.
Qwen Image 2.1은 1K 또는 2K 출력과 자동, 1:1, 4:3, 3:4, 3:2, 2:3, 16:9, 9:16, 21:9, 9:21을 포함한 화면 비율을 제공합니다. auto는 첫 번째 참조에 맞춰집니다. 정확한 옵션은 현재 RunComfy 파라미터 패널을 확인하세요.
예. 동일한 Qwen Image 2.1 가중치가 텍스트-이미지와 이미지-이미지에 사용됩니다. 이 페이지는 편집 / 참조 워크플로우이며, 별도의 텍스트-이미지 페이지에서는 사진을 업로드하지 않고 프롬프트로부터 생성합니다.
예. RunComfy 모델 UI에서 편집을 프로토타입한 다음, 동일한 매개변수로 RunComfy HTTP API를 통해 동일한 Qwen Image 2.1 모델을 호출하십시오. 모델을 직접 호스팅하거나 확장할 필요는 없습니다.
세대는 USD 또는 크레딧을 소비합니다. Qwen Image 2.1는 1K 출력 이미지당 $0.029가 청구되며, 2K 출력 이미지당 $0.119가 청구됩니다. 추가 참조는 이 페이지에 나열된 추가 비용을 더하지 않으며, 새 사용자는 일반적으로 테스트용 무료 체험 금액을 받습니다.
RunComfy는 최고의 ComfyUI 플랫폼으로서 ComfyUI 온라인 환경과 서비스를 제공하며 ComfyUI 워크플로우 멋진 비주얼을 제공합니다. RunComfy는 또한 제공합니다 AI Models, 예술가들이 최신 AI 도구를 활용하여 놀라운 예술을 창조할 수 있도록 지원합니다.





