logo
RunComfy
  • ComfyUI
  • 트레이너신규
  • 모델
  • API
  • 가격
discord logo
모델
탐색
모든 모델
라이브러리
생성 기록
모델 API
API 문서
API 키
계정
사용량

Wan 2.6 Text to Image: 참조 이미지를 활용한 정밀한 텍스트 이미지 생성 | RunComfy

wan-ai/wan-2-6/text-to-image

텍스트 프롬프트와 참조 이미지로 스타일과 피사체 정체성을 정밀하게 제어한 고품질 이미지를 생성하세요. 브랜드 비주얼, 광고, 이커머스 제품 이미지에 적합합니다.

프롬프트는 2,000자 미만이어야 합니다.
선택 사항인 참조 이미지입니다. 지원 형식: JPEG, JPG, PNG(알파 채널 없음), BMP, WEBP. 각 변 384~5,000px, 최대 10MB.
생성 이미지에서 제외할 내용을 입력합니다.
생성할 이미지 수의 상한입니다. 실제 생성 수는 모델 추론에 따라 결정되며 설정값보다 적을 수 있습니다. 예를 들어 5로 설정해도 내용에 따라 3장만 생성될 수 있습니다.
Idle
The rate is $0.017 per image.

Wan 2.6 Text to Image 소개

Wan AI의 Wan 2.6 Text to Image는 프롬프트를 이미지당 $0.015에 실무용 이미지로 변환합니다. 선택 사항인 참조 이미지를 사용하면 스타일, 피사체 정체성, 브랜드 요소를 세밀하게 제어할 수 있습니다. 스톡 이미지 검색, 복잡한 마스킹, 수작업 리터칭을 줄이고 참조 기반의 일관된 아트 디렉션을 구축할 수 있습니다. 마케팅 리더, 크리에이티브 디렉터, 이커머스 브랜드 팀에 적합합니다. RunComfy에서는 브라우저와 HTTP API로 모두 이용할 수 있어 모델을 직접 호스팅하거나 확장할 필요가 없습니다.
추천 용도: 전환 중심 광고 크리에이티브 | 제품 히어로 이미지 | 스토리보드 키 프레임

Wan 2.6 Text to Image 모델 개요#


  • 제공업체: Alibaba Cloud
  • 작업: text-to-image
  • 지원 이미지 크기: 1024×1024, 800×1200, 1200×800, 960×1280, 1280×960, 720×1280, 1280×720, 1344×576 px
  • 요약: Wan 2.6 Text to Image는 자연어 프롬프트에서 고품질 이미지를 생성하며, 선택 사항인 참조 이미지로 스타일, 피사체 정체성, 편집 방향을 제어할 수 있습니다. 프롬프트 충실도, 사실적인 질감, 안정적인 구도에 중점을 둔 모델입니다.

Wan 2.6 Text to Image 주요 기능#


Wan 2.6 Text to Image의 참조 이미지 기반 제어#

  • 참조 이미지를 시각적 기준으로 사용하고 프롬프트로 원하는 결과를 구체적으로 설명할 수 있습니다.
  • 여러 번 생성할 때도 캐릭터와 브랜드 요소를 더 일관되게 유지하는 데 도움이 됩니다.

Wan 2.6 Text to Image의 프롬프트 충실한 렌더링#

  • 피사체, 스타일, 조명, 분위기, 구도에 관한 상세 지시를 영어 또는 중국어로 해석합니다.
  • 이커머스, 마케팅, 편집 콘텐츠에 적합한 논리적인 장면 구성과 사실적인 질감을 표현합니다.

Wan 2.6 Text to Image의 텍스트·이미지 워크플로#

  • 텍스트와 참조 이미지를 함께 사용해 변형 이미지를 만들거나 원하는 부분을 수정할 수 있습니다.
  • 네거티브 프롬프트로 원치 않는 물체, 색상, 아티팩트를 제외할 수 있습니다.

Wan 2.6 Text to Image 입력 매개변수#


프롬프트#

매개변수형식기본값/제한설명
promptstring2,000자 미만원하는 이미지의 핵심 설명입니다. 피사체, 스타일, 빛, 분위기, 구도를 구체적으로 작성하세요.
negative_promptstring최대 500자이미지에서 제외할 요소나 특성을 지정합니다.

참조 이미지#

매개변수형식기본값/제한설명
image_urlimage_uri선택 사항; JPEG/JPG/알파 없는 PNG/BMP/WEBP, 각 변 384~5,000px, 최대 10MB스타일, 정체성 또는 편집 방향을 안내하는 참조 이미지입니다.

출력 및 재현성#

매개변수형식기본값/제한설명
image_sizestring기본값: 1024*1024 (1:1); 고정 크기 8개10241024 (1:1), 8001200 (2:3), 1200800 (3:2), 9601280 (3:4), 1280960 (4:3), 7201280 (9:16), 1280720 (16:9), 1344576 (21:9) 중에서 선택합니다.
max_imagesinteger기본값: 1; 범위: 1~5생성 수의 상한입니다. 모델이 반환하는 실제 이미지 수는 설정값보다 적을 수 있습니다.
seedinteger기본값: 0; 범위: 0~2147483647고정 시드를 사용하면 결과를 재현하기가 쉬워집니다.

다른 모델과의 비교#


  • Flux 2 대비: Wan 2.6 Text to Image는 텍스트 생성과 참조 이미지 제어를 하나의 워크플로에 결합합니다. 피사체 정체성과 편집 편의성이 중요할 때 적합합니다. Flux 2 Dev는 현재 RunComfy에서 무료입니다.
  • Z-Image-Turbo 대비: Wan 2.6 Text to Image는 최고 속도보다 복잡한 프롬프트에서의 참조 충실도와 논리적인 구도를 우선합니다.
  • Nano Banana Pro 대비: Wan 2.6 Text to Image는 참조 이미지 제어와 안정적인 편집을 결합해 정체성 중심 캠페인에 적합합니다.
  • 권장 용도: 스타일, 피사체 정체성, 안정적인 편집 과정이 중요한 브랜드 비주얼, 광고, 이커머스 이미지.

API 연동#


Wan 2.6 Text to Image는 표준 HTTP 요청을 통해 RunComfy API에 연동할 수 있습니다. 프롬프트, 선택적 참조 이미지, 출력 크기를 전송해 크리에이티브 워크플로나 CI/CD 파이프라인에서 생성을 자동화하세요.


참고: Wan 2.6 Text to Image API 엔드포인트


공식 자료 및 라이선스#


  • Alibaba Cloud: Wan 2.6 시리즈
  • Alibaba Cloud Model Studio: 모델 목록
  • Wan: 공식 사이트
  • 라이선스: Alibaba Cloud Model Studio를 통해 제공되는 독점 모델입니다. 상업적 사용에는 Alibaba Cloud 약관이 적용되며 지역과 배포 방식에 따라 별도 계약이 필요할 수 있습니다. 무료 사용자에게는 상업용 라이선스가 제공되지 않습니다.

관련 기능#


움직임과 스토리텔링이 필요하면 Wan 2.6 Text to Video를 사용하세요: https://www.runcomfy.com/models/wan-ai/wan-2-6/text-to-video


기존 이미지를 영상으로 만들려면 Wan 2.6 Image to Video를 사용하세요: https://www.runcomfy.com/models/wan-ai/wan-2-6/image-to-video


관련 모델

wan-2.7/pro/text-to-image

WAN 2.7 Pro 텍스트 이미지 모델입니다. 표준 모델과 같은 입력 항목과 한·영 프롬프트를 지원하며, 인쇄물과 대형 비주얼에 적합한 고품질 이미지를 한 번에 최대 5장 생성합니다.

flux-2/lora

텍스트로 이미지를 생성하고 최대 3개의 LoRA 어댑터를 서로 다른 강도로 조합할 수 있습니다.

z-image/turbo/text-to-image/lora

텍스트로 이미지를 만들고 최대 3개의 LoRA 어댑터와 크기, 가중치, 시드를 조절할 수 있습니다.

qwen-edit-2509/lora/multiple-angles

필수 프롬프트에 따라 원본 이미지 한 장의 카메라 각도를 바꾸거나 다른 편집을 적용합니다. 여섯 가지 출력 크기, 추론 단계, 가이던스 스케일, 결과 이미지 1~4장과 JPEG 또는 PNG 출력을 설정할 수 있습니다.

longcat-image/text-to-image

추론 단계, 지침, 시드 및 JPEG, PNG 또는 WebP 출력을 위한 6개의 정확한 크기 사전 설정 및 컨트롤을 사용하여 텍스트에서 이미지를 생성합니다.

qwen-image-layered

정확한 개체 분리와 원활한 디자인 제어를 위해 이미지를 편집 가능한 RGBA 레이어로 변환합니다.

자주 묻는 질문

Wan 2.6 Text to Image의 주요 기능은 무엇인가요?

Wan 2.6 Text to Image는 텍스트 프롬프트에서 고품질 정지 이미지를 생성합니다. 선택 사항인 참조 이미지로 스타일, 피사체 정체성, 구체적인 편집 방향을 세밀하게 제어할 수 있습니다. 프롬프트 충실도, 사실적인 질감, 안정적인 구도에 중점을 둡니다.

Wan 2.6 Text to Image는 Flux 2나 Nano Banana Pro와 어떻게 다른가요?

Wan 2.6 Text to Image는 텍스트 이미지 생성과 참조 이미지 제어를 하나의 워크플로에 결합합니다. 참조 없는 단일 이미지 생성보다 시각적 정체성, 브랜드 요소, 의도한 수정이 중요한 작업에 적합합니다.

Wan 2.6 Text to Image가 지원하는 해상도와 화면 비율은 무엇인가요?

1024×1024(1:1), 800×1200(2:3), 1200×800(3:2), 960×1280(3:4), 1280×960(4:3), 720×1280(9:16), 1280×720(16:9), 1344×576(21:9) 중에서 선택할 수 있습니다. 이 화면에서는 그 밖의 크기나 사용자 지정 치수를 지원하지 않습니다.

Wan 2.6 Text to Image의 입력 제한은 무엇인가요?

프롬프트는 2,000자 미만, 네거티브 프롬프트는 최대 500자입니다. 선택적 참조 이미지는 JPEG, JPG, 알파 채널 없는 PNG, BMP, WEBP 형식이어야 하며 각 변은 384~5,000픽셀, 파일은 최대 10MB여야 합니다.

RunComfy 테스트에서 프로덕션 API 사용으로 전환하려면 어떻게 하나요?

RunComfy 모델 화면에서 테스트한 뒤 API 키로 Wan 2.6 Text to Image API 엔드포인트의 동일한 흐름을 호출할 수 있습니다. HTTP로 프롬프트, 선택적 참조 이미지, 출력 크기를 전송하세요. 이 페이지의 표시 가격은 이미지당 $0.015이며, 호출 전에 계정 크레딧을 확인해야 합니다.

Wan 2.6 Text to Image는 시각적 정체성을 어떻게 유지하나요?

선택적 참조 이미지가 피사체 특징과 스타일을 제시하고 프롬프트가 원하는 장면을 설명합니다. 같은 참조와 명확한 지시를 사용하면 일관성을 높일 수 있지만, 매번 완전히 동일한 결과를 보장하지는 않습니다.

Wan 2.6 Text to Image는 오디오나 영상도 생성하나요?

아니요. 이 모델은 정지 이미지만 생성합니다. 영상에는 Wan 2.6 Text to Video 또는 Wan 2.6 Image to Video를 사용하세요. 오디오 동기화나 립싱크는 이 텍스트 이미지 엔드포인트의 기능이 아닙니다.

Wan 2.6 Text to Image 결과물을 상업적으로 사용할 수 있나요?

이 모델에는 Alibaba Cloud Model Studio의 이용 약관이 적용됩니다. 상업적 사용 가능 여부는 해당 약관, 지역, 계약에 따라 달라집니다. 모델 페이지에 따르면 무료 사용자에게는 상업용 라이선스가 제공되지 않습니다. 게시 전에 최신 조건을 확인하세요.

Wan 2.6 Text to Image로 일관된 이미지를 여러 장 생성할 수 있나요?

max_images로 1~5장의 상한을 설정할 수 있지만 실제 출력 수는 더 적을 수 있습니다. 0~2147483647 범위의 고정 seed를 사용하면 결과를 재현하기 쉬워지지만, 모든 이미지가 픽셀 단위로 동일하다고 보장되지는 않습니다.

Wan 2.6 Text to Image는 모바일 및 소셜 미디어 형식에 적합한가요?

네. 세로 콘텐츠에는 720×1280(9:16), 800×1200(2:3), 960×1280(3:4)을 사용할 수 있습니다. 정사각형이나 가로형 에셋에는 1:1, 4:3, 3:2, 16:9, 21:9를 선택할 수 있습니다.

팔로우하기
  • 링크드인
  • 페이스북
  • Instagram
  • 트위터
지원
  • 디스코드
  • 이메일
  • 시스템 상태
  • 제휴사
비디오 모델
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 모든 모델 보기 →
이미지 모델
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 모든 모델 보기 →
법적 고지
  • 서비스 약관
  • 개인정보 보호정책
  • 쿠키 정책
RunComfy
저작권 2026 RunComfy. All Rights Reserved.

RunComfy는 최고의 ComfyUI 플랫폼으로서 ComfyUI 온라인 환경과 서비스를 제공하며 ComfyUI 워크플로우 멋진 비주얼을 제공합니다. RunComfy는 또한 제공합니다 AI Models, 예술가들이 최신 AI 도구를 활용하여 놀라운 예술을 창조할 수 있도록 지원합니다.

Wan 2.6 Text to Image 생성 예시