logo
RunComfy
  • ComfyUI
  • 트레이너신규
  • 모델
  • API
  • 가격
discord logo
모델
탐색
모든 모델
라이브러리
생성 기록
모델 API
API 문서
API 키
계정
사용량

Wan 3.0: 이미지-비디오, 첫 번째 마지막 프레임, Models and API의 오디오 | RunComfy

wan-ai/wan-3.0/image-to-video

Wan 3.0는 선택적 마지막 프레임 제어, 유연한 지속 시간, 종횡비 및 세련된 짧은 클립을 위한 오디오를 사용하여 첫 번째 프레임 이미지를 일관된 비디오로 애니메이션화합니다.

첫 번째 프레임에 애니메이션을 적용할 동작, 액션, 카메라 움직임, 조명, 스타일을 설명하세요.
모델이 비디오로 애니메이션화되는 첫 번째 프레임 이미지입니다. 더 나은 피사체 보존을 위해 선명한 고품질 이미지를 사용하세요.
비디오의 엔딩 포즈, 구성 또는 장면을 안내하는 데 사용되는 선택적 마지막 프레임 이미지입니다.
출력 해상도 계층. 빠른 초안을 작성하려면 480p을 사용하고 고품질 출력을 위해서는 1080p을 사용하세요.
출력 종횡비. 입력 이미지 비율을 일치시키려면 adaptive을 사용하세요.
생성된 비디오의 길이(초)입니다. 범위는 2~30입니다. 반복을 위해 짧게 시작한 다음 동작이 올바르게 보이면 늘리십시오.
다양한 움직임이나 구성 요구 사항이 있는 복잡한 장면에 대해 보다 심층적이고 즉각적인 해석을 지원합니다.
켜져 있으면 출력 비디오에 동기화된 오디오 트랙이 포함됩니다. 무음 클립의 경우 끄십시오.
재현 가능한 결과를 위한 무작위 시드입니다. 범위는 0~2147483647입니다.
Idle
The rate is $0.06 per second for 480p, $0.12 per second for 720p, and $0.25 per second for 1080p.

Wan 3.0 소개

Wan 3.0 이미지-비디오는 선택적인 마지막 프레임 안내, 2~30초 지속 시간, 종횡비 제어 및 동기화된 오디오를 통해 단일 첫 번째 프레임 이미지를 영화 클립으로 생생하게 구현합니다. 피사체와 장면의 일관성을 유지하는 신속한 구동 모션을 위해 느린 수동 키프레임을 사용하면 제품 마케팅 담당자, 인물 사진 및 라이프스타일 제작자, 짧은 클립을 빠르게 전달하는 소셜 팀에 적합합니다. 개발자의 경우 RunComfy의 Wan 3.0을 브라우저와 HTTP API을 통해 모두 사용할 수 있으므로 모델을 직접 호스팅하거나 확장할 필요가 없습니다.
이상적인 대상: 제품 및 마케팅 클립 | 초상화 애니메이션 | 수직 소셜 비디오

Wan 3.0을 선택하는 이유#


Wan 3.0은 텍스트, 이미지, 비디오, 오디오, 파일 및 웹 페이지를 동기화된 사운드와 함께 일관된 클립으로 변환하는 Wan-AI의 올인원 비디오 생성 모델입니다. 이 페이지에서는 Wan 3.0 Image to Video을 제공합니다. 첫 번째 프레임 이미지와 프롬프트를 제공하고 해당 프레임을 2~30초 길이의 클립으로 애니메이션화하며 선택적인 마지막 프레임을 사용하여 샷이 끝나는 방식을 고정합니다. 동일한 기본 모델은 텍스트-비디오 및 비디오 참조도 실행하므로 여기서 개발한 룩은 전체 제품군에 걸쳐 전송됩니다.


Wan 3.0 장점그것이 당신에게 의미하는 것
하나의 모델, 많은 입력Wan 3.0은 텍스트, 첫 번째/마지막 프레임 이미지, 참조 이미지, 비디오, 오디오, 문서 및 링크를 처리하므로 아이디어 간에 도구를 전환할 필요가 거의 없습니다.
첫 번째 및 마지막 프레임 제어이 페이지에서는 시작 프레임과 종료 프레임을 모두 설정할 수 있으므로 Wan 3.0이 첫 번째 프레임 전용 애니메이션보다 샷이 시작되고 해결되는 방식을 더욱 엄격하게 제어할 수 있습니다.
유연한 2~30초 출력Wan 3.0는 짧은 초안이나 긴 싱글 테이크를 렌더링하므로 빠른 반복과 완성된 샷이 동일한 끝점에서 나옵니다.
동기화된 오디오, 선택 사항모든 Wan 3.0 결과에는 일치하는 오디오 트랙이 포함되거나 무성 클립을 내보낼 수 있습니다. 오디오를 전환해도 가격은 변경되지 않습니다.

최고의 사용 사례#


  • 제품 및 마케팅 동영상: Wan 3.0를 사용하여 제품이나 팩샷을 제어된 모션과 프레임을 갖춘 짧은 홍보 클립으로 전환하세요.
  • 인물 사진 및 라이프스타일 애니메이션: Wan 3.0에서 인물 사진, 패션, 라이프스타일을 브랜드에 담긴 자연스러운 순간으로 애니메이션화해 보세요.
  • 소셜 미디어 콘텐츠: 릴, 단편, 스토리 또는 피드 배치를 위해 단일 이미지에서 세로, 정사각형 또는 와이드스크린 Wan 3.0 클립을 생성합니다.
  • 창의적인 프로토타이핑: 전체 제작 과정을 시작하기 전에 Wan 3.0를 사용하여 고정 프레임에서 카메라 방향, 동작 및 시각적 스타일을 테스트합니다.

작동 방식#


  1. 오프닝 프레임 설정: Wan 3.0에 생기를 불어넣을 깨끗한 고해상도 첫 프레임 이미지를 업로드하세요.
  2. 동작 설명: Wan 3.0에게 무엇이 움직이는지, 카메라가 어떻게 움직이는지, 시간이 지남에 따라 빛과 장면이 어떻게 전개되는지 알려주세요.
  3. 엔딩 안내(선택 사항): 최종 포즈, 구성 또는 장면이 중요할 때 마지막 프레임 이미지를 추가하면 Wan 3.0가 두 이미지를 연결합니다.
  4. 전달 형식 선택: 해상도, 화면비, 2~30초 지속 시간, 오디오 생성 여부를 선택한 다음 Wan 3.0 결과를 검토하고 한 번에 하나의 지침을 구체화합니다.

매개변수#


첫 번째 표에는 이 페이지의 Wan 3.0 Image to Video 도구에 의해 노출된 컨트롤이 나열되어 있습니다.


매개변수필수유형기본값범위 / 옵션선택 방법
프롬프트*예(*)문자열예시 프롬프트최대 20,000자피사체, 움직임, 카메라 움직임, 조명 및 스타일을 설명합니다. 명확한 구조는 길이보다 더 중요합니다.
`image_url*예(*)문자열예시 이미지이미지 URL 또는 Base64첫 번째 프레임 Wan 3.0에서 애니메이션이 적용됩니다. 최상의 피사체 보존을 위해 선명하고 조명이 밝으며 깔끔한 이미지를 사용하십시오.
`end_image_url아니요문자열비어 있음이미지 URL 또는 Base64선택적 마지막 프레임입니다. 엔딩 포즈나 구도가 정해졌을 때 설정하세요.
'해상도'아니요문자열`720p480p, 720p, 1080p빠른 초안을 작성하려면 480p을 사용하고 더 자세한 내용을 전달하려면 1080p을 사용하세요.
`aspect_ratio아니요문자열`adaptiveadaptive, 16:9, 9:16, 1:1, 4:3, 3:4입력 이미지를 따르려면 adaptive을 그대로 두거나 특정 배치에 대한 비율을 강제로 적용하세요.
기간아니요정수52~30초모션을 다듬는 동안 짧게 유지하고 방향이 확정되면 올립니다.
`thinking_mode아니요부울'거짓'참 / 거짓여러 동작이나 구성 규칙을 결합하는 복잡한 프롬프트를 활성화합니다.
`enable_audio아니요부울'사실'참 / 거짓동기화된 오디오 트랙을 계속 사용하세요. 조용한 클립을 위해 끄십시오.
'씨앗'아니요정수무작위0-2147483647작고 유사한 편집을 수행하는 동안 결과를 재현하기 위해 시드를 수정합니다.

  • 필수항목입니다.

다음 표에는 더 넓은 Wan 3.0 모델이 요약되어 있습니다. 참조, 문서 및 텍스트 전용 입력은 이 이미지-비디오 페이지의 컨트롤이 아닌 모델의 다른 모드 및 형제 도구를 통해 사용할 수 있습니다.


핵심 차원Wan 3.0
모델`wan3.0-video
세대 모드텍스트-비디오; 이미지-비디오(첫 번째 프레임 또는 첫 번째 + 마지막 프레임); 이미지, 비디오 및 오디오의 비디오 참조; 게다가 문서 및 웹 링크 참조.
출력 기간2~30초. 비디오 입력의 경우 입력과 출력이 30초 이내에 유지됩니다. 스마트 기간 옵션을 사용하면 Wan 3.0에서 길이를 추천할 수 있습니다.
해상도480P, 720P 또는 1080P.
출력 종횡비adaptive(입력에서 권장) 또는 16:9, 4:3, 1:1, 3:4, 9:16.
오디오 출력사진과 함께 생성되고 기본적으로 켜져 있는 선택적 동기화 오디오.
첫 번째/마지막 프레임 입력최대 1개의 first_frame 및 1개의 last_frame. 이미지: JPEG, JPG, PNG, BMP 또는 WEBP; 측면당 '240~8000' 픽셀; 종횡비 최대 '8:1'; 각각 최대 20MB.
참고 이미지피사체, 객체 또는 장면 일관성을 위한 최대 10개의 참조 이미지.
참고 동영상최대 5개의 클립; MP4 또는 MOV; 각각 1~15초; 최대 15초의 영상 결합; 측면당 '240~4096' 픽셀; 클립당 최대 100MB.
참조 오디오최대 5개의 클립; WAV 또는 MP3; 최대 15초의 오디오 결합; 각각 최대 15MB.
문서/웹 입력문서 1개(DOCX, PDF, PPTX, XLSX, TXT 등 최대 50페이지) 또는 공개 웹 링크 1개.
모드 독점첫 번째/마지막 프레임 입력은 동일한 요청의 참조, 문서 또는 링크 입력과 결합될 수 없습니다.
프롬프트 제한최대 20,000자입니다.

가격#


Wan 3.0 가격은 선택한 해결 방법과 생성 기간에 따라 달라집니다. Wan 3.0 오디오를 활성화하거나 비활성화해도 속도는 변경되지 않습니다.


해결초당 가격5초10대30대
480p$0.06$0.30$0.60$1.80
720p$0.12$0.60$1.20$3.60
1080p$0.25$1.25$2.50$7.50

1~4개 출력 배치의 경우 '기간 × 초당 속도 × 출력 횟수'로 총계를 계산합니다.


프롬프트 및 참조 팁#


재사용 가능한 Wan 3.0 구조를 사용하세요.


[주제 + 세부 사항 정의] + [시간에 따른 하나의 동작] + [카메라 프레이밍 및 움직임] + [설정 + 조명] + [시각적 처리] + [오디오] + [엔딩 프레임 또는 제약 조건]


  • 주제 제시: 첫 번째 프레임에 포함된 내용을 지정한 다음 Wan 3.0이 이를 어떻게 움직여야 하는지 설명합니다.
  • 피사체와 카메라 분리: 더 깨끗한 Wan 3.0 결과를 위해 피사체 움직임과 카메라 움직임을 독립적으로 설명합니다.
  • 선명한 첫 번째 프레임 사용: 입력의 흐림, 혼란 또는 낮은 해상도가 비디오에 전달됩니다.
  • 엔딩 고정: 특정 최종 포즈나 구성이 협상 불가능할 때 마지막 프레임 이미지에 도달합니다.
  • 사고 모드 켜기: Wan 3.0 샷이 여러 동작 또는 구성 규칙을 레이어할 때 활성화합니다.
  • 시드 수정: 작은 프롬프트 편집 내용을 공정하게 비교할 수 있도록 테이크가 올바르게 보이면 시드를 잠급니다.

Wan 3.0 비교 방법#


이 Wan 3.0 비교를 모델 제품군 가이드로 사용하세요. 최대 해상도와 지속 시간은 함께 사용할 수 없으며, 도구마다 다른 입력 및 컨트롤이 노출될 수 있습니다. 공개적으로 이용 가능한 정보를 기반으로 합니다.


모델해결최대 기간오디오눈에 띄는
Wan 3.0480p–1080p30대선택적 동기화 오디오텍스트, 첫 번째/마지막 프레임, 이미지, 비디오, 오디오의 비디오 참조, 문서 및 웹 입력을 포괄하는 하나의 올인원 모델입니다.
클링 3.0최대 4K15초립싱크가 포함된 네이티브 오디오대본이 있는 광고와 캐릭터 장면에 대해 다중 촬영 카메라 변경과 화자가 할당한 대화를 조정합니다.
하이뤄 021080p~10초없음조용한 액션과 제품 촬영을 위한 물리학 중심의 모션과 강력하고 신속한 준수.
시던스 2.51080p30대공동 오디오 및 비디오신원에 민감한 편집을 위해 동기화된 음성 및 효과를 갖춘 참조가 많은 생성입니다.
베오 3.14K8초네이티브 대화 및 효과영화 전환 및 조합된 시퀀스에 적합한 첫 번째/마지막 프레임 및 참조 컨트롤입니다.

Wan 3.0을 차별화하는 것은 폭입니다. 첫 번째 프레임에 애니메이션을 적용하고 마지막 프레임을 존중하며 이미지, 비디오, 오디오, 문서 및 링크에서 가져올 수 있는 단일 모델이며 선택적으로 동기화된 사운드를 생성합니다. 생기를 불어넣을 시작 프레임이 있으면 Wan 3.0 Image to Video을 선택하고, 시작점이 변경되면 텍스트 또는 참조 도구로 이동하세요.


더 많은 모델을 사용해 보세요#


  • Wan 3.0 텍스트를 비디오로: 시작 이미지가 없는 경우 프롬프트에서만 클립을 생성합니다.
  • Wan 3.0 비디오 참조: 캐릭터 및 개체 일관성을 위해 이미지, 비디오 및 오디오 참조를 결합합니다.
  • Seedance 2.5 Text to Video: 텍스트에서 빠르고 저렴한 초안 렌더링을 생성합니다.
  • Kling 3.0: 선택적인 종료 프레임과 동기화된 오디오를 사용하여 시작 이미지에 애니메이션을 적용합니다.

공식 리소스#


  • Wan 3.0 비디오 생성 API 참조(Alibaba Cloud Model Studio)
  • 완 모델 패밀리 개요

관련 모델

sync/lipsync/v2

필수 동영상 URL과 오디오 URL로 립싱크 동영상을 만듭니다. `lipsync-2` 또는 `lipsync-2-pro`를 선택할 수 있으며 Pro는 같은 길이 기준으로 비용이 약 1.67배입니다. 입력 길이가 다를 때는 다섯 가지 동기화 모드를 선택할 수 있습니다.

kling-3.0/4k/image-to-video

정지 이미지를 네이티브 4K 시네마틱 영상으로 구현합니다. 시작 이미지는 필수이며 종료 이미지는 선택 사항이고, 동기화 오디오를 지원합니다.

wan-2-6/video-to-video

영상 길이, 출력 크기, 장면 구조, 시드, 네거티브 프롬프트 및 오디오 생성에 대한 제어 기능을 사용하여 텍스트 프롬프트와 1~3개의 참조 클립에서 동영상을 만듭니다.

kling-video-o3/4K/image-to-video

이미지 1장으로 영화 같은 4K 영상을 생성하며 출력 1초당 $0.42입니다.

sora-2/pro/text-to-video

Sora 2 Pro로 텍스트 프롬프트에서 동영상을 만들고 출력 크기와 길이를 선택합니다.

video-background-removal/green-screen

영상 배경을 분리하고 후반 작업에 맞게 코덱과 색 번짐 억제를 조절하세요.

자주 묻는 질문

이미지-비디오 작업 흐름에서 Wan 3.0은 무엇에 사용됩니까?

Wan 3.0 이미지-비디오는 단일 첫 번째 프레임 이미지를 가져와 텍스트 프롬프트에 따라 짧고 일관된 클립으로 애니메이션을 적용합니다. 리깅이나 수동 키프레임 없이 제품 사진, 인물 사진, 라이프스타일 사진 또는 컨셉 아트를 모션으로 전환하는 데 적합합니다.

Wan 3.0의 첫 번째 및 마지막 프레임 옵션은 어떻게 작동하나요?

항상 첫 번째 프레임 이미지를 제공하고, 종료 포즈나 구성이 중요한 경우 선택적으로 마지막 프레임 이미지를 추가할 수 있습니다. 그런 다음 Wan 3.0은 첫 번째 프레임에서 시작하여 마지막 프레임을 향해 해결되는 연속 모션을 생성하여 샷의 시작과 종료 방식을 더욱 세밀하게 제어할 수 있습니다.

Wan 3.0은 입력 이미지에서 피사체를 얼마나 잘 보존합니까?

첫 번째 프레임이 비디오의 오프닝으로 직접 사용되기 때문에 Wan 3.0은 클립 전체에서 피사체의 모습과 프레임을 일관되게 유지하는 경향이 있습니다. 선명하고 조명이 밝으며 정돈된 입력 이미지를 사용하면 피사체가 가장 잘 보존됩니다.

Wan 3.0 이미지-비디오는 어떤 해상도, 지속 시간 및 화면 비율을 지원합니까?

Wan 3.0는 480p, 720p 및 1080p 출력을 지원하며 720p은 공통 기본값입니다. 지속 시간은 2~30초 범위에서 조정 가능하며 화면 비율은 와이드스크린, 수직, 정사각형 또는 클래식으로 설정하거나 adaptive로 설정하여 입력 이미지를 따라갈 수 있습니다. 정확한 전류 제한은 RunComfy 매개변수 패널을 확인하세요.

Wan 3.0에서 비디오와 함께 오디오를 생성할 수 있나요?

예. Wan 3.0은 클립과 함께 동기화된 오디오 트랙을 생성할 수 있으며, 무성 영상만 필요한 경우 오디오를 끌 수 있습니다. 오디오를 전환해도 생성 비용은 변경되지 않습니다.

Wan 3.0을 사용하기 전에 어떤 입력 제한을 알아야 합니까?

입력 이미지는 JPEG, PNG 또는 WEBP와 같은 일반적인 형식이어야 하며 적절한 해상도와 종횡비가 있어야 합니다. 품질이 매우 낮거나 프레임이 너무 복잡하면 모션 품질이 저하될 수 있으므로 깨끗하고 해상도가 높은 첫 번째 프레임을 선호하세요. 한도는 공급자 설정에 따라 다를 수 있습니다.

개발자가 RunComfy API를 통해 Wan 3.0을 사용할 수 있나요?

예. RunComfy 모델 UI에서 Wan 3.0의 프로토타입을 만든 다음 생산 또는 자동화를 위해 동일한 매개변수를 사용하여 RunComfy HTTP API을 통해 동일한 모델을 호출할 수 있습니다. 이를 통해 모델을 변경하지 않고도 브라우저 테스트에서 통합 파이프라인으로 이동할 수 있습니다.

RunComfy에서 Wan 3.0로 생성하는 데 비용이 얼마나 드나요?

세대는 출력 해상도 및 기간에 따라 USD 또는 크레딧을 소비합니다. 480p에서는 초당 $0.06, 720p에서는 초당 $0.12, 1080p에서는 초당 $0.25입니다. 신규 사용자는 일반적으로 대규모 실행을 시작하기 전에 Wan 3.0을 사용해 볼 수 있는 무료 평가판을 받습니다.

팔로우하기
  • 링크드인
  • 페이스북
  • Instagram
  • 트위터
지원
  • 디스코드
  • 이메일
  • 시스템 상태
  • 제휴사
비디오 모델
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 모든 모델 보기 →
이미지 모델
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 모든 모델 보기 →
법적 고지
  • 서비스 약관
  • 개인정보 보호정책
  • 쿠키 정책
RunComfy
저작권 2026 RunComfy. All Rights Reserved.

RunComfy는 최고의 ComfyUI 플랫폼으로서 ComfyUI 온라인 환경과 서비스를 제공하며 ComfyUI 워크플로우 멋진 비주얼을 제공합니다. RunComfy는 또한 제공합니다 AI Models, 예술가들이 최신 AI 도구를 활용하여 놀라운 예술을 창조할 수 있도록 지원합니다.

Wan 3.0의 예

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...