logo
RunComfy
  • ComfyUI
  • 트레이너신규
  • 모델
  • API
  • 가격
discord logo
모델
탐색
모든 모델
라이브러리
생성 기록
모델 API
API 문서
API 키
계정
사용량

Wan 2.2 S2V 음성 기반 영상 생성 | RunComfy

wan-ai/wan-2-2/speech-to-video

이미지 한 장과 음성 파일 하나를 결합해 말하기, 노래, 퍼포먼스 영상을 480P 또는 720P로 생성합니다.

필수 JPG, JPEG, PNG, BMP, WEBP 이미지입니다. 너비와 높이는 각각 400픽셀보다 크고 7000픽셀 이하여야 합니다.
0:00
0:00
길이 20초 미만, 용량 15MB 미만인 필수 WAV 또는 MP3 파일입니다.
speech, sing, perform 중에서 선택합니다. 기본값은 speech입니다.
480P 또는 720P를 선택합니다. 기본값은 480P입니다.
Idle
The rate is $0.10 per second for 480P, and $0.20 per second for 720P.

Wan 2.2 S2V 개요

Wan 2.2 S2V는 필수 정지 이미지와 필수 음성 트랙으로 인물 영상을 만듭니다. 녹음 내용에 맞게 speech, sing, perform 중 하나를 고르고 480P 또는 720P 해상도를 선택합니다. 이미지와 음성에는 형식, 크기, 길이, 파일 용량 제한이 적용됩니다.

Wan 2.2 S2V 기능

이미지와 음성으로 생성

텍스트 프롬프트 없이 필수 이미지 한 장과 음성 파일 하나로 영상을 만듭니다.

음성 기반 인물 움직임

녹음을 바탕으로 인물 영상을 움직이며 말하기, 노래, 폭넓은 퍼포먼스에 맞는 모드를 선택할 수 있습니다.

세 가지 퍼포먼스 모드

대화에는 speech, 노래에는 sing, 그 밖의 연기에는 perform을 선택합니다. 기본값은 speech입니다.

두 가지 출력 해상도

기본 480P로 생성하거나 더 높은 출력 해상도가 필요할 때 720P를 선택합니다.

X에서 보는 Wan 2.2 S2V 소식과 예시

관련 모델

seedance-2.5/text-to-video/4k

Seedance 2.5 4K Text to Video: 4K 영화 클립에 대한 프롬프트

pixverse/v5.5/effects

필수 원본 이미지에 48개 효과 프리셋 중 하나를 적용하고 해상도, 길이, 네거티브 프롬프트, 최적화를 설정합니다.

sora-2/image-to-video

이미지에서 자연스러운 영상과 실시간 오디오를 생성하는 AI 영상 제작 툴

ltx-2/fast/text-to-video

텍스트 프롬프트로 16:9 동영상을 만들고 길이, 해상도, 프레임률, 오디오 생성 여부를 선택합니다.

ltx-2-19b/text-to-video/lora

프롬프트에서 정밀한 오디오 동기화와 LoRA 스타일 제어를 갖춘 모션 클립을 생성합니다.

sora-2/text-to-video

필수 텍스트 프롬프트로 오디오가 동기화된 동영상을 생성합니다. 출력 크기는 `1280x720` 또는 `720x1280`, 길이는 `4`, `8`, `12`초 중에서 선택할 수 있습니다.

자주 묻는 질문

Wan 2.2 S2V에 필요한 입력은 무엇인가요?

이미지 한 장과 음성 파일 하나가 필요합니다. 이 화면에는 텍스트 프롬프트 입력이 없습니다.

어떤 이미지 형식을 지원하나요?

JPG, JPEG, PNG, BMP, WEBP를 지원합니다. 너비와 높이는 각각 400픽셀보다 크고 7000픽셀 이하여야 합니다.

음성 파일 조건은 무엇인가요?

20초 미만의 WAV 또는 MP3를 사용하세요. 파일 용량은 15MB 미만이어야 합니다.

어떤 퍼포먼스 모드를 선택할 수 있나요?

speech, sing, perform 중에서 선택할 수 있습니다. 기본값은 speech입니다.

어떤 해상도로 생성할 수 있나요?

480P 또는 720P를 선택합니다. 기본값은 480P입니다.

생성 비용은 얼마인가요?

5초 영상 생성에는 68 크레딧이 필요합니다.

speech, sing, perform은 언제 사용하나요?

대화에는 speech, 노래에는 sing, 말하기나 노래에 한정되지 않은 폭넓은 연기에는 perform을 선택하세요.

업로드가 거부될 때 무엇을 확인해야 하나요?

지원 형식과 제한을 확인하세요. 이미지는 크기 조건을, 음성은 형식, 길이, 파일 용량 조건을 모두 충족해야 합니다.

Wan 2.2 S2V는 일괄 생성을 지원하나요?

네. 배치 크기는 1, 2, 3, 4를 지원합니다.

퍼포먼스 모드에 따라 이미지나 음성 조건이 달라지나요?

아니요. speech, sing, perform 모두 같은 형식, 크기, 길이, 파일 용량 제한이 적용됩니다.

팔로우하기
  • 링크드인
  • 페이스북
  • Instagram
  • 트위터
지원
  • 디스코드
  • 이메일
  • 시스템 상태
  • 제휴사
비디오 모델
  • PixVerse V6
  • PixVerse V6 Text To Video
  • PixVerse C1
  • Wan 2.6 Flash
  • Wan 2.5
  • Wan 3.0
  • 모든 모델 보기 →
이미지 모델
  • Qwen Image 2.1
  • Qwen Image 2.1 T2I
  • Wan 2.6 Image to Image
  • Seedream 5.0 Pro
  • Nano Banana Pro
  • Flux 2 Pro
  • 모든 모델 보기 →
법적 고지
  • 서비스 약관
  • 개인정보 보호정책
  • 쿠키 정책
RunComfy
저작권 2026 RunComfy. All Rights Reserved.

RunComfy는 최고의 ComfyUI 플랫폼으로서 ComfyUI 온라인 환경과 서비스를 제공하며 ComfyUI 워크플로우 멋진 비주얼을 제공합니다. RunComfy는 또한 제공합니다 AI Models, 예술가들이 최신 AI 도구를 활용하여 놀라운 예술을 창조할 수 있도록 지원합니다.

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...