원래 스타일을 유지하며 오디오 트랙의 앞, 뒤 또는 양쪽을 연장합니다.
live avatar generator는 오디오로 인물 사진 한 장을 움직이도록 설계된 모델입니다. 인물의 정체성, 얼굴 구조, 구도를 유지하면서 자연스럽고 일관된 말하기 영상을 생성합니다. 정확한 립싱크, 섬세한 표정 변화, 안정적인 움직임 덕분에 다양한 목소리와 연출 방식으로 반복 제작하기 좋습니다.
주요 기능
image_url에 인물 이미지, audio_url에 WAV 또는 MP3 오디오를 지정한 뒤 원하는 표정, 말하는 속도감, 움직임 범위를 간결한 프롬프트로 설명하세요. num_clips를 하나 늘릴 때마다 길이가 약 3초 증가합니다. frames_per_clip은 움직임의 부드러움을 조절하며 4의 배수여야 합니다. 프롬프트를 더 엄격하게 따르게 하려면 guidance_scale을 조금씩 높이고, 비슷한 결과를 재현하려면 seed를 다시 사용하세요. 시선과 얼굴 형태를 안정적으로 유지하려면 얼굴이 중앙에 있는 선명한 정면 사진과 단순한 배경을 사용하세요.
예시:
활용 팁:
원래 스타일을 유지하며 오디오 트랙의 앞, 뒤 또는 양쪽을 연장합니다.
Google Veo 3로 텍스트 프롬프트에 따라 동영상을 생성하고 오디오 생성 여부를 선택합니다.
다중 참조와 프레임 제어를 활용해 1080p 영상을 생성합니다.
참조 이미지 1장으로 5초 또는 10초 영상을 만들고, 네거티브 프롬프트와 네이티브 오디오 생성을 선택적으로 설정할 수 있습니다.
시작 이미지를 텍스트로 움직이고 화면비, 해상도, 길이, 스타일, 오디오, 여러 클립을 설정하세요.
고급 음향 및 장면 제어로 이미지를 영화 같은 영상으로 변환하는 AI 생성기
live avatar generator는 정지 인물 사진 한 장, WAV 또는 MP3 오디오, 프롬프트를 결합해 영상을 생성합니다. 입력 음성에 맞춰 얼굴과 입을 움직이고, 프롬프트로 표정, 속도감, 움직임의 크기를 조절합니다.
본격적인 촬영 없이 말하기 영상을 만들려는 콘텐츠 제작자, 교육자, 마케팅 담당자, 제품 팀에 적합합니다. AI 대변인, 강의, 제품 설명, 고객용 아바타 등에 활용할 수 있습니다.
RunComfy에서는 생성 시 크레딧을 사용합니다. 이용 가능한 체험 크레딧과 현재 설정에 필요한 크레딧은 RunComfy 화면에 표시되므로 실행 전에 확인할 수 있습니다.
num_clips는 약 3초 단위로 대략적인 길이를 정합니다. frames_per_clip은 움직임의 부드러움을 조절하며 4의 배수여야 합니다. guidance_scale은 프롬프트 준수도, seed는 결과 재현성에 영향을 줍니다.
유효한 image_url, WAV 또는 MP3 오디오를 가리키는 유효한 audio_url, 프롬프트가 필요합니다. 출력은 말하기 영상입니다. 해상도는 서비스에서 결정하며 입력 항목으로 제공되지 않습니다.
이 엔드포인트는 한 번에 인물 사진 한 장과 오디오 한 개를 처리합니다. 여러 인물의 대화를 만들려면 화자별로 영상을 생성한 뒤 편집 도구에서 합치세요.
얼굴이 중앙에 있는 선명한 정면 사진, 단순한 배경, 잡음이 적은 오디오를 사용하고, 원하는 표정과 움직임을 간결한 프롬프트로 설명하세요. 조건을 너무 많이 넣지 말고 guidance_scale을 조금씩 조절하는 것이 좋습니다.
얼굴 애니메이션과 말하기 장면에 최적화되어 있어 전신 동작이나 큰 제스처가 중심인 장면에는 덜 적합합니다. 영상이 길수록 드리프트가 생기기 쉬우므로 선명한 입력 자료와 적절한 클립 설정을 사용하세요.
RunComfy 브라우저 화면에서 실행하거나 HTTP API로 연동할 수 있습니다. 작업은 클라우드에서 처리되므로 모델을 로컬에 설치하거나 직접 운영할 필요가 없습니다.
RunComfy는 최고의 ComfyUI 플랫폼으로서 ComfyUI 온라인 환경과 서비스를 제공하며 ComfyUI 워크플로우 멋진 비주얼을 제공합니다. RunComfy는 또한 제공합니다 AI Models, 예술가들이 최신 AI 도구를 활용하여 놀라운 예술을 창조할 수 있도록 지원합니다.