텍스트로 짧은 영상을 만들고 길이, 화면비, 오디오 생성 여부를 설정하세요.
live avatar generator는 오디오로 인물 사진 한 장을 움직이도록 설계된 모델입니다. 인물의 정체성, 얼굴 구조, 구도를 유지하면서 자연스럽고 일관된 말하기 영상을 생성합니다. 정확한 립싱크, 섬세한 표정 변화, 안정적인 움직임 덕분에 다양한 목소리와 연출 방식으로 반복 제작하기 좋습니다.
주요 기능
image_url에 인물 이미지, audio_url에 WAV 또는 MP3 오디오를 지정한 뒤 원하는 표정, 말하는 속도감, 움직임 범위를 간결한 프롬프트로 설명하세요. num_clips를 하나 늘릴 때마다 길이가 약 3초 증가합니다. frames_per_clip은 움직임의 부드러움을 조절하며 4의 배수여야 합니다. 프롬프트를 더 엄격하게 따르게 하려면 guidance_scale을 조금씩 높이고, 비슷한 결과를 재현하려면 seed를 다시 사용하세요. 시선과 얼굴 형태를 안정적으로 유지하려면 얼굴이 중앙에 있는 선명한 정면 사진과 단순한 배경을 사용하세요.
예시:
활용 팁:
텍스트로 짧은 영상을 만들고 길이, 화면비, 오디오 생성 여부를 설정하세요.
사실감 넘치는 동작, 정밀한 카메라 제어, 몰입형 시뮬레이션
이미지 한 장으로 역동적인 AI 영상을 만들어내는 혁신적인 도구
원본 동영상을 선택한 해상도와 프레임률로 업스케일합니다.
단 한 장의 이미지로 부드럽고 생생한 영상과 오디오를 손쉽게 제작해보세요
LTX 2.5 Fast 최대 4K까지 동기화된 AV 초안을 갖춘 텍스트-비디오
live avatar generator는 정지 인물 사진 한 장, WAV 또는 MP3 오디오, 프롬프트를 결합해 영상을 생성합니다. 입력 음성에 맞춰 얼굴과 입을 움직이고, 프롬프트로 표정, 속도감, 움직임의 크기를 조절합니다.
본격적인 촬영 없이 말하기 영상을 만들려는 콘텐츠 제작자, 교육자, 마케팅 담당자, 제품 팀에 적합합니다. AI 대변인, 강의, 제품 설명, 고객용 아바타 등에 활용할 수 있습니다.
RunComfy에서는 생성 시 크레딧을 사용합니다. 이용 가능한 체험 크레딧과 현재 설정에 필요한 크레딧은 RunComfy 화면에 표시되므로 실행 전에 확인할 수 있습니다.
num_clips는 약 3초 단위로 대략적인 길이를 정합니다. frames_per_clip은 움직임의 부드러움을 조절하며 4의 배수여야 합니다. guidance_scale은 프롬프트 준수도, seed는 결과 재현성에 영향을 줍니다.
유효한 image_url, WAV 또는 MP3 오디오를 가리키는 유효한 audio_url, 프롬프트가 필요합니다. 출력은 말하기 영상입니다. 해상도는 서비스에서 결정하며 입력 항목으로 제공되지 않습니다.
이 엔드포인트는 한 번에 인물 사진 한 장과 오디오 한 개를 처리합니다. 여러 인물의 대화를 만들려면 화자별로 영상을 생성한 뒤 편집 도구에서 합치세요.
얼굴이 중앙에 있는 선명한 정면 사진, 단순한 배경, 잡음이 적은 오디오를 사용하고, 원하는 표정과 움직임을 간결한 프롬프트로 설명하세요. 조건을 너무 많이 넣지 말고 guidance_scale을 조금씩 조절하는 것이 좋습니다.
얼굴 애니메이션과 말하기 장면에 최적화되어 있어 전신 동작이나 큰 제스처가 중심인 장면에는 덜 적합합니다. 영상이 길수록 드리프트가 생기기 쉬우므로 선명한 입력 자료와 적절한 클립 설정을 사용하세요.
RunComfy 브라우저 화면에서 실행하거나 HTTP API로 연동할 수 있습니다. 작업은 클라우드에서 처리되므로 모델을 로컬에 설치하거나 직접 운영할 필요가 없습니다.
RunComfy는 최고의 ComfyUI 플랫폼으로서 ComfyUI 온라인 환경과 서비스를 제공하며 ComfyUI 워크플로우 멋진 비주얼을 제공합니다. RunComfy는 또한 제공합니다 AI Models, 예술가들이 최신 AI 도구를 활용하여 놀라운 예술을 창조할 수 있도록 지원합니다.