원본 동영상을 선택한 해상도와 프레임률로 업스케일합니다.
Elevenlabs Music은 자연어 프롬프트와 선택형 구조화 가사를 보컬곡 또는 연주곡으로 구현하는 고품질 음악 생성 모델입니다. 스타일과 구간을 세밀하게 설명하면 미디어, 게임, 창작 제작에 바로 쓸 수 있는 완성도 높은 오디오를 출력합니다.
출력 형식: 오디오만 / 약 3초~약 5분 / 44.1 kHz / 스테레오 / MP3 또는 WAV
다음 항목으로 Elevenlabs Music을 안정적으로 제어할 수 있습니다.
| 매개변수 | 필수 | 형식 | 기본값 | 범위 / 선택지 | 설명 |
|---|---|---|---|---|---|
| prompt* | 예(*) | string | — | — | 구조 마커를 포함한 스타일 설명과 가사. |
| music_length_ms | 아니요 | integer | 40000 | 일반적으로 3000~300000 | 출력 길이(밀리초). |
| force_instrumental | 아니요 | boolean | disabled | true/false | 보컬 없는 연주곡만 생성. |
| output_format | 아니요 | string | mp3_standard | 플랫폼 선택지 참조 | 출력 형식. 기본값은 mp3_standard이며 나머지는 화면에서 선택. |
RunComfy의 Elevenlabs Music은 생성한 오디오 길이에 따라 과금됩니다.
| 과금 단위 | 요금 |
|---|---|
| 생성 오디오 1초 | $0.011 |
예상 비용
| 길이 | 예상 비용 |
|---|---|
| 30초 | 약 $0.33 |
| 40초(기본값) | 약 $0.44 |
| 60초 | 약 $0.66 |
| 120초 | 약 $1.32 |
| 300초(5분) | 약 $3.30 |
1) RunComfy에서 Elevenlabs Music을 선택하고 생성 패널을 엽니다.
2) “Intro 8 bars, Verse 16 bars, Chorus 16 bars”처럼 구조 마커로 프롬프트를 작성하고 보컬이 필요하면 가사를 넣습니다.
3) music_length_ms를 기획에 맞춥니다. 예를 들어 40000은 약 40초입니다. 먼저 짧게 생성해 방향을 잡은 뒤 늘립니다.
4) 보컬 없는 트랙은 force_instrumental을 켜고, 가사를 부르게 하려면 끕니다.
5) 빠른 확인은 MP3, 믹싱은 WAV처럼 작업 목적에 맞게 output_format을 고릅니다. 지원 형식은 화면을 확인하세요.
6) 생성 후 확인합니다. 특정 구간만 바꾸려면 전체 곡을 다시 쓰지 말고 프롬프트의 해당 부분을 수정해 재실행합니다.
7) RunComfy API에도 같은 매개변수를 보냅니다. 직접 호스팅할 필요가 없으며 결과는 작업 기록에서 내려받을 수 있습니다.
8) 구간별로 좋은 버전을 저장한 뒤 이어 붙이거나 비교해 최종 결과를 고릅니다.
RunComfy의 Elevenlabs Music은 세밀한 구조 제어를 유지하면서 전문 음악 제작을 빠르게 반복할 수 있게 합니다.
원본 동영상을 선택한 해상도와 프레임률로 업스케일합니다.
필수 텍스트 프롬프트로 Hailuo 02의 6초 또는 10초 영상을 생성하며 프롬프트 확장을 선택할 수 있습니다.
두 개의 음성과 이미지 한 장으로 동영상을 만들고 화자의 재생 순서를 지정할 수 있습니다.
Wan 2.2 Plus로 프롬프트에서 5초 동영상을 생성하고 크기, 시드, 프롬프트 확장을 설정합니다.
첫 번째 프레임 이미지를 최대 15초 동안 768p 또는 2K 비디오로 애니메이션화
텍스트로 음성을 생성해 동영상에 동기화하고 음성 ID, 언어, 속도를 설정합니다.
Elevenlabs Music은 자연어 프롬프트로 전체 길이의 곡이나 연주곡을 만드는 모델입니다. 구간별 세밀한 제어, 다국어 보컬, 맞춤형 파인튜닝을 지원해 Elevenlabs Music 화면 또는 RunComfy API에서 전문 품질의 음악을 제작할 수 있습니다.
클래식부터 힙합까지 거의 모든 장르를 지원하고 영어, 스페인어, 독일어, 일본어 등 여러 언어의 보컬을 생성합니다. 언어별 스타일과 감정 지시를 해석해 다양한 지역의 콘텐츠 제작에 활용할 수 있습니다.
현재 약 3초부터 5분까지 지원하며 스튜디오 품질의 44.1 kHz MP3 또는 WAV를 출력합니다. 프롬프트에는 구조화 구간을 넣을 수 있고, 안정적인 결과를 위해 전체 텍스트는 수천 토큰 이내가 권장됩니다.
저작권 문제가 없는 참고 자료만 파인튜닝에 사용할 수 있습니다. 일반적으로 5~10개의 짧은 오디오로 구성된 소규모 맞춤 데이터셋을 사용합니다. 지나치게 큰 파일이나 저작권 보호 자료는 규정 준수와 성능상 이유로 거부될 수 있습니다.
RunComfy 모델 화면에서 Elevenlabs Music 품질과 매개변수를 검증한 뒤 같은 설정을 제공하는 RunComfy API를 사용합니다. API 키로 인증하고 작업 자동화와 USD 크레딧 과금을 연결하면 운영 규모로 확장할 수 있습니다.
대부분 생성 곡의 상업적 권리를 제공하지만 재배포 전에 elevenlabs.io에서 최신 조건을 확인해야 합니다. 일반 용도에 맞는 독창적 출력을 목표로 하지만 대규모 공개 전에는 정식 라이선스 검토를 권장합니다.
차세대 음악 합성 기술로 44.1 kHz에서 일관된 구성, 정교한 믹스, 고품질 오디오를 제공합니다. 이전 모델에서 부족하기 쉬운 다이내믹 레인지와 곡의 응집력을 개선해 자연스러운 전환과 사실적인 보컬을 뚜렷한 결함 없이 재현합니다.
Suno보다 세밀한 구조 제어와 프롬프트 반영을 제공하고 Udio보다 유연하게 편집할 수 있습니다. Udio는 보컬 음색의 사실감이 강점이지만 Elevenlabs Music은 구간 제어와 투명한 권리 조건을 중시해 창작과 법적 정확성을 함께 관리하기 좋습니다.
네. RunComfy의 API 구조는 일괄 또는 대기열 방식 생성을 지원합니다. 프롬프트 반복, 구간 전환 조정, MP3·WAV 수집을 자동화해 앱, 가상 세계, 동적 미디어의 음악 제작을 간소화할 수 있습니다.
네. 구간을 인식해 나머지 곡을 바꾸지 않고 코러스나 브리지만 다시 만들 수 있습니다. 이 세밀한 제어로 개발자와 테크니컬 아티스트가 더 효율적이고 정확하게 반복할 수 있습니다.
RunComfy는 최고의 ComfyUI 플랫폼으로서 ComfyUI 온라인 환경과 서비스를 제공하며 ComfyUI 워크플로우 멋진 비주얼을 제공합니다. RunComfy는 또한 제공합니다 AI Models, 예술가들이 최신 AI 도구를 활용하여 놀라운 예술을 창조할 수 있도록 지원합니다.