단 한 장의 이미지로 부드럽고 생생한 영상과 오디오를 손쉽게 제작해보세요
Ace Step 1.5는 쉼표로 구분한 스타일 태그와 선택형 구조화 가사를 보컬, 악기, 가사 싱크를 갖춘 완성곡으로 구현하는 음악 생성 모델입니다. 50개 이상의 언어를 지원하고 효율적으로 작동하며 몇 초부터 4분(240초)까지 빠르게 반복할 수 있습니다.
출력 형식: 오디오만 / 5~240초 / 스테레오 / 샘플레이트는 제공업체 기준
| 매개변수 | 필수 | 형식 | 기본값 | 범위 / 선택지 | 설명 |
|---|---|---|---|---|---|
| tags* | 예(*) | string | — | 자유 입력 | 장르, 분위기, 악기를 쉼표로 구분. |
| lyrics | 아니요 | string | — | 자유 입력 또는 [inst] / [instrumental] | 가사. [Verse], [Chorus], [Bridge]로 구조 지정. |
| duration | 아니요 | integer | 60 | 5~240 | 오디오 길이(초). |
| seed | 아니요 | integer | -1 | -1~2147483647 | 재현용 시드. -1은 무작위. |
RunComfy의 Ace Step 1.5는 생성 오디오 길이에 따라 과금됩니다.
| 과금 단위 | 요금 |
|---|---|
| 생성 오디오 1초 | $0.0004 |
예상 비용
| 길이 | 예상 비용 |
|---|---|
| 30초 | 약 $0.012 |
| 60초(기본값) | 약 $0.024 |
| 120초 | 약 $0.048 |
| 240초(4분) | 약 $0.096 |
1) RunComfy에서 Ace Step 1.5를 열고 생성 패널을 표시합니다.
2) “lofi, hiphop, chill, mellow piano” 같은 태그로 장르, 분위기, 편성을 정합니다.
3) 필요하면 가사를 넣고 [Verse], [Chorus], [Bridge]를 분명히 나눕니다. 연주곡은 [inst]를 사용합니다.
4) 5~240초를 설정합니다. 먼저 짧게 방향을 확인한 뒤 4분 전체 버전을 만듭니다.
5) 태그나 가사의 영향만 비교할 때는 시드를 고정하고, 다양한 결과가 필요하면 -1로 둡니다.
6) 생성해 들어 본 뒤 작업 기록에서 오디오 파일을 내려받습니다.
7) API에서는 같은 필드를 RunComfy Ace Step 1.5 엔드포인트로 보냅니다. 직접 호스팅할 필요가 없습니다.
8) 좋은 시드와 태그 조합을 프리셋으로 저장해 프로젝트 전체의 사운드를 통일합니다.
단 한 장의 이미지로 부드럽고 생생한 영상과 오디오를 손쉽게 제작해보세요
프롬프트에서 동영상을 생성하고 LoRA, 해상도, 화면비, 프레임, FPS, 단계, 시드를 설정합니다.
FLUX 3 Draft: 720p에서 빠르고 저렴한 텍스트-비디오 미리 보기
텍스트, 레퍼런스 오디오, 이미지에서 자연스러운 음성과 오디오를 생성합니다.
정교한 프레임 전환과 자연스러운 움직임으로 이미지를 영화처럼 변환
스타일 전환부터 오브젝트 조정까지 가능한 영상 생성 AI
acestep-ai의 음악 생성 모델로 스타일 태그와 선택형 구조화 가사를 멜로디, 리듬, 보컬이 있는 완성 트랙으로 구현합니다. RunComfy에서 장르, 분위기, 곡 구조를 설명하면 가사 싱크가 맞는 일관된 곡을 만듭니다. 수작업 작곡 없이 프롬프트로 빠르게 음악을 만들려는 제작자에게 적합합니다.
영상 배경음악, 짧은 곡 데모, 앰비언트 루프, 광고 징글, 게임 장면용 참고곡에 적합합니다. 몇 개의 태그로 장르, 악기, 에너지를 조절하고 보컬과 가사도 생성해 작곡 초안과 아이디어 검증에 활용할 수 있습니다.
기존 Ace Step의 태그 제어와 최대 4분 길이는 유지하면서 50개 이상의 언어로 가사 지원을 넓히고 구조화 가사 처리를 개선했습니다. 연주곡 전용 모델과 달리 보컬, 악기, 가사 싱크를 한 번에 생성하고 시드로 결과를 재현할 수 있습니다.
디자이너, 테크니컬 아티스트, 영상 제작자, 제품팀이 예고편, 소셜 콘텐츠, 게임 오디오 시제품, 이커머스 영상, 광고 소재를 만들 수 있습니다. 장면 메타데이터나 캠페인 브리프로 주문형 사운드트랙을 만드는 과정에도 연동하며 여러 언어의 보컬과 연주곡을 한 화면에서 다룹니다.
한 번에 5~240초(4분)를 지원하며 필수 항목은 tags, 구조화 lyrics는 선택입니다. 지원 형식과 태그 조합은 제공업체 설정에 따라 달라지므로 구축 전 RunComfy 매개변수 화면에서 정확한 값을 확인하세요.
RunComfy AI Playground에서 스타일 태그, 가사, 길이, 시드를 조절해 결과를 확인합니다. 설정이 정해지면 같은 매개변수로 RunComfy API에서 호출해 백엔드나 제작 과정을 자동화할 수 있습니다. 화면과 코드에서 모델 동작은 같습니다.
RunComfy USD/크레딧 잔액을 사용하며 공개 정보 기준 초당 $0.0004입니다. 신규 사용자는 일반적으로 무료 체험 크레딧을 받고 이후 모델 페이지 Generation 영역의 요금이 적용됩니다. 최신 요금과 모드별 차이도 해당 영역에서 확인하세요.
RunComfy는 최고의 ComfyUI 플랫폼으로서 ComfyUI 온라인 환경과 서비스를 제공하며 ComfyUI 워크플로우 멋진 비주얼을 제공합니다. RunComfy는 또한 제공합니다 AI Models, 예술가들이 최신 AI 도구를 활용하여 놀라운 예술을 창조할 수 있도록 지원합니다.