Генерация видео по референсам: длительность 3–15 с, тариф $0.084 за секунду.
Ace Step — модель преобразования текста в музыку, которая создаёт полноценные песни с вокалом, инструментовкой и синхронизированным текстом по разделённым запятыми тегам стиля и необязательному тексту. Она рассчитана на быстрые итерации и поддерживает длительность от нескольких секунд до 4 минут (240 секунд).
Формат результата: только аудио / длительность 5–240 секунд / стерео / частота дискретизации определяется поставщиком.
| Параметр | Обязательный | Тип | По умолчанию | Диапазон / Варианты | Описание |
|---|---|---|---|---|---|
| tags* | Да (*) | string | — | Произвольный текст | Разделённый запятыми список тегов жанра, настроения и инструментов. |
| lyrics | Нет | string | — | Произвольный текст или [inst] / [instrumental] | Вокальный текст; оставьте пустым для текста от ИИ или используйте [inst] для инструментальной версии. |
| duration | Нет | integer | 60 | 5 – 240 | Длительность аудио в секундах. |
| seed | Нет | integer | -1 | -1 – 2147483647 | Случайный seed для воспроизводимости; -1 выбирает случайное значение. |
Ace Step на RunComfy тарифицирует сгенерированное аудио по длительности.
| Единица тарификации | Тариф |
|---|---|
| За секунду сгенерированного аудио | $0.0002 |
Примеры расчётной стоимости
| Длительность | Примерная стоимость |
|---|---|
| 30 с | ~$0.006 |
| 60 с (по умолчанию) | ~$0.012 |
| 120 с | ~$0.024 |
| 240 с (4 мин) | ~$0.048 |
1) Откройте Ace Step на RunComfy и разверните панель генерации.
2) Введите теги стиля, например "lofi, hiphop, chill, mellow piano", чтобы задать жанр, настроение и инструменты.
3) При необходимости добавьте текст; чётко разделите куплет и припев либо используйте [inst] для инструментальной версии.
4) Задайте duration в секундах (5–240); сначала проверьте направление на коротком фрагменте, а затем генерируйте полные 4 минуты.
5) Зафиксируйте seed, чтобы сравнить влияние изменений тегов или текста, либо оставьте -1 для разнообразия.
6) Запустите генерацию, прослушайте результат и скачайте аудиофайл из истории задач.
7) Для работы через API отправьте те же поля на эндпоинт Ace Step в RunComfy; self-hosting не требуется.
8) Сохраняйте удачные seed и комбинации тегов как пресеты, чтобы звуковое направление проекта оставалось единообразным.
Генерация видео по референсам: длительность 3–15 с, тариф $0.084 за секунду.
Создавайте видео из фотографий с несколькими ключевыми кадрами с дополнительным звуком.
Сегментируйте описанный объект на протяжении кадров видео.
Отделяйте людей или предметы от фона видео и настраивайте кодек, уточнение краёв и тип объекта.
Создайте видео с говорящим аватаром из портрета и аудиодорожки; при необходимости задайте промптом движение и манеру речи.
Отредактируйте исходное видео по текстовой инструкции, сохранив целостность сцены.
Ace Step — модель преобразования текста в музыку от acestep-ai, которая создаёт полноценные треки с мелодией, ритмом и вокалом по тегам стиля и промптам. В процессе на RunComfy вы описываете жанр, настроение и структуру, а Ace Step генерирует связную композицию с синхронизированным текстом. Модель предназначена для быстрой генерации музыки по промпту без ручного сочинения.
Ace Step хорошо подходит для фоновой музыки, коротких демо, атмосферных лупов, рекламных джинглов и референсных треков к сценам видео или игр. Теги позволяют несколькими описаниями задать жанр, темп и энергию. Генерация вокала и текста также полезна для черновиков песен и творческих прототипов.
В отличие от многих универсальных аудиомоделей, Ace Step делает акцент на акустической точности, динамическом балансе, пространственном качестве и чёткости инструментов. Интерфейс тегов даёт техническим художникам и дизайнерам более прямой контроль жанра и энергии, чем одни свободные промпты. Параметр seed также позволяет разработчикам последовательно повторять итерации выбранного направления.
Дизайнеры, технические художники, авторы видео и продуктовые команды могут использовать Ace Step для трейлеров, соцсетей, игровых аудиопрототипов, e-commerce-видео и рекламы. Разработчики могут встроить модель в конвейеры, где саундтрек создаётся по требованию из метаданных сцены или брифа кампании. Поддержка вокала и инструментала закрывает широкий набор аудиозадач в одном интерфейсе.
Ace Step поддерживает гибкую длительность — от нескольких секунд примерно до 4 минут (240 секунд) на одну генерацию. Другие ограничения, включая длину промпта, аудиоформаты и сочетания тегов, зависят от текущей конфигурации поставщика. Проверяйте панель параметров RunComfy: лимиты могут различаться по режимам и провайдерам, а панель всегда показывает актуальные значения эндпоинта преобразования текста в звук.
Проверьте Ace Step в Web UI RunComfy AI Playground, меняя теги стиля, промпт, длительность и seed, пока результат преобразования текста в звук не совпадёт с целью. После стабилизации настроек вызывайте ту же модель Ace Step через API RunComfy с идентичными параметрами для автоматизации в бэкенде или контентном конвейере. Творческие итерации остаются в браузере, а продакшен выполняется в коде без изменения поведения модели.
Генерации Ace Step расходуют кредиты USD с баланса RunComfy и, по доступной информации поставщика, стоят $0.0002 за секунду. Новые пользователи обычно получают бесплатную сумму для тестирования; затем действуют правила раздела Generation на странице модели. Актуальные тарифы и различия между режимами смотрите в этом разделе.
RunComfy предоставляет доступ к Ace Step и процессу генерации аудио, но коммерческие права на музыку зависят от лицензии исходного автора и поставщика, acestep-ai. Перед выпуском треков в продуктах, рекламе, фильмах или играх изучите официальную лицензию Ace Step и условия провайдера. По вопросам платформы можно написать на hi@runcomfy.com.
RunComfy - ведущая ComfyUI платформа, предлагающая ComfyUI онлайн среду и услуги, а также рабочие процессы ComfyUI с потрясающей визуализацией. RunComfy также предоставляет AI Models, позволяя художникам использовать новейшие инструменты AI для создания невероятного искусства.