Открытое преобразование изображения в видео с дополнительным последним кадром и собственным стереозвуком.
Ace Step 1.5 — модель преобразования текста в музыку, которая создаёт полноценные песни с вокалом, инструментовкой и синхронизированной фразировкой по разделённым запятыми тегам стиля и необязательному структурированному тексту. Она поддерживает 50+ языков, работает эффективно и рассчитана на быстрые итерации с длительностью от нескольких секунд до 4 минут (240 секунд).
Формат результата: только аудио / длительность 5–240 секунд / стерео / частота дискретизации определяется поставщиком.
| Параметр | Обязательный | Тип | По умолчанию | Диапазон / Варианты | Описание |
|---|---|---|---|---|---|
| tags* | Да (*) | string | — | Произвольный текст | Разделённый запятыми список тегов жанра, настроения и инструментов. |
| lyrics | Нет | string | — | Произвольный текст или [inst] / [instrumental] | Вокальный текст; используйте маркеры [Verse], [Chorus] и [Bridge] для структуры песни. |
| duration | Нет | integer | 60 | 5 – 240 | Длительность аудио в секундах. |
| seed | Нет | integer | -1 | -1 – 2147483647 | Случайный seed для воспроизводимости; -1 выбирает случайное значение. |
Ace Step 1.5 на RunComfy тарифицирует сгенерированное аудио по длительности.
| Единица тарификации | Тариф |
|---|---|
| За секунду сгенерированного аудио | $0.0003 |
Примеры расчётной стоимости
| Длительность | Примерная стоимость |
|---|---|
| 30 с | ~$0.009 |
| 60 с (по умолчанию) | ~$0.018 |
| 120 с | ~$0.036 |
| 240 с (4 мин) | ~$0.072 |
1) Откройте Ace Step 1.5 на RunComfy и разверните панель генерации.
2) Введите теги стиля, например "lofi, hiphop, chill, mellow piano", чтобы задать жанр, настроение и инструменты.
3) При необходимости добавьте текст; чётко разделите секции [Verse], [Chorus] и [Bridge] либо используйте [inst] для инструментальной версии.
4) Задайте duration в секундах (5–240); сначала проверьте направление на коротком фрагменте, а затем генерируйте полные 4 минуты.
5) Зафиксируйте seed, чтобы сравнить влияние изменений тегов или текста, либо оставьте -1 для разнообразия.
6) Запустите генерацию, прослушайте результат и скачайте аудиофайл из истории задач.
7) Для работы через API отправьте те же поля на эндпоинт Ace Step 1.5 в RunComfy; self-hosting не требуется.
8) Сохраняйте удачные seed и комбинации тегов как пресеты, чтобы звуковое направление проекта оставалось единообразным.
Открытое преобразование изображения в видео с дополнительным последним кадром и собственным стереозвуком.
Создайте видео с синхронизированным звуком из одной необходимой текстовой подсказки. Выберите `1280x720` или `720x1280` и длительность `4`, `8` или `12` секунд.
Создавайте плавные видео из двух изображений с высоким качеством переходов
Создайте видео в Kling 2.5 Turbo по промпту и выберите длительность, соотношение сторон и негативный промпт.
Мощное решение для создания видео из изображений с точной анимацией
Удаляйте фон версией Fast и настраивайте кодек, уточнение краёв и тип объекта.
Ace Step 1.5 — модель преобразования текста в музыку от acestep-ai, которая создаёт полноценные треки с мелодией, ритмом и вокалом по тегам стиля и необязательному структурированному тексту. В процессе на RunComfy вы описываете жанр, настроение и структуру песни, а Ace Step 1.5 генерирует связную композицию с синхронизированной фразировкой. Модель предназначена для быстрой генерации музыки по промпту без ручного сочинения.
Ace Step 1.5 хорошо подходит для фоновой музыки к видео, коротких демо, атмосферных лупов, рекламных джинглов и референсных треков к игровым сценам. Теги позволяют несколькими описаниями задать жанр, инструменты и энергию. Генерация текста и вокала также делает Ace Step 1.5 полезным для черновиков песен и творческих прототипов.
В сравнении с исходным Ace Step версия 1.5 сохраняет управление тегами и максимальную длительность 4 минуты, расширяет поддержку текстов до 50+ языков и улучшает работу со структурированными текстами. В отличие от систем только для инструментальной музыки, Ace Step 1.5 нативно создаёт вокал, инструментовку и синхронизированную фразировку за один проход. Параметр seed также позволяет разработчикам последовательно повторять итерации.
Дизайнеры, технические художники, авторы видео и продуктовые команды могут использовать Ace Step 1.5 для трейлеров, соцсетей, игровых аудиопрототипов, e-commerce-видео и рекламы. Разработчики могут встроить модель в конвейеры, где саундтрек создаётся по требованию из метаданных сцены или брифа кампании. Поддержка вокала и инструментала на многих языках закрывает широкий набор задач в одном интерфейсе.
Ace Step 1.5 поддерживает гибкую длительность от 5 секунд до 240 секунд (4 минуты) на одну генерацию, одно обязательное поле tags и необязательное структурированное поле lyrics. Другие ограничения, включая аудиоформаты и сочетания тегов, зависят от текущей конфигурации поставщика. Проверяйте точные лимиты в панели параметров RunComfy, поскольку они могут различаться по режимам и провайдерам.
Проверьте Ace Step 1.5 в Web UI RunComfy AI Playground, меняя теги стиля, текст, длительность и seed, пока результат text-to-audio не совпадёт с целью. После стабилизации настроек вызывайте ту же модель Ace Step 1.5 через API RunComfy с идентичными параметрами для автоматизации в бэкенде или контентном конвейере. Творческие итерации остаются в браузере, а продакшен выполняется в коде без изменения поведения модели.
Генерации Ace Step 1.5 расходуют кредиты USD с баланса RunComfy и, по доступной информации поставщика, стоят $0.0003 за секунду. Новые пользователи обычно получают бесплатную сумму для тестирования; затем действуют правила раздела Generation на странице модели. Актуальные тарифы и различия между режимами смотрите в этом разделе.
RunComfy - ведущая ComfyUI платформа, предлагающая ComfyUI онлайн среду и услуги, а также рабочие процессы ComfyUI с потрясающей визуализацией. RunComfy также предоставляет AI Models, позволяя художникам использовать новейшие инструменты AI для создания невероятного искусства.