logo
RunComfy
  • ComfyUI
  • ТренерНовое
  • Модели
  • API
  • Цены
discord logo
МОДЕЛИ
Обзор
Все модели
БИБЛИОТЕКА
Генерации
API МОДЕЛЕЙ
Документация API
API-ключи
АККАУНТ
Использование

Ace Step 1.5: генерация музыки из текста с вокалом, текстом и тегами стиля на RunComfy и через API | RunComfy

acestep-ai/ace-step-1.5/text-to-audio

Создавайте по тегам стиля и необязательному тексту песни длительностью до 4 минут с оригинальным вокалом и высокой акустической точностью — на RunComfy и через HTTP API.

Разделённые запятыми теги жанра, настроения и инструментов, которые задают стиль создаваемого трека.
Необязательный вокальный текст. Оставьте поле пустым или используйте [inst] / [instrumental] для инструментальной композиции; маркеры [Verse], [Chorus] и [Bridge] задают структуру песни.
Длительность аудио в секундах.
Idle
The rate is $0.0003 per second.

Введение в Ace Step 1.5

Ace Step 1.5 от ACE Studio превращает текстовые теги стиля и необязательные структурированные тексты в полноценные песни длительностью до 4 минут по тарифу $0.0003 за секунду. Модель поддерживает 50+ языков, связный вокал и высокую акустическую точность. Генерация по тегам и промпту заменяет ручную работу композитора, запись вокалиста и многодорожечное производство, ускоряя музыкальные эксперименты для медиакоманд, игровых студий, авторов контента и рекламных продюсеров. Разработчики могут использовать Ace Step 1.5 на RunComfy в браузере или через HTTP API без самостоятельного размещения и масштабирования модели.
Идеально для: прототипов музыкальных демо | музыки для кино и игр | короткой рекламной музыки

ACE Studio / Ace Step 1.5#


Ace Step 1.5 — модель преобразования текста в музыку, которая создаёт полноценные песни с вокалом, инструментовкой и синхронизированной фразировкой по разделённым запятыми тегам стиля и необязательному структурированному тексту. Она поддерживает 50+ языков, работает эффективно и рассчитана на быстрые итерации с длительностью от нескольких секунд до 4 минут (240 секунд).


Формат результата: только аудио / длительность 5–240 секунд / стерео / частота дискретизации определяется поставщиком.


Параметры#


ПараметрОбязательныйТипПо умолчаниюДиапазон / ВариантыОписание
tags*Да (*)string—Произвольный текстРазделённый запятыми список тегов жанра, настроения и инструментов.
lyricsНетstring—Произвольный текст или [inst] / [instrumental]Вокальный текст; используйте маркеры [Verse], [Chorus] и [Bridge] для структуры песни.
durationНетinteger605 – 240Длительность аудио в секундах.
seedНетinteger-1-1 – 2147483647Случайный seed для воспроизводимости; -1 выбирает случайное значение.

Цены#


Ace Step 1.5 на RunComfy тарифицирует сгенерированное аудио по длительности.


Единица тарификацииТариф
За секунду сгенерированного аудио$0.0003

Примеры расчётной стоимости


ДлительностьПримерная стоимость
30 с~$0.009
60 с (по умолчанию)~$0.018
120 с~$0.036
240 с (4 мин)~$0.072

Как использовать#


1) Откройте Ace Step 1.5 на RunComfy и разверните панель генерации.

2) Введите теги стиля, например "lofi, hiphop, chill, mellow piano", чтобы задать жанр, настроение и инструменты.

3) При необходимости добавьте текст; чётко разделите секции [Verse], [Chorus] и [Bridge] либо используйте [inst] для инструментальной версии.

4) Задайте duration в секундах (5–240); сначала проверьте направление на коротком фрагменте, а затем генерируйте полные 4 минуты.

5) Зафиксируйте seed, чтобы сравнить влияние изменений тегов или текста, либо оставьте -1 для разнообразия.

6) Запустите генерацию, прослушайте результат и скачайте аудиофайл из истории задач.

7) Для работы через API отправьте те же поля на эндпоинт Ace Step 1.5 в RunComfy; self-hosting не требуется.

8) Сохраняйте удачные seed и комбинации тегов как пресеты, чтобы звуковое направление проекта оставалось единообразным.

Похожие модели

minimax-h3-open/image-to-video

Открытое преобразование изображения в видео с дополнительным последним кадром и собственным стереозвуком.

sora-2/text-to-video

Создайте видео с синхронизированным звуком из одной необходимой текстовой подсказки. Выберите `1280x720` или `720x1280` и длительность `4`, `8` или `12` секунд.

wan-2-2/first-last-frame

Создавайте плавные видео из двух изображений с высоким качеством переходов

kling-2-5/turbo/text-to-video

Создайте видео в Kling 2.5 Turbo по промпту и выберите длительность, соотношение сторон и негативный промпт.

wan-2-2/image-to-video

Мощное решение для создания видео из изображений с точной анимацией

video-background-removal/fast/video-to-video

Удаляйте фон версией Fast и настраивайте кодек, уточнение краёв и тип объекта.

Часто задаваемые вопросы

Что такое Ace Step 1.5 и как он работает в процессе text-to-audio?

Ace Step 1.5 — модель преобразования текста в музыку от acestep-ai, которая создаёт полноценные треки с мелодией, ритмом и вокалом по тегам стиля и необязательному структурированному тексту. В процессе на RunComfy вы описываете жанр, настроение и структуру песни, а Ace Step 1.5 генерирует связную композицию с синхронизированной фразировкой. Модель предназначена для быстрой генерации музыки по промпту без ручного сочинения.

Для каких задач генерации лучше всего подходит Ace Step 1.5?

Ace Step 1.5 хорошо подходит для фоновой музыки к видео, коротких демо, атмосферных лупов, рекламных джинглов и референсных треков к игровым сценам. Теги позволяют несколькими описаниями задать жанр, инструменты и энергию. Генерация текста и вокала также делает Ace Step 1.5 полезным для черновиков песен и творческих прототипов.

Как Ace Step 1.5 соотносится с исходным Ace Step и другими музыкальными моделями?

В сравнении с исходным Ace Step версия 1.5 сохраняет управление тегами и максимальную длительность 4 минуты, расширяет поддержку текстов до 50+ языков и улучшает работу со структурированными текстами. В отличие от систем только для инструментальной музыки, Ace Step 1.5 нативно создаёт вокал, инструментовку и синхронизированную фразировку за один проход. Параметр seed также позволяет разработчикам последовательно повторять итерации.

Каким командам и сценариям больше всего подходит Ace Step 1.5 в продакшене?

Дизайнеры, технические художники, авторы видео и продуктовые команды могут использовать Ace Step 1.5 для трейлеров, соцсетей, игровых аудиопрототипов, e-commerce-видео и рекламы. Разработчики могут встроить модель в конвейеры, где саундтрек создаётся по требованию из метаданных сцены или брифа кампании. Поддержка вокала и инструментала на многих языках закрывает широкий набор задач в одном интерфейсе.

Какие ограничения входа и выхода нужно учитывать перед использованием Ace Step 1.5?

Ace Step 1.5 поддерживает гибкую длительность от 5 секунд до 240 секунд (4 минуты) на одну генерацию, одно обязательное поле tags и необязательное структурированное поле lyrics. Другие ограничения, включая аудиоформаты и сочетания тегов, зависят от текущей конфигурации поставщика. Проверяйте точные лимиты в панели параметров RunComfy, поскольку они могут различаться по режимам и провайдерам.

Как перейти от тестирования Ace Step 1.5 в интерфейсе к продакшену через API RunComfy?

Проверьте Ace Step 1.5 в Web UI RunComfy AI Playground, меняя теги стиля, текст, длительность и seed, пока результат text-to-audio не совпадёт с целью. После стабилизации настроек вызывайте ту же модель Ace Step 1.5 через API RunComfy с идентичными параметрами для автоматизации в бэкенде или контентном конвейере. Творческие итерации остаются в браузере, а продакшен выполняется в коде без изменения поведения модели.

Как рассчитывается цена аудио, созданного Ace Step 1.5 на RunComfy?

Генерации Ace Step 1.5 расходуют кредиты USD с баланса RunComfy и, по доступной информации поставщика, стоят $0.0003 за секунду. Новые пользователи обычно получают бесплатную сумму для тестирования; затем действуют правила раздела Generation на странице модели. Актуальные тарифы и различия между режимами смотрите в этом разделе.

Подписывайтесь на нас
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Поддержка
  • Discord
  • Email
  • Статус системы
  • партнёр
Модели видео
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Посмотреть все модели →
Модели изображений
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Посмотреть все модели →
Юридическая информация
  • Условия обслуживания
  • Политика конфиденциальности
  • Политика в отношении файлов cookie
RunComfy
Авторское право 2026 RunComfy. Все права защищены.

RunComfy - ведущая ComfyUI платформа, предлагающая ComfyUI онлайн среду и услуги, а также рабочие процессы ComfyUI с потрясающей визуализацией. RunComfy также предоставляет AI Models, позволяя художникам использовать новейшие инструменты AI для создания невероятного искусства.