logo
RunComfy
  • ComfyUI
  • ТренерНовое
  • Модели
  • API
  • Цены
discord logo
МОДЕЛИ
Обзор
Все модели
БИБЛИОТЕКА
Генерации
API МОДЕЛЕЙ
Документация API
API-ключи
АККАУНТ
Использование

Ace Step 1.5: генерация музыки из текста с вокалом, текстом и тегами стиля на RunComfy и через API | RunComfy

acestep-ai/ace-step-1.5/text-to-audio

Создавайте по тегам стиля и необязательному тексту песни длительностью до 4 минут с оригинальным вокалом и высокой акустической точностью — на RunComfy и через HTTP API.

Разделённые запятыми теги жанра, настроения и инструментов, которые задают стиль создаваемого трека.
Необязательный вокальный текст. Оставьте поле пустым или используйте [inst] / [instrumental] для инструментальной композиции; маркеры [Verse], [Chorus] и [Bridge] задают структуру песни.
Длительность аудио в секундах.
Idle
The rate is $0.0004 per second.

Введение в Ace Step 1.5

Ace Step 1.5 от ACE Studio превращает текстовые теги стиля и необязательные структурированные тексты в полноценные песни длительностью до 4 минут по тарифу $0.0004 за секунду. Модель поддерживает 50+ языков, связный вокал и высокую акустическую точность. Генерация по тегам и промпту заменяет ручную работу композитора, запись вокалиста и многодорожечное производство, ускоряя музыкальные эксперименты для медиакоманд, игровых студий, авторов контента и рекламных продюсеров. Разработчики могут использовать Ace Step 1.5 на RunComfy в браузере или через HTTP API без самостоятельного размещения и масштабирования модели.
Идеально для: прототипов музыкальных демо | музыки для кино и игр | короткой рекламной музыки

ACE Studio / Ace Step 1.5#


Ace Step 1.5 — модель преобразования текста в музыку, которая создаёт полноценные песни с вокалом, инструментовкой и синхронизированной фразировкой по разделённым запятыми тегам стиля и необязательному структурированному тексту. Она поддерживает 50+ языков, работает эффективно и рассчитана на быстрые итерации с длительностью от нескольких секунд до 4 минут (240 секунд).


Формат результата: только аудио / длительность 5–240 секунд / стерео / частота дискретизации определяется поставщиком.


Параметры#


ПараметрОбязательныйТипПо умолчаниюДиапазон / ВариантыОписание
tags*Да (*)string—Произвольный текстРазделённый запятыми список тегов жанра, настроения и инструментов.
lyricsНетstring—Произвольный текст или [inst] / [instrumental]Вокальный текст; используйте маркеры [Verse], [Chorus] и [Bridge] для структуры песни.
durationНетinteger605 – 240Длительность аудио в секундах.
seedНетinteger-1-1 – 2147483647Случайный seed для воспроизводимости; -1 выбирает случайное значение.

Цены#


Ace Step 1.5 на RunComfy тарифицирует сгенерированное аудио по длительности.


Единица тарификацииТариф
За секунду сгенерированного аудио$0.0004

Примеры расчётной стоимости


ДлительностьПримерная стоимость
30 с~$0.012
60 с (по умолчанию)~$0.024
120 с~$0.048
240 с (4 мин)~$0.096

Как использовать#


1) Откройте Ace Step 1.5 на RunComfy и разверните панель генерации.

2) Введите теги стиля, например "lofi, hiphop, chill, mellow piano", чтобы задать жанр, настроение и инструменты.

3) При необходимости добавьте текст; чётко разделите секции [Verse], [Chorus] и [Bridge] либо используйте [inst] для инструментальной версии.

4) Задайте duration в секундах (5–240); сначала проверьте направление на коротком фрагменте, а затем генерируйте полные 4 минуты.

5) Зафиксируйте seed, чтобы сравнить влияние изменений тегов или текста, либо оставьте -1 для разнообразия.

6) Запустите генерацию, прослушайте результат и скачайте аудиофайл из истории задач.

7) Для работы через API отправьте те же поля на эндпоинт Ace Step 1.5 в RunComfy; self-hosting не требуется.

8) Сохраняйте удачные seed и комбинации тегов как пресеты, чтобы звуковое направление проекта оставалось единообразным.

Похожие модели

pixverse-c1/transition

Анимируйте управляемый переход между выбранными первым и последним кадрами.

gemini-omni-flash/image-to-video

Оживите неподвижное изображение и создайте короткое видео с синхронным звуком.

happyhorse-1.0/reference-to-video

HappyHorse 1.0 Reference to Video объединяет до 9 эталонных изображений и подсказку в связный многосимвольный клип со стабильной идентичностью.

video-background-removal/fast/video-to-video

Удаляйте фон версией Fast и настраивайте кодек, уточнение краёв и тип объекта.

steady-dancer

Анимируйте референсное изображение с помощью движений из управляющего видео.

wan-2-5/image-to-video

Создавайте анимированные ролики из изображений с синхронным звуком

Часто задаваемые вопросы

Что такое Ace Step 1.5 и как он работает в процессе text-to-audio?

Ace Step 1.5 — модель преобразования текста в музыку от acestep-ai, которая создаёт полноценные треки с мелодией, ритмом и вокалом по тегам стиля и необязательному структурированному тексту. В процессе на RunComfy вы описываете жанр, настроение и структуру песни, а Ace Step 1.5 генерирует связную композицию с синхронизированной фразировкой. Модель предназначена для быстрой генерации музыки по промпту без ручного сочинения.

Для каких задач генерации лучше всего подходит Ace Step 1.5?

Ace Step 1.5 хорошо подходит для фоновой музыки к видео, коротких демо, атмосферных лупов, рекламных джинглов и референсных треков к игровым сценам. Теги позволяют несколькими описаниями задать жанр, инструменты и энергию. Генерация текста и вокала также делает Ace Step 1.5 полезным для черновиков песен и творческих прототипов.

Как Ace Step 1.5 соотносится с исходным Ace Step и другими музыкальными моделями?

В сравнении с исходным Ace Step версия 1.5 сохраняет управление тегами и максимальную длительность 4 минуты, расширяет поддержку текстов до 50+ языков и улучшает работу со структурированными текстами. В отличие от систем только для инструментальной музыки, Ace Step 1.5 нативно создаёт вокал, инструментовку и синхронизированную фразировку за один проход. Параметр seed также позволяет разработчикам последовательно повторять итерации.

Каким командам и сценариям больше всего подходит Ace Step 1.5 в продакшене?

Дизайнеры, технические художники, авторы видео и продуктовые команды могут использовать Ace Step 1.5 для трейлеров, соцсетей, игровых аудиопрототипов, e-commerce-видео и рекламы. Разработчики могут встроить модель в конвейеры, где саундтрек создаётся по требованию из метаданных сцены или брифа кампании. Поддержка вокала и инструментала на многих языках закрывает широкий набор задач в одном интерфейсе.

Какие ограничения входа и выхода нужно учитывать перед использованием Ace Step 1.5?

Ace Step 1.5 поддерживает гибкую длительность от 5 секунд до 240 секунд (4 минуты) на одну генерацию, одно обязательное поле tags и необязательное структурированное поле lyrics. Другие ограничения, включая аудиоформаты и сочетания тегов, зависят от текущей конфигурации поставщика. Проверяйте точные лимиты в панели параметров RunComfy, поскольку они могут различаться по режимам и провайдерам.

Как перейти от тестирования Ace Step 1.5 в интерфейсе к продакшену через API RunComfy?

Проверьте Ace Step 1.5 в Web UI RunComfy AI Playground, меняя теги стиля, текст, длительность и seed, пока результат text-to-audio не совпадёт с целью. После стабилизации настроек вызывайте ту же модель Ace Step 1.5 через API RunComfy с идентичными параметрами для автоматизации в бэкенде или контентном конвейере. Творческие итерации остаются в браузере, а продакшен выполняется в коде без изменения поведения модели.

Как рассчитывается цена аудио, созданного Ace Step 1.5 на RunComfy?

Генерации Ace Step 1.5 расходуют кредиты USD с баланса RunComfy и, по доступной информации поставщика, стоят $0.0004 за секунду. Новые пользователи обычно получают бесплатную сумму для тестирования; затем действуют правила раздела Generation на странице модели. Актуальные тарифы и различия между режимами смотрите в этом разделе.

Подписывайтесь на нас
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Поддержка
  • Discord
  • Email
  • Статус системы
  • партнёр
Модели видео
  • PixVerse V6
  • PixVerse V6 Text To Video
  • PixVerse C1
  • Wan 2.6 Flash
  • Wan 2.5
  • Wan 3.0
  • Посмотреть все модели →
Модели изображений
  • Qwen Image 2.1
  • Qwen Image 2.1 T2I
  • Wan 2.6 Image to Image
  • Seedream 5.0 Pro
  • Nano Banana Pro
  • Flux 2 Pro
  • Посмотреть все модели →
Юридическая информация
  • Условия обслуживания
  • Политика конфиденциальности
  • Политика в отношении файлов cookie
RunComfy
Авторское право 2026 RunComfy. Все права защищены.

RunComfy - ведущая ComfyUI платформа, предлагающая ComfyUI онлайн среду и услуги, а также рабочие процессы ComfyUI с потрясающей визуализацией. RunComfy также предоставляет AI Models, позволяя художникам использовать новейшие инструменты AI для создания невероятного искусства.