logo
RunComfy
  • ComfyUI
  • ТренерНовое
  • Модели
  • API
  • Цены
discord logo
МОДЕЛИ
Обзор
Все модели
БИБЛИОТЕКА
Генерации
API МОДЕЛЕЙ
Документация API
API-ключи
АККАУНТ
Использование

ACE-Step Audio Inpaint: редактирование аудиофрагментов, текста и стиля на RunComfy и через API | RunComfy

acestep-ai/ace-step/audio-inpaint

Повторно синтезируйте выбранный фрагмент аудиодорожки с новыми тегами стиля или текстом и аккуратно вставьте его в исходный микс — на RunComfy и через HTTP API.

0:00
0:00
Исходное аудио для редактирования. Укажите HTTPS-URL файла MP3, WAV или FLAC длительностью до 60 минут.
Разделённые запятыми теги жанра, настроения и инструментов, которые задают стиль перегенерируемого фрагмента.
Точка отсчёта начального времени: 'start' считает от начала дорожки, а 'end' — назад от её конца.
Начало редактируемого фрагмента в секундах относительно выбранной точки отсчёта.
Точка отсчёта конечного времени: 'start' считает от начала дорожки, а 'end' — назад от её конца.
Конец редактируемого фрагмента в секундах относительно выбранной точки отсчёта.
Необязательный текст для перегенерируемого фрагмента. Оставьте поле пустым, чтобы его написала модель, или используйте [inst] / [instrumental], чтобы исключить вокал.
Случайный seed для воспроизводимости результата. Укажите -1, чтобы выбрать случайное значение.
Idle
The rate is $0.0002 per second of output audio.

Введение в ACE-Step Audio Inpaint

ACE-Step Audio Inpaint от ACE Studio повторно синтезирует выбранный фрагмент существующего трека по тарифу $0.0002 за секунду выходного аудио. Модель может заменить текст, инструментовку или настроение, сохранив остальной микс без изменений. Точечная обработка по промпту избавляет от полной регенерации песни и ручной работы со стемами, ускоряя исправление и ремикширование для продюсеров, саунд-дизайнеров, игровых аудиокоманд и рекламных креаторов. Разработчики могут использовать ACE-Step Audio Inpaint на RunComfy в браузере или через HTTP API без самостоятельного размещения и масштабирования модели.
Идеально для: замены строк и punch-in | рестайлинга и ремикса отдельных секций | исправления закадровой речи и звуковых эффектов

ACE Studio / ACE-Step Audio Inpaint#


ACE-Step Audio Inpaint — модель редактирования аудио, которая заново синтезирует заданный фрагмент существующего трека, не затрагивая остальное. Передайте URL исходного аудио, укажите начало и конец фрагмента и опишите замену тегами стиля и необязательным текстом. Модель создаст новый сегмент и аккуратно встроит его в окружающий микс.


Формат результата: только аудио / источник до 60 минут / редактируемый диапазон 0–240 секунд / частота дискретизации определяется поставщиком.


Основные возможности#


  • Перезапись отдельных фрагментов: задайте окно начальным и конечным временем и синтезируйте только его; всё за пределами окна остаётся побитово идентичным.
  • Плавная склейка на границах: модель учитывает аудио непосредственно до и после фрагмента, чтобы правка совпала по темпу, тональности и тембру без заметных швов.
  • Отсчёт с любой стороны: временные метки можно считать от начала или назад от конца, что упрощает исправление аутро и финальных фрагментов.
  • Рестайлинг и замена текста по тегам: управляйте новой инструментовкой, настроением или вокальной строкой с помощью короткого списка тегов и необязательного текста.
  • Воспроизводимые варианты: зафиксируйте seed для конкретного результата или используйте случайное значение для других вариаций того же задания.
  • Одинаковые возможности интерфейса и API: одни и те же входные данные работают в интерфейсе RunComfy и через HTTP API.

Параметры#


ПараметрОбязательныйТипПо умолчаниюДиапазон / ВариантыОписание
audio*Да (*)string—HTTPS URL файла MP3 / WAV / FLAC, до 60 минИсходный аудиофайл для редактирования.
tags*Да (*)string—Произвольный текстРазделённые запятыми теги жанра, настроения и инструментов для стиля сегмента.
start_time_relative_toНетstringstartstart, endТочка отсчёта для start_time.
start_timeНетnumber—0 – 240Начало редактируемого сегмента в секундах.
end_time_relative_toНетstringstartstart, endТочка отсчёта для end_time.
end_timeНетnumber300 – 240Конец редактируемого сегмента в секундах.
lyricsНетstring—Произвольный текст или [inst] / [instrumental]Текст для нового сегмента; если поле пустое, модель напишет его сама.
seedНетinteger-1-1 – 2147483647Случайный seed для воспроизводимости; -1 выбирает случайное значение.

Цены#


ACE-Step Audio Inpaint на RunComfy тарифицируется по длительности выходного аудио.


Единица тарификацииТариф
За секунду выходного аудио$0.0002

Примеры расчётной стоимости


Длительность результатаПримерная стоимость
30 с~$0.006
60 с~$0.012
180 с (3 мин)~$0.036

Советы по промптам и референсам#


  • Ставьте границы сегмента на естественных долях или концах музыкальных фраз, чтобы переходы звучали намеренно.
  • Объединяйте дополняющие теги, например "lofi, mellow piano, soft drums", чтобы зафиксировать жанр и инструментовку сегмента.
  • Для незаметной правки согласуйте новые теги с энергией окружающего аудио; для ремикса намеренно выберите другое направление.
  • Используйте структурированный текст с одинаковым числом слогов, чтобы новая вокальная фразировка совпала с соседними тактами.
  • Для инструментальной секции или удаления вокала установите lyrics в [inst] или [instrumental].
  • Используйте start_time_relative_to: end с небольшим смещением, чтобы поправить fade-out или последний hook без пересчёта времени от начала.
  • При итерациях фиксируйте seed и меняйте только теги или текст, чтобы понимать влияние каждой правки.
  • Редактируйте небольшие точные окна по несколько тактов: они склеиваются чище, чем очень длинные диапазоны.

Похожие модели

ltx-2-19b/image-to-video/lora

Преобразует статичные изображения в выразительные видеоролики с синхронным звуком.

video-background-removal/video-to-video

Отделяйте людей или предметы от фона видео и настраивайте кодек, уточнение краёв и тип объекта.

wan-2-6/image-to-video

Преобразуйте статичные изображения в высокодетализированный видеоконтент с синхронизацией движения и гибким управлением с помощью Wan 2.6.

kling-video-o1/video-to-video/edit

Отредактируйте референсное видео с помощью промпта и дополнительных элементов или изображений, при необходимости сохранив исходную звуковую дорожку.

pixverse/v5.5/image-to-video

Оживите стартовое изображение по тексту и настройте формат, разрешение, длительность, стиль, аудио и несколько клипов.

seedance-2.0/fast

Быстрее создавайте кинематографичные ролики с мультимодальными референсами, синхронизацией губ и управлением камерой.

Часто задаваемые вопросы

Что такое ACE-Step Audio Inpaint и как он работает в процессе audio-to-audio?

ACE-Step Audio Inpaint — модель редактирования аудио от acestep-ai, которая переписывает выбранный временной диапазон трека, сохраняя окружающий звук. В процессе на RunComfy вы передаёте URL источника, указываете начальное и конечное время и добавляете теги стиля или новый текст; ACE-Step Audio Inpaint заново генерирует только этот сегмент. Модель предназначена для исправления, рестайлинга и точечного ремикса без повторного рендера всей песни.

Для каких задач генерации лучше всего подходит ACE-Step Audio Inpaint?

ACE-Step Audio Inpaint удобен для исправления сбившихся или шумных тактов, переписывания отдельного куплета или припева, смены инструментовки секции и замены строки текста в готовом треке. Он также подходит для коротких правок закадровой речи и звуковых эффектов, когда окружающее аудио должно остаться неизменным. Поскольку модель работает с сегментами, она полезнее для ремикса, подготовки к мастерингу и контентного монтажа, чем для создания целой песни.

Как ACE-Step Audio Inpaint соотносится с полноценными text-to-music-моделями и редактированием по стемам?

В отличие от полноценной генерации музыки из текста, ACE-Step Audio Inpaint меняет временной диапазон и плавно встраивает его в существующий трек, а не создаёт песню с нуля. В сравнении с ручным разделением и регенерацией стемов модель объединяет выбор сегмента, повторный синтез и crossfade за один проход audio-to-audio. Технические художники точнее контролируют, что изменится, а что останется прежним.

Каким командам и сценариям больше всего подходит ACE-Step Audio Inpaint в продакшене?

Музыкальные продюсеры, саунд-дизайнеры, игровые аудиокоманды и рекламные креаторы используют ACE-Step Audio Inpaint для исправления, переписывания и рестайлинга отдельных секций. Разработчики могут встроить модель в редакторы, где пользователь отмечает диапазон и отправляет новые теги или текст. Контентные команды также могут применять её для финальных правок трейлеров, подкастов и игровых роликов.

Какие ограничения входа и выхода нужно учитывать перед использованием ACE-Step Audio Inpaint?

Обычно исходное аудио передаётся по публичному HTTPS URL файла MP3, WAV или FLAC и, по доступной информации, может длиться примерно до 60 минут. В ACE-Step Audio Inpaint сегмент задаётся в секундах через start_time и end_time; оба значения находятся в диапазоне 0–240 и могут отсчитываться от начала или конца трека. Частота дискретизации и точные форматы зависят от провайдера, поэтому проверяйте актуальные лимиты в панели параметров RunComfy.

Как перейти от тестирования ACE-Step Audio Inpaint в Playground к продакшену через API RunComfy?

Проверьте ACE-Step Audio Inpaint в Web UI RunComfy AI Playground, меняя URL аудио, диапазон, теги, текст и seed, пока результат audio-to-audio не совпадёт с целью. После стабилизации настроек вызывайте ту же модель ACE-Step Audio Inpaint через API RunComfy с идентичными параметрами для автоматизации правок в бэкенде или контентном конвейере. Творческие итерации остаются в браузере, а продакшен выполняется в коде без изменения поведения модели.

Как рассчитывается цена ACE-Step Audio Inpaint на RunComfy?

Генерации ACE-Step Audio Inpaint расходуют кредиты USD с баланса RunComfy и, по доступной информации поставщика, стоят $0.0002 за секунду выходного аудио. Новые пользователи обычно получают бесплатную сумму для тестирования; затем действуют правила раздела Generation на странице модели. Актуальные тарифы и различия между режимами смотрите в этом разделе.

Можно ли коммерчески использовать результаты ACE-Step Audio Inpaint?

RunComfy предоставляет доступ к ACE-Step Audio Inpaint и процессу audio-to-audio, но коммерческие права на изменённое аудио зависят от лицензии исходного автора и поставщика, acestep-ai, а также от ваших прав на загруженный трек. Перед выпуском аудио в продуктах, рекламе, фильмах или играх изучите официальную лицензию ACE-Step и права на источник. По вопросам платформы можно написать на hi@runcomfy.com.

Подписывайтесь на нас
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Поддержка
  • Discord
  • Email
  • Статус системы
  • партнёр
Модели видео
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Посмотреть все модели →
Модели изображений
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Посмотреть все модели →
Юридическая информация
  • Условия обслуживания
  • Политика конфиденциальности
  • Политика в отношении файлов cookie
RunComfy
Авторское право 2026 RunComfy. Все права защищены.

RunComfy - ведущая ComfyUI платформа, предлагающая ComfyUI онлайн среду и услуги, а также рабочие процессы ComfyUI с потрясающей визуализацией. RunComfy также предоставляет AI Models, позволяя художникам использовать новейшие инструменты AI для создания невероятного искусства.