logo
RunComfy
  • ComfyUI
  • TreinadorNovo
  • Modelos
  • API
  • Preços
discord logo
MODELOS
Explorar
Todos os modelos
BIBLIOTECA
Gerações
APIS DE MODELOS
Documentação da API
Chaves API
CONTA
Uso

ACE-Step Audio Inpaint: edição de segmentos de áudio e reescrita de letras e estilo no RunComfy e via API | RunComfy

acestep-ai/ace-step/audio-inpaint

Ressintetize um trecho selecionado de uma faixa com novas tags de estilo ou letras e reinsira-o na mixagem original, no RunComfy e via API HTTP.

0:00
0:00
Áudio de origem a ser editado. Forneça a URL HTTPS de um arquivo MP3, WAV ou FLAC com até 60 minutos.
Tags de gênero, clima e instrumentos, separadas por vírgulas, que orientam o estilo do trecho regenerado.
Ponto de referência do tempo inicial: 'start' conta a partir do início da faixa, enquanto 'end' conta de trás para frente a partir do fim.
Início do trecho editável, em segundos, medido a partir do ponto de referência selecionado.
Ponto de referência do tempo final: 'start' conta a partir do início da faixa, enquanto 'end' conta de trás para frente a partir do fim.
Fim do trecho editável, em segundos, medido a partir do ponto de referência selecionado.
Letra opcional para o trecho regenerado. Deixe em branco para o modelo escrevê-la ou use [inst] / [instrumental] para não gerar vocais.
Seed aleatório para obter resultados reproduzíveis. Use -1 para escolher um valor aleatório.
Idle
The rate is $0.0002 per second of output audio.

Introdução ao ACE-Step Audio Inpaint

ACE-Step Audio Inpaint, do ACE Studio, ressintetiza um trecho selecionado de uma faixa existente por $0.0002 por segundo de áudio de saída. Ele pode trocar letras, instrumentação ou clima sem alterar o restante da mixagem. As edições direcionadas por prompt evitam a regeneração da música inteira e a manipulação manual de stems, encurtando os ciclos de correção e remix para produtores, designers de som, equipes de áudio de jogos e criativos de publicidade. Os desenvolvedores podem usar ACE-Step Audio Inpaint no RunComfy pelo navegador ou por uma API HTTP, sem precisar hospedar ou escalar o modelo.
Ideal para: reescrita de letras e punch-ins | restilização e remix de seções | correção de locução e efeitos sonoros

ACE Studio / ACE-Step Audio Inpaint#


ACE-Step Audio Inpaint é um modelo de edição de áudio que regenera um trecho definido de uma faixa existente sem alterar o restante. Forneça a URL do áudio de origem, marque o início e o fim do trecho e descreva a substituição com tags de estilo e uma letra opcional. O modelo sintetiza o novo segmento e o integra à mixagem ao redor.


Formato de saída: somente áudio / fonte de até 60 minutos / intervalo editável de 0–240 segundos / taxa de amostragem definida pelo provedor.


Principais recursos#


  • Reescrita de trechos: delimite uma janela com os tempos inicial e final e ressintetize somente esse trecho; tudo o que estiver fora permanece idêntico bit a bit.
  • Emenda consciente das bordas: o modelo considera o áudio imediatamente anterior e posterior para alinhar a edição em andamento, tonalidade e timbre sem emendas perceptíveis.
  • Referência a partir das duas extremidades: os tempos podem ser contados desde o início ou de trás para frente a partir do final, simplificando correções de encerramentos e caudas.
  • Restilização e reescrita de letras por tags: oriente nova instrumentação, clima ou linha vocal com uma lista curta de tags e uma letra opcional.
  • Resultados reproduzíveis: fixe seed para manter uma versão específica ou use um valor aleatório para experimentar variações do mesmo briefing.
  • Paridade entre interface e API: os mesmos dados funcionam na interface do RunComfy e pela API HTTP.

Parâmetros#


ParâmetroObrigatórioTipoPadrãoFaixa / OpçõesDescrição
audio*Sim (*)string—URL HTTPS de MP3 / WAV / FLAC, até 60 minArquivo de áudio de origem a ser editado.
tags*Sim (*)string—Texto livreTags de gênero, clima e instrumentos separadas por vírgulas que orientam o estilo do segmento.
start_time_relative_toNãostringstartstart, endPonto de referência de start_time.
start_timeNãonumber—0 – 240Início do segmento editável, em segundos.
end_time_relative_toNãostringstartstart, endPonto de referência de end_time.
end_timeNãonumber300 – 240Final do segmento editável, em segundos.
lyricsNãostring—Texto livre ou [inst] / [instrumental]Letra do segmento regenerado; se ficar vazio, o modelo escreve uma.
seedNãointeger-1-1 – 2147483647Seed aleatório para reprodutibilidade; -1 gera um valor aleatório.

Preços#


ACE-Step Audio Inpaint no RunComfy é cobrado de acordo com a duração do áudio de saída.


Unidade de cobrançaTarifa
Por segundo de áudio de saída$0.0002

Exemplos de custos estimados


Duração da saídaCusto aproximado
30 s~$0.006
60 s~$0.012
180 s (3 min)~$0.036

Dicas de prompt e referência#


  • Posicione as bordas do segmento em batidas naturais ou no fim de uma frase musical para que as transições pareçam intencionais.
  • Combine tags complementares, por exemplo, "lofi, mellow piano, soft drums", para definir gênero e instrumentação do segmento.
  • Mantenha as novas tags próximas da energia do áudio ao redor para uma correção discreta; afaste-as de propósito quando quiser um remix.
  • Forneça uma letra estruturada e com número consistente de sílabas para alinhar o novo fraseado vocal aos compassos vizinhos.
  • Para uma seção instrumental ou para remover os vocais, defina lyrics como [inst] ou [instrumental].
  • Use start_time_relative_to: end com um pequeno deslocamento para ajustar um fade-out ou o último hook sem recalcular o tempo desde o início.
  • Fixe seed durante as iterações e altere apenas tags ou letras, assim você poderá atribuir as diferenças a cada edição.
  • Restrinja a edição a janelas específicas, de poucos compassos, para obter uma integração mais limpa que ao reescrever intervalos muito longos.

Modelos Relacionados

pikaffects

Transforme uma única imagem em vídeo aplicando o Pikaffect que você escolher.

hailuo-2-3/fast/standard/image-to-video

Transforme imagens estáticas em vídeos realistas com rapidez e fluidez criativa.

kling-video-o3/pro/text-to-video

Texto para vídeo cinematográfico de nível Pro por US$ 0,112 por segundo de saída.

kling-2-6/pro/text-to-video

Transforme um prompt em vídeo curto, com duração, proporção e geração de áudio configuráveis.

pikadditions

Adicione com o Pikadditions uma pessoa ou um objeto de uma imagem a um vídeo existente.

wan-2-6/text-to-video

Gere um vídeo de 5, 10 ou 15 segundos a partir de um prompt de texto, com fonte de áudio opcional e controles de tamanho, estrutura da cena, prompt negativo, propagação, expansão do prompt e áudio gerado.

Perguntas Frequentes

O que é ACE-Step Audio Inpaint e o que ele faz em um fluxo de áudio para áudio?

ACE-Step Audio Inpaint é um modelo de edição de áudio da acestep-ai que reescreve um intervalo escolhido de uma faixa preservando o áudio ao redor. Em um fluxo de áudio para áudio no RunComfy, você fornece a URL de origem, marca os tempos inicial e final e adiciona tags de estilo ou uma nova letra; ACE-Step Audio Inpaint regenera somente esse segmento. Ele foi desenvolvido para correção, restilização e remix direcionado sem renderizar novamente a música inteira.

Para quais tarefas de geração ACE-Step Audio Inpaint é mais indicado?

ACE-Step Audio Inpaint é ideal para corrigir compassos fora do tempo ou com ruído, reescrever um verso ou refrão, mudar a instrumentação de uma seção e substituir uma linha da letra em uma faixa pronta. Ele também funciona bem em correções curtas de locução ou efeitos sonoros quando o áudio ao redor deve permanecer intacto. Como atua por segmento, é mais adequado para remix, preparação de masterização e edição de conteúdo que para gerar músicas inteiras.

Como ACE-Step Audio Inpaint se compara a modelos completos de texto para música ou à edição por stems?

Em comparação com modelos completos de texto para música, ACE-Step Audio Inpaint edita um intervalo de tempo e o integra à faixa existente em vez de criar uma música do zero. Em comparação com a separação e regeneração manual de stems, ele reúne seleção do segmento, ressíntese e crossfade em uma única passagem de áudio para áudio. Assim, artistas técnicos controlam com mais precisão o que muda e o que permanece igual.

Quais equipes e casos de uso mais se beneficiam de ACE-Step Audio Inpaint em produção?

Produtores musicais, designers de som, equipes de áudio de jogos e criativos de publicidade usam ACE-Step Audio Inpaint para corrigir, reescrever ou mudar o estilo de seções específicas. Os desenvolvedores podem integrá-lo a editores que permitem selecionar um intervalo e enviar novas tags ou letras. Equipes de conteúdo também podem usá-lo em ajustes finais de trailers, podcasts e cinemáticas de jogos.

Quais limites de entrada e saída devo conhecer antes de usar ACE-Step Audio Inpaint?

Normalmente, o áudio de origem é fornecido por uma URL HTTPS pública para MP3, WAV ou FLAC e, segundo as informações disponíveis, pode ter até cerca de 60 minutos. Em ACE-Step Audio Inpaint, start_time e end_time delimitam o segmento em segundos; ambos aceitam valores no intervalo 0–240 e podem ser ancorados no início ou no fim da faixa. Taxa de amostragem e formatos exatos dependem do provedor, portanto consulte os limites ativos no painel de parâmetros do RunComfy.

Como passar dos testes de ACE-Step Audio Inpaint no Playground para o uso em produção pela API do RunComfy?

Você pode testar ACE-Step Audio Inpaint na Web UI do RunComfy AI Playground, ajustanda URL do áudio, intervalo, tags, letra e seed até que o resultado de áudio para áudio corresponda ao objetivo. Quando a configuração estiver estável, chame o mesmo modelo ACE-Step Audio Inpaint pela API do RunComfy com parâmetros idênticos para automatizar edições no backend ou pipeline de conteúdo. A iteração criativa fica no navegador e a produção no código, sem mudar o comportamento do modelo.

Como é calculado o preço de ACE-Step Audio Inpaint no RunComfy?

As gerações ACE-Step Audio Inpaint consomem créditos USD do saldo do RunComfy e, segundo as informações disponíveis do provedor, custam $0.0002 por segundo de áudio de saída. Normalmente, novos usuários recebem um valor de teste gratuito; depois disso, valem as regras da seção Generation na página do modelo. Consulte essa seção para as tarifas atuais e eventuais diferenças entre modos.

Posso usar comercialmente as saídas de ACE-Step Audio Inpaint?

O RunComfy oferece acesso a ACE-Step Audio Inpaint e ao fluxo de áudio para áudio, mas os direitos comerciais sobre o áudio editado dependem da licença do autor e provedor original, acestep-ai, e dos direitos que você possui sobre a faixa enviada. Antes de publicar áudio editado em produtos, anúncios, filmes ou jogos, confira a licença oficial ACE-Step e os direitos sobre o áudio de origem. Para dúvidas sobre a plataforma, escreva para hi@runcomfy.com.

Siga-nos
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Suporte
  • Discord
  • E-mail
  • Status do Sistema
  • afiliado
Modelos de Vídeo
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Ver todos os modelos →
Modelos de Imagem
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Ver todos os modelos →
Legal
  • Termos de Serviço
  • Política de Privacidade
  • Política de Cookies
RunComfy
Copyright 2026 RunComfy. Todos os Direitos Reservados.

RunComfy é a principal ComfyUI plataforma, oferecendo ComfyUI online ambiente e serviços, juntamente com fluxos de trabalho do ComfyUI apresentando visuais impressionantes. RunComfy também oferece AI Models, permitindo que artistas utilizem as mais recentes ferramentas de AI para criar arte incrível.