logo
RunComfy
  • ComfyUI
  • TreinadorNovo
  • Modelos
  • API
  • Preços
discord logo
MODELOS
Explorar
Todos os modelos
BIBLIOTECA
Gerações
APIS DE MODELOS
Documentação da API
Chaves API
CONTA
Uso

Ace Step: música a partir de texto com vocais, letras e controle por tags de estilo no RunComfy e via API | RunComfy

acestep-ai/ace-step/text-to-audio

Gere músicas de até 4 minutos a partir de tags de estilo e letras opcionais, com vocais originais e alta fidelidade acústica, no RunComfy e via API HTTP.

Lista separada por vírgulas de tags de gênero, humor e instrumento para orientar o estilo da faixa gerada.
Conteúdo vocal opcional para a faixa. Deixe em branco para letras geradas por IA ou use [inst] / [instrumental] para não usar vocais.
Duração do áudio em segundos.
Idle
The rate is $0.0002 per second.

Introdução ao Ace Step

Ace Step, do ACE Studio, transforma tags de estilo e letras opcionais em músicas completas de até 4 minutos por $0.0002 por segundo, com vocais coerentes, instrumentação definida e alta fidelidade acústica. A geração orientada por tags e controlada por prompt substitui sessões manuais de composição, contratação de cantores e produção multifaixa, acelerando a criação musical para equipes de mídia, estúdios de jogos, criadores de conteúdo e produtores de publicidade. Os desenvolvedores podem usar Ace Step no RunComfy pelo navegador ou por uma API HTTP, sem precisar hospedar ou escalar o modelo.
Ideal para: protótipos de demos musicais | trilhas para cinema e jogos | música publicitária curta

ACE Studio / Ace Step#


Ace Step é um modelo de texto para música que transforma tags de estilo separadas por vírgulas e letras opcionais em músicas completas com vocais, instrumentação e letra sincronizada. Ele foi criado para iterações rápidas e aceita durações de poucos segundos a 4 minutos (240 segundos).


Formato de saída: somente áudio / duração de 5–240 segundos / estéreo / taxa de amostragem definida pelo provedor.


Principais recursos#


  • Geração de texto para música por tags: componha faixas listando gêneros, climas e instrumentos em vez de escrever parágrafos longos.
  • Geração de vocais e letras: Ace Step pode escrever a própria letra ou cantar a letra fornecida pelo usuário com linhas vocais sincronizadas.
  • Alta fidelidade acústica: preserva equilíbrio dinâmico, qualidade espacial e clareza dos instrumentos em toda a faixa de 4 minutos.
  • Duração flexível: ajuste de loops curtos a faixas de 240 segundos para composições completas.
  • Reprodutibilidade: defina um seed fixo para recriar exatamente o resultado ao iterar em tags ou letras.
  • Paridade entre API e navegador: os mesmos parâmetros funcionam na interface do RunComfy e pela API HTTP.

Parâmetros#


ParâmetroObrigatórioTipoPadrãoFaixa / OpçõesDescrição
tags*Sim (*)string—Texto livreLista separada por vírgulas de tags de gênero, clima e instrumentos.
lyricsNãostring—Texto livre ou [inst] / [instrumental]Conteúdo vocal; deixe em branco para uma letra gerada por IA ou use [inst] para uma faixa instrumental.
durationNãointeger605 – 240Duração do áudio em segundos.
seedNãointeger-1-1 – 2147483647Seed aleatório para reprodutibilidade; -1 gera um resultado aleatório.

Preços#


Ace Step no RunComfy cobra o áudio gerado de acordo com a duração.


Unidade de cobrançaTarifa
Por segundo de áudio gerado$0.0002

Exemplos de custos estimados


DuraçãoCusto aproximado
30 s~$0.006
60 s (padrão)~$0.012
120 s~$0.024
240 s (4 min)~$0.048

Como usar#


1) Abra Ace Step no RunComfy e exiba o painel de geração.

2) Insira tags de estilo como "lofi, hiphop, chill, mellow piano" para definir gênero, clima e instrumentação.

3) Adicione a letra se desejar; separe claramente verso e refrão ou use [inst] para uma faixa instrumental.

4) Defina duration em segundos (5–240); comece com uma duração curta para testar a direção antes de gerar os 4 minutos completos.

5) Fixe seed para comparar o efeito de mudanças nas tags ou na letra, ou deixe-o em -1 para obter mais variedade.

6) Execute a geração, ouça a prévia e baixe o arquivo de áudio do histórico de tarefas.

7) Para usar a API, envie os mesmos campos ao endpoint do Ace Step no RunComfy; não é necessário self-hosting.

8) Salve seeds e combinações de tags promissoras como predefinições para manter a direção sonora consistente no projeto.


Dicas de prompt e referência#


  • Combine várias tags complementares, por exemplo, "trap, dark, 808, brass", para definir gênero, instrumentação e energia em uma única passagem.
  • Misture tags contrastantes com cuidado, por exemplo, "chill, trap", para encontrar combinações originais sem confundir o arranjo.
  • Forneça uma letra estruturada com marcadores claros [Verse] e [Chorus] e contagem de sílabas consistente para um fraseado vocal mais limpo.
  • Comece com rascunhos de 30–45 s para validar a direção antes de solicitar renderizações mais longas de 120–240 s.
  • Mantenha seed fixo durante as iterações e altere apenas tags ou letras, assim você poderá atribuir as diferenças a cada mudança.
  • Evite indicações contraditórias como "low-fi yet ultra-hi-fi" e escolha uma estética dominante para cada faixa no Ace Step.
  • Para músicas instrumentais, use [inst] ou [instrumental] no campo lyrics em vez de deixá-lo vazio.
  • Se o resultado parecer apressado ou excessivamente estendido, ajuste duration em vez de impor restrições demais à letra.

Comparação entre Ace Step e outros modelos#


  • Segundo informações publicamente disponíveis, Ace Step se concentra no controle por tags e em músicas de até 4 minutos, enquanto alguns modelos da família Suno privilegiam prompts livres e faixas padrão mais curtas.
  • Em comparação com sistemas apenas instrumentais, como MusicGen, Ace Step gera nativamente vocais, letras e instrumentação em uma única passagem.
  • Caso de uso ideal: escolha Ace Step quando precisar de músicas completas com vocais, controle de gênero por tags e seeds reproduzíveis para iteração.

Modelos Relacionados

ltx-2.5/text-to-video/fast

LTX 2.5 Fast texto para vídeo com rascunhos AV sincronizados até 4K

infinite-talk/fast

Gere um vídeo a partir de uma faixa de áudio e uma imagem, com prompt e seed opcionais.

hailuo-2-3/fast/standard/image-to-video

Transforme imagens estáticas em vídeos realistas com rapidez e fluidez criativa.

pikaffects

Transforme uma única imagem em vídeo aplicando o Pikaffect que você escolher.

Veo 2

Vídeos em 4K com física realista e controle de câmera preciso

wan-2-2/fun-inpaint

Transforme imagens em vídeos fluidos com animação entre quadros

Perguntas Frequentes

O que é Ace Step e o que ele faz em um fluxo de texto para som?

Ace Step é um modelo de texto para música da acestep-ai que transforma tags de estilo e prompts em faixas completas com melodia, ritmo e vocais. Em um fluxo de texto para som no RunComfy, você descreve gênero, clima e estrutura; Ace Step gera então uma peça coerente com letra sincronizada. Ele foi criado para quem quer gerar música rapidamente por prompt, sem composição manual.

Para quais tarefas de geração Ace Step é mais indicado?

Ace Step é ideal para criar música de fundo, demos curtas, loops ambientes, jingles publicitários e faixas de referência para cenas de vídeo ou jogos. O controle por tags permite orientar gênero, andamento e energia com poucos descritores. A geração de vocais e letras também ajuda em rascunhos de músicas e protótipos criativos.

Como Ace Step se compara a outros modelos musicais de texto para som em qualidade e controle?

Em comparação com muitos modelos de áudio genéricos, Ace Step prioriza alta precisão acústica, com atenção ao equilíbrio dinâmico, à qualidade espacial e à clareza dos instrumentos. A interface por tags oferece a artistas técnicos e designers controle mais direto sobre gênero e energia que prompts totalmente livres. O parâmetro seed também permite que os desenvolvedores repitam iterações de forma consistente.

Quais equipes e casos de uso mais se beneficiam de Ace Step em produção?

Designers, artistas técnicos, criadores de vídeo e equipes de produto podem usar Ace Step em trailers, conteúdo social, protótipos de áudio para jogos, vídeos de e-commerce e peças publicitárias. Os desenvolvedores podem integrá-lo a pipelines que geram trilhas sob demanda a partir de metadados da cena ou do briefing da campanha. Como aceita vocais e instrumentais, o modelo cobre várias necessidades de áudio em uma única interface.

Quais limites de entrada e saída devo conhecer antes de usar Ace Step?

Ace Step oferece duração flexível, de poucos segundos a cerca de 4 minutos (240 segundos) por geração. Outros limites, como tamanho do prompt, formatos de áudio e combinações de tags, dependem da configuração atual do provedor. Consulte o painel de parâmetros do RunComfy: os limites podem variar por modo ou provedor, e o painel sempre mostra os valores ativos do endpoint de texto para som.

Como passar dos testes de Ace Step no Playground para o uso em produção pela API do RunComfy?

Você pode testar Ace Step na Web UI do RunComfy AI Playground e ajustar tags de estilo, prompts, duração e seed até que a saída de texto para som corresponda ao objetivo. Quando a configuração estiver estável, chame o mesmo modelo Ace Step pela API do RunComfy com parâmetros idênticos para automatizar a geração no backend ou no pipeline de conteúdo. A iteração criativa fica no navegador e a produção no código, sem mudar o comportamento do modelo.

Como é calculado o preço do áudio gerado com Ace Step no RunComfy?

As gerações Ace Step consomem créditos USD do saldo do RunComfy e, segundo as informações disponíveis do provedor, custam $0.0002 por segundo. Normalmente, novos usuários recebem um valor de teste gratuito; depois disso, valem as regras da seção Generation na página do modelo. Consulte essa seção para as tarifas atuais e eventuais diferenças entre modos.

Posso usar comercialmente as saídas de texto para som do Ace Step?

O RunComfy oferece acesso a Ace Step e ao fluxo de geração de áudio, mas os direitos comerciais sobre a música dependem da licença do autor e provedor original, acestep-ai. Antes de publicar faixas em produtos, anúncios, filmes ou jogos, confira a licença oficial do Ace Step e os termos do provedor. Para dúvidas sobre a plataforma, escreva para hi@runcomfy.com.

Siga-nos
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Suporte
  • Discord
  • E-mail
  • Status do Sistema
  • afiliado
Modelos de Vídeo
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Ver todos os modelos →
Modelos de Imagem
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Ver todos os modelos →
Legal
  • Termos de Serviço
  • Política de Privacidade
  • Política de Cookies
RunComfy
Copyright 2026 RunComfy. Todos os Direitos Reservados.

RunComfy é a principal ComfyUI plataforma, oferecendo ComfyUI online ambiente e serviços, juntamente com fluxos de trabalho do ComfyUI apresentando visuais impressionantes. RunComfy também oferece AI Models, permitindo que artistas utilizem as mais recentes ferramentas de AI para criar arte incrível.