logo
RunComfy
  • ComfyUI
  • TreinadorNovo
  • Modelos
  • API
  • Preços
discord logo
MODELOS
Explorar
Todos os modelos
BIBLIOTECA
Gerações
APIS DE MODELOS
Documentação da API
Chaves API
CONTA
Uso

Ace Step 1.5: música a partir de texto com vocais, letras e tags de estilo no RunComfy e via API | RunComfy

acestep-ai/ace-step-1.5/text-to-audio

Gere músicas de até 4 minutos a partir de tags de estilo e letras opcionais, com vocais originais e alta fidelidade acústica, no RunComfy e via API HTTP.

Lista de tags de gênero, clima e instrumentos, separadas por vírgulas, que orientam o estilo da faixa gerada.
Conteúdo vocal opcional. Deixe em branco ou use [inst] / [instrumental] para uma faixa instrumental; use os marcadores [Verse], [Chorus] e [Bridge] para estruturar a música.
Duração do áudio em segundos.
Idle
The rate is $0.0003 per second.

Introdução ao Ace Step 1.5

Ace Step 1.5, do ACE Studio, transforma tags de estilo e letras estruturadas opcionais em músicas completas de até 4 minutos por $0.0003 por segundo. Ele aceita 50+ idiomas e oferece vocais coerentes e alta fidelidade acústica. A geração orientada por tags e controlada por prompt substitui sessões manuais de composição, contratação de cantores e produção multifaixa, acelerando a criação musical para equipes de mídia, estúdios de jogos, criadores de conteúdo e produtores de publicidade. Os desenvolvedores podem usar Ace Step 1.5 no RunComfy pelo navegador ou por uma API HTTP, sem precisar hospedar ou escalar o modelo.
Ideal para: protótipos de demos musicais | trilhas para cinema e jogos | música publicitária curta

ACE Studio / Ace Step 1.5#


Ace Step 1.5 é um modelo de texto para música que transforma tags de estilo separadas por vírgulas e letras estruturadas opcionais em músicas completas com vocais, instrumentação e fraseado sincronizado. Ele aceita 50+ idiomas, funciona com eficiência e foi criado para iterações rápidas, com durações de poucos segundos a 4 minutos (240 segundos).


Formato de saída: somente áudio / duração de 5–240 segundos / estéreo / taxa de amostragem definida pelo provedor.


Parâmetros#


ParâmetroObrigatórioTipoPadrãoFaixa / OpçõesDescrição
tags*Sim (*)string—Texto livreLista separada por vírgulas de tags de gênero, clima e instrumentos.
lyricsNãostring—Texto livre ou [inst] / [instrumental]Conteúdo vocal; use marcadores como [Verse], [Chorus] e [Bridge] para estruturar a música.
durationNãointeger605 – 240Duração do áudio em segundos.
seedNãointeger-1-1 – 2147483647Seed aleatório para reprodutibilidade; -1 gera um valor aleatório.

Preços#


Ace Step 1.5 no RunComfy cobra o áudio gerado de acordo com a duração.


Unidade de cobrançaTarifa
Por segundo de áudio gerado$0.0003

Exemplos de custos estimados


DuraçãoCusto aproximado
30 s~$0.009
60 s (padrão)~$0.018
120 s~$0.036
240 s (4 min)~$0.072

Como usar#


1) Abra Ace Step 1.5 no RunComfy e exiba o painel de geração.

2) Insira tags de estilo como "lofi, hiphop, chill, mellow piano" para definir gênero, clima e instrumentação.

3) Adicione a letra se desejar; separe claramente as seções [Verse], [Chorus] e [Bridge] ou use [inst] para uma faixa instrumental.

4) Defina duration em segundos (5–240); comece com uma duração curta para testar a direção antes de gerar os 4 minutos completos.

5) Fixe seed para comparar o efeito de mudanças nas tags ou na letra, ou deixe-o em -1 para obter mais variedade.

6) Execute a geração, ouça a prévia e baixe o arquivo de áudio do histórico de tarefas.

7) Para usar a API, envie os mesmos campos ao endpoint do Ace Step 1.5 no RunComfy; não é necessário self-hosting.

8) Salve seeds e combinações de tags promissoras como predefinições para manter a direção sonora consistente no projeto.

Modelos Relacionados

Hailuo Video 01

Transforme textos e imagens em vídeos realistas e dinâmicos com IA

kling-video-o1/image-to-video

Gere um vídeo de 5 ou 10 segundos entre imagens inicial e final obrigatórias. Descreva a transição no prompt com @Image1 e @Image2.

hailuo-02/image-to-video

Gere vídeos em HD com IA a partir de imagens, com movimento fluido e alta precisão

happyhorse-1.1/reference-to-video

Transforme imagens de referência em vídeo fluido de 720P ou 1080P com um único prompt.

wan-2.7/reference-to-video

Transforme referências visuais ou de áudio em clipes HD com controle preciso do movimento.

bytedance/upscale/video

Amplie um vídeo de origem para a resolução e a taxa de quadros selecionadas.

Perguntas Frequentes

O que é Ace Step 1.5 e o que ele faz em um fluxo de texto para áudio?

Ace Step 1.5 é um modelo de texto para música da acestep-ai que transforma tags de estilo e letras estruturadas opcionais em faixas completas com melodia, ritmo e vocais. Em um fluxo de texto para áudio no RunComfy, você descreve gênero, clima e estrutura da música; Ace Step 1.5 gera então uma composição coerente com fraseado sincronizado. Ele foi criado para quem quer gerar música rapidamente por prompt, sem composição manual.

Para quais tarefas de geração Ace Step 1.5 é mais indicado?

Ace Step 1.5 é ideal para música de fundo de vídeos, demos curtas, loops ambientes, jingles publicitários e faixas de referência para cenas de jogos. O controle por tags permite orientar gênero, instrumentação e energia com poucos descritores. A geração de letras e vocais também torna Ace Step 1.5 útil em rascunhos de músicas e protótipos criativos.

Como Ace Step 1.5 se compara ao Ace Step original e a outros modelos musicais?

Em comparação com Ace Step original, a versão 1.5 mantém o controle por tags e a duração máxima de 4 minutos, amplia o suporte de letras para 50+ idiomas e melhora o tratamento de letras estruturadas. Em comparação com sistemas apenas instrumentais, Ace Step 1.5 gera nativamente vocais, instrumentação e fraseado sincronizado em uma única passagem. O parâmetro seed também permite que os desenvolvedores repitam iterações de forma consistente.

Quais equipes e casos de uso mais se beneficiam de Ace Step 1.5 em produção?

Designers, artistas técnicos, criadores de vídeo e equipes de produto podem usar Ace Step 1.5 em trailers, conteúdo social, protótipos de áudio para jogos, vídeos de e-commerce e peças publicitárias. Os desenvolvedores podem integrá-lo a pipelines que geram trilhas sob demanda a partir de metadados da cena ou do briefing da campanha. O suporte a vocais e instrumentais em vários idiomas cobre diversas necessidades em uma única interface.

Quais limites de entrada e saída devo conhecer antes de usar Ace Step 1.5?

Ace Step 1.5 aceita durações flexíveis de 5 segundos a 240 segundos (4 minutos) por geração, com um único campo tags obrigatório e lyrics estruturado opcional. Outros limites, como formatos de áudio e combinações de tags, dependem da configuração atual do provedor. Consulte os limites exatos no painel de parâmetros do RunComfy, pois eles podem variar por modo ou provedor.

Como passar dos testes de Ace Step 1.5 na interface para o uso em produção pela API do RunComfy?

Você pode testar Ace Step 1.5 na Web UI do RunComfy AI Playground e ajustar tags de estilo, letra, duração e seed até que a saída de texto para áudio corresponda ao objetivo. Quando a configuração estiver estável, chame o mesmo modelo Ace Step 1.5 pela API do RunComfy com parâmetros idênticos para automatizar a geração no backend ou pipeline de conteúdo. A iteração criativa fica no navegador e a produção no código, sem mudar o comportamento do modelo.

Como é calculado o preço do áudio gerado com Ace Step 1.5 no RunComfy?

As gerações Ace Step 1.5 consomem créditos USD do saldo do RunComfy e, segundo as informações disponíveis do provedor, custam $0.0003 por segundo. Normalmente, novos usuários recebem um valor de teste gratuito; depois disso, valem as regras da seção Generation na página do modelo. Consulte essa seção para as tarifas atuais e eventuais diferenças entre modos.

Siga-nos
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Suporte
  • Discord
  • E-mail
  • Status do Sistema
  • afiliado
Modelos de Vídeo
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Ver todos os modelos →
Modelos de Imagem
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Ver todos os modelos →
Legal
  • Termos de Serviço
  • Política de Privacidade
  • Política de Cookies
RunComfy
Copyright 2026 RunComfy. Todos os Direitos Reservados.

RunComfy é a principal ComfyUI plataforma, oferecendo ComfyUI online ambiente e serviços, juntamente com fluxos de trabalho do ComfyUI apresentando visuais impressionantes. RunComfy também oferece AI Models, permitindo que artistas utilizem as mais recentes ferramentas de AI para criar arte incrível.