ACE Studio / Ace Step#
Ace Step é um modelo de texto para música que transforma tags de estilo separadas por vírgulas e letras opcionais em músicas completas com vocais, instrumentação e letra sincronizada. Ele foi criado para iterações rápidas e aceita durações de poucos segundos a 4 minutos (240 segundos).
Formato de saída: somente áudio / duração de 5–240 segundos / estéreo / taxa de amostragem definida pelo provedor.
Principais recursos#
- Geração de texto para música por tags: componha faixas listando gêneros, climas e instrumentos em vez de escrever parágrafos longos.
- Geração de vocais e letras: Ace Step pode escrever a própria letra ou cantar a letra fornecida pelo usuário com linhas vocais sincronizadas.
- Alta fidelidade acústica: preserva equilíbrio dinâmico, qualidade espacial e clareza dos instrumentos em toda a faixa de 4 minutos.
- Duração flexível: ajuste de loops curtos a faixas de 240 segundos para composições completas.
- Reprodutibilidade: defina um seed fixo para recriar exatamente o resultado ao iterar em tags ou letras.
- Paridade entre API e navegador: os mesmos parâmetros funcionam na interface do RunComfy e pela API HTTP.
Parâmetros#
| Parâmetro | Obrigatório | Tipo | Padrão | Faixa / Opções | Descrição |
|---|
| tags* | Sim (*) | string | — | Texto livre | Lista separada por vírgulas de tags de gênero, clima e instrumentos. |
| lyrics | Não | string | — | Texto livre ou [inst] / [instrumental] | Conteúdo vocal; deixe em branco para uma letra gerada por IA ou use [inst] para uma faixa instrumental. |
| duration | Não | integer | 60 | 5 – 240 | Duração do áudio em segundos. |
| seed | Não | integer | -1 | -1 – 2147483647 | Seed aleatório para reprodutibilidade; -1 gera um resultado aleatório. |
Preços#
Ace Step no RunComfy cobra o áudio gerado de acordo com a duração.
| Unidade de cobrança | Tarifa |
|---|
| Por segundo de áudio gerado | $0.0003 |
Exemplos de custos estimados
| Duração | Custo aproximado |
|---|
| 30 s | ~$0.009 |
| 60 s (padrão) | ~$0.018 |
| 120 s | ~$0.036 |
| 240 s (4 min) | ~$0.072 |
Como usar#
1) Abra Ace Step no RunComfy e exiba o painel de geração.
2) Insira tags de estilo como "lofi, hiphop, chill, mellow piano" para definir gênero, clima e instrumentação.
3) Adicione a letra se desejar; separe claramente verso e refrão ou use [inst] para uma faixa instrumental.
4) Defina duration em segundos (5–240); comece com uma duração curta para testar a direção antes de gerar os 4 minutos completos.
5) Fixe seed para comparar o efeito de mudanças nas tags ou na letra, ou deixe-o em -1 para obter mais variedade.
6) Execute a geração, ouça a prévia e baixe o arquivo de áudio do histórico de tarefas.
7) Para usar a API, envie os mesmos campos ao endpoint do Ace Step no RunComfy; não é necessário self-hosting.
8) Salve seeds e combinações de tags promissoras como predefinições para manter a direção sonora consistente no projeto.
Dicas de prompt e referência#
- Combine várias tags complementares, por exemplo, "trap, dark, 808, brass", para definir gênero, instrumentação e energia em uma única passagem.
- Misture tags contrastantes com cuidado, por exemplo, "chill, trap", para encontrar combinações originais sem confundir o arranjo.
- Forneça uma letra estruturada com marcadores claros [Verse] e [Chorus] e contagem de sílabas consistente para um fraseado vocal mais limpo.
- Comece com rascunhos de 30–45 s para validar a direção antes de solicitar renderizações mais longas de 120–240 s.
- Mantenha seed fixo durante as iterações e altere apenas tags ou letras, assim você poderá atribuir as diferenças a cada mudança.
- Evite indicações contraditórias como "low-fi yet ultra-hi-fi" e escolha uma estética dominante para cada faixa no Ace Step.
- Para músicas instrumentais, use [inst] ou [instrumental] no campo lyrics em vez de deixá-lo vazio.
- Se o resultado parecer apressado ou excessivamente estendido, ajuste duration em vez de impor restrições demais à letra.
Comparação entre Ace Step e outros modelos#
- Segundo informações publicamente disponíveis, Ace Step se concentra no controle por tags e em músicas de até 4 minutos, enquanto alguns modelos da família Suno privilegiam prompts livres e faixas padrão mais curtas.
- Em comparação com sistemas apenas instrumentais, como MusicGen, Ace Step gera nativamente vocais, letras e instrumentação em uma única passagem.
- Caso de uso ideal: escolha Ace Step quando precisar de músicas completas com vocais, controle de gênero por tags e seeds reproduzíveis para iteração.