Transforme textos e imagens em vídeos realistas e dinâmicos com IA
Ace Step 1.5 é um modelo de texto para música que transforma tags de estilo separadas por vírgulas e letras estruturadas opcionais em músicas completas com vocais, instrumentação e fraseado sincronizado. Ele aceita 50+ idiomas, funciona com eficiência e foi criado para iterações rápidas, com durações de poucos segundos a 4 minutos (240 segundos).
Formato de saída: somente áudio / duração de 5–240 segundos / estéreo / taxa de amostragem definida pelo provedor.
| Parâmetro | Obrigatório | Tipo | Padrão | Faixa / Opções | Descrição |
|---|---|---|---|---|---|
| tags* | Sim (*) | string | — | Texto livre | Lista separada por vírgulas de tags de gênero, clima e instrumentos. |
| lyrics | Não | string | — | Texto livre ou [inst] / [instrumental] | Conteúdo vocal; use marcadores como [Verse], [Chorus] e [Bridge] para estruturar a música. |
| duration | Não | integer | 60 | 5 – 240 | Duração do áudio em segundos. |
| seed | Não | integer | -1 | -1 – 2147483647 | Seed aleatório para reprodutibilidade; -1 gera um valor aleatório. |
Ace Step 1.5 no RunComfy cobra o áudio gerado de acordo com a duração.
| Unidade de cobrança | Tarifa |
|---|---|
| Por segundo de áudio gerado | $0.0003 |
Exemplos de custos estimados
| Duração | Custo aproximado |
|---|---|
| 30 s | ~$0.009 |
| 60 s (padrão) | ~$0.018 |
| 120 s | ~$0.036 |
| 240 s (4 min) | ~$0.072 |
1) Abra Ace Step 1.5 no RunComfy e exiba o painel de geração.
2) Insira tags de estilo como "lofi, hiphop, chill, mellow piano" para definir gênero, clima e instrumentação.
3) Adicione a letra se desejar; separe claramente as seções [Verse], [Chorus] e [Bridge] ou use [inst] para uma faixa instrumental.
4) Defina duration em segundos (5–240); comece com uma duração curta para testar a direção antes de gerar os 4 minutos completos.
5) Fixe seed para comparar o efeito de mudanças nas tags ou na letra, ou deixe-o em -1 para obter mais variedade.
6) Execute a geração, ouça a prévia e baixe o arquivo de áudio do histórico de tarefas.
7) Para usar a API, envie os mesmos campos ao endpoint do Ace Step 1.5 no RunComfy; não é necessário self-hosting.
8) Salve seeds e combinações de tags promissoras como predefinições para manter a direção sonora consistente no projeto.
Transforme textos e imagens em vídeos realistas e dinâmicos com IA
Gere um vídeo de 5 ou 10 segundos entre imagens inicial e final obrigatórias. Descreva a transição no prompt com @Image1 e @Image2.
Gere vídeos em HD com IA a partir de imagens, com movimento fluido e alta precisão
Transforme imagens de referência em vídeo fluido de 720P ou 1080P com um único prompt.
Transforme referências visuais ou de áudio em clipes HD com controle preciso do movimento.
Amplie um vídeo de origem para a resolução e a taxa de quadros selecionadas.
Ace Step 1.5 é um modelo de texto para música da acestep-ai que transforma tags de estilo e letras estruturadas opcionais em faixas completas com melodia, ritmo e vocais. Em um fluxo de texto para áudio no RunComfy, você descreve gênero, clima e estrutura da música; Ace Step 1.5 gera então uma composição coerente com fraseado sincronizado. Ele foi criado para quem quer gerar música rapidamente por prompt, sem composição manual.
Ace Step 1.5 é ideal para música de fundo de vídeos, demos curtas, loops ambientes, jingles publicitários e faixas de referência para cenas de jogos. O controle por tags permite orientar gênero, instrumentação e energia com poucos descritores. A geração de letras e vocais também torna Ace Step 1.5 útil em rascunhos de músicas e protótipos criativos.
Em comparação com Ace Step original, a versão 1.5 mantém o controle por tags e a duração máxima de 4 minutos, amplia o suporte de letras para 50+ idiomas e melhora o tratamento de letras estruturadas. Em comparação com sistemas apenas instrumentais, Ace Step 1.5 gera nativamente vocais, instrumentação e fraseado sincronizado em uma única passagem. O parâmetro seed também permite que os desenvolvedores repitam iterações de forma consistente.
Designers, artistas técnicos, criadores de vídeo e equipes de produto podem usar Ace Step 1.5 em trailers, conteúdo social, protótipos de áudio para jogos, vídeos de e-commerce e peças publicitárias. Os desenvolvedores podem integrá-lo a pipelines que geram trilhas sob demanda a partir de metadados da cena ou do briefing da campanha. O suporte a vocais e instrumentais em vários idiomas cobre diversas necessidades em uma única interface.
Ace Step 1.5 aceita durações flexíveis de 5 segundos a 240 segundos (4 minutos) por geração, com um único campo tags obrigatório e lyrics estruturado opcional. Outros limites, como formatos de áudio e combinações de tags, dependem da configuração atual do provedor. Consulte os limites exatos no painel de parâmetros do RunComfy, pois eles podem variar por modo ou provedor.
Você pode testar Ace Step 1.5 na Web UI do RunComfy AI Playground e ajustar tags de estilo, letra, duração e seed até que a saída de texto para áudio corresponda ao objetivo. Quando a configuração estiver estável, chame o mesmo modelo Ace Step 1.5 pela API do RunComfy com parâmetros idênticos para automatizar a geração no backend ou pipeline de conteúdo. A iteração criativa fica no navegador e a produção no código, sem mudar o comportamento do modelo.
As gerações Ace Step 1.5 consomem créditos USD do saldo do RunComfy e, segundo as informações disponíveis do provedor, custam $0.0003 por segundo. Normalmente, novos usuários recebem um valor de teste gratuito; depois disso, valem as regras da seção Generation na página do modelo. Consulte essa seção para as tarifas atuais e eventuais diferenças entre modos.
RunComfy é a principal ComfyUI plataforma, oferecendo ComfyUI online ambiente e serviços, juntamente com fluxos de trabalho do ComfyUI apresentando visuais impressionantes. RunComfy também oferece AI Models, permitindo que artistas utilizem as mais recentes ferramentas de AI para criar arte incrível.