logo
RunComfy
  • ComfyUI
  • TrainerNuovo
  • Modelli
  • API
  • Prezzi
discord logo
MODELLI
Esplora
Tutti i modelli
LIBRERIA
Generazioni
API DEI MODELLI
Documentazione API
Chiavi API
ACCOUNT
Utilizzo

Ace Step 1.5: musica da testo con voce, testi e tag di stile su RunComfy e via API | RunComfy

acestep-ai/ace-step-1.5/text-to-audio

Genera da tag di stile e testi opzionali brani lunghi fino a 4 minuti, con voci originali e alta fedeltà acustica, su RunComfy e via API HTTP.

Elenco di tag di genere, atmosfera e strumenti, separati da virgole, che guidano lo stile del brano generato.
Contenuto vocale opzionale. Lascia vuoto o usa [inst] / [instrumental] per un brano strumentale; usa i marcatori [Verse], [Chorus] e [Bridge] per strutturare la canzone.
Durata dell’audio in secondi.
Idle
The rate is $0.0003 per second.

Introduzione a Ace Step 1.5

Ace Step 1.5 di ACE Studio trasforma tag testuali di stile e testi strutturati opzionali in brani completi lunghi fino a 4 minuti al costo di $0.0003 al secondo. Supporta 50+ lingue e offre voci coerenti e alta fedeltà acustica. La generazione basata su tag e controllata dal prompt sostituisce sessioni di composizione manuale, ingaggio di cantanti e produzione multitraccia, accelerando l'ideazione per team media, studi di videogiochi, creator e produttori pubblicitari. Gli sviluppatori possono usare Ace Step 1.5 su RunComfy nel browser o tramite API HTTP, senza dover ospitare o scalare il modello.
Ideale per: prototipi di demo musicali | colonne sonore per cinema e videogiochi | musica pubblicitaria breve

ACE Studio / Ace Step 1.5#


Ace Step 1.5 è un modello text-to-music che trasforma tag di stile separati da virgole e testi strutturati opzionali in brani completi con voce, strumentazione e fraseggio sincronizzato. Supporta 50+ lingue, funziona in modo efficiente ed è progettato per iterazioni rapide con durate da pochi secondi fino a 4 minuti (240 secondi).


Formato di output: solo audio / durata 5–240 secondi / stereo / frequenza di campionamento definita dal fornitore.


Parametri#


ParametroObbligatorioTipoPredefinitoIntervallo / OpzioniDescrizione
tags*Sì (*)string—Testo liberoElenco separato da virgole di tag relativi a genere, atmosfera e strumenti.
lyricsNostring—Testo libero o [inst] / [instrumental]Contenuto vocale; usa indicatori come [Verse], [Chorus] e [Bridge] per strutturare il brano.
durationNointeger605 – 240Durata dell'audio in secondi.
seedNointeger-1-1 – 2147483647Seed casuale per la riproducibilità; -1 produce un risultato casuale.

Prezzi#


Ace Step 1.5 su RunComfy fattura l'audio generato in base alla durata.


Unità di fatturazioneTariffa
Per secondo di audio generato$0.0003

Esempi di costi stimati


DurataCosto indicativo
30 s~$0.009
60 s (predefinito)~$0.018
120 s~$0.036
240 s (4 min)~$0.072

Come si usa#


1) Apri Ace Step 1.5 su RunComfy e mostra il pannello di generazione.

2) Inserisci tag di stile come "lofi, hiphop, chill, mellow piano" per definire genere, atmosfera e strumentazione.

3) Aggiungi facoltativamente il testo; separa chiaramente le sezioni [Verse], [Chorus] e [Bridge] oppure usa [inst] per un brano strumentale.

4) Imposta duration in secondi (5–240); inizia con una durata breve per verificare la direzione prima di generare tutti i 4 minuti.

5) Blocca seed per confrontare l'effetto delle modifiche a tag o testo oppure lascialo su -1 per ottenere più varietà.

6) Avvia la generazione, ascolta l'anteprima e scarica il file audio dalla cronologia dei job.

7) Per usare l'API, invia gli stessi campi all'endpoint Ace Step 1.5 su RunComfy; non serve alcun self-hosting.

8) Salva come preset i seed e le combinazioni di tag più efficaci per mantenere coerente la direzione sonora del progetto.

Modelli correlati

seedance-2.5/first-last-frame/480p

Seedance 2.5 FLF2V 480p: transizioni di bozza del primo-ultimo fotogramma a un costo inferiore

sam-3/video-to-video

Segmenta l’elemento descritto lungo i fotogrammi di un video.

fantasy-portrait/image-to-video

Trasforma un ritratto e un video di riferimento in un'animazione espressiva guidata da un prompt di testo richiesto.

dreamina-3-0/image-to-video

Trasforma le tue immagini in video realistici in 2K con Dreamina 3.0.

pixverse/v5.5/text-to-video

Genera un video da un prompt testuale obbligatorio con controlli precisi per proporzioni, risoluzione, durata, stile, seed, audio, più clip e ottimizzazione.

wan-2-2/speech-to-video

Anima un'immagine da una traccia audio in modalità parlato, canto o performance.

Domande Frequenti

Che cos'è Ace Step 1.5 e che cosa fa in un flusso text-to-audio?

Ace Step 1.5 è un modello text-to-music di acestep-ai che trasforma tag di stile e testi strutturati opzionali in tracce complete con melodia, ritmo e voce. In un flusso text-to-audio su RunComfy descrivi genere, atmosfera e struttura del brano; Ace Step 1.5 genera quindi una composizione coerente con fraseggio sincronizzato. È pensato per chi vuole creare musica rapidamente tramite prompt, senza comporla manualmente.

Per quali attività di generazione è più adatto Ace Step 1.5?

Ace Step 1.5 è ideale per musica di sottofondo per video, brevi demo, loop ambientali, jingle pubblicitari e tracce di riferimento per scene di videogiochi. Il controllo tramite tag permette di orientare genere, strumentazione ed energia con pochi descrittori. La generazione di testo e voce rende Ace Step 1.5 utile anche per bozze di canzoni e prototipi creativi.

Come si confronta Ace Step 1.5 con Ace Step originale e con altri modelli musicali?

Rispetto ad Ace Step originale, la versione 1.5 mantiene il controllo tramite tag e la durata massima di 4 minuti, amplia il supporto dei testi a 50+ lingue e migliora la gestione dei testi strutturati. Rispetto ai sistemi soltanto strumentali, Ace Step 1.5 genera nativamente voce, strumentazione e fraseggio sincronizzato in un unico passaggio. Il parametro seed consente inoltre agli sviluppatori di ripetere le iterazioni in modo coerente.

Quali team e casi d'uso traggono maggiore vantaggio da Ace Step 1.5 in produzione?

Designer, artisti tecnici, creator video e product team possono usare Ace Step 1.5 per trailer, contenuti social, prototipi audio per videogiochi, video e-commerce e creatività pubblicitarie. Gli sviluppatori possono integrarlo in pipeline che generano colonne sonore on demand in base ai metadati della scena o al brief della campagna. Il supporto di voce e strumentali in molte lingue copre numerose esigenze da un'unica interfaccia.

Quali limiti di input e output è necessario conoscere prima di usare Ace Step 1.5?

Ace Step 1.5 supporta durate flessibili da 5 secondi fino a 240 secondi (4 minuti) per generazione, con un unico campo tags obbligatorio e lyrics strutturato opzionale. Gli altri vincoli, come formati audio e combinazioni di tag, dipendono dalla configurazione attuale del fornitore. Controlla quindi i limiti esatti nel pannello dei parametri RunComfy, perché possono variare in base alla modalità o al provider.

Come si passa dai test di Ace Step 1.5 nell'interfaccia all'uso in produzione tramite l'API RunComfy?

Puoi provare Ace Step 1.5 nella Web UI del RunComfy AI Playground e regolare tag di stile, testo, durata e seed finché il risultato text-to-audio non corrisponde all'obiettivo. Quando la configurazione è stabile, richiama lo stesso modello Ace Step 1.5 tramite l'API RunComfy con parametri identici per automatizzare la generazione dal backend o dalla pipeline di contenuti. L'iterazione resta nel browser e la produzione nel codice, senza cambiare il comportamento del modello.

Come viene calcolato il prezzo dell'audio generato con Ace Step 1.5 su RunComfy?

Le generazioni Ace Step 1.5 consumano crediti USD dal saldo RunComfy e, in base alle informazioni disponibili sul fornitore, costano $0.0003 al secondo. In genere i nuovi utenti ricevono un importo di prova gratuito; in seguito si applicano le regole della sezione Generation nella pagina del modello. Consulta quella sezione per le tariffe aggiornate e le eventuali differenze tra modalità.

Seguici
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Supporto
  • Discord
  • Email
  • Stato del Sistema
  • affiliato
Modelli Video
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Visualizza tutti i modelli →
Modelli Immagine
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Visualizza tutti i modelli →
Legale
  • Termini di Servizio
  • Informativa sulla Privacy
  • Informativa sui Cookie
RunComfy
Copyright 2026 RunComfy. Tutti i Diritti Riservati.

RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.