logo
RunComfy
  • ComfyUI
  • TrainerNuovo
  • Modelli
  • API
  • Prezzi
discord logo
MODELLI
Esplora
Tutti i modelli
LIBRERIA
Generazioni
API DEI MODELLI
Documentazione API
Chiavi API
ACCOUNT
Utilizzo

ACE-Step Audio Inpaint: modifica di segmenti audio e riscrittura di testi e stile su RunComfy e via API | RunComfy

acestep-ai/ace-step/audio-inpaint

Risintetizza una porzione selezionata di una traccia audio con nuovi tag di stile o testi e reinseriscila nel mix originale, su RunComfy e via API HTTP.

0:00
0:00
Audio sorgente da modificare. Fornisci l’URL HTTPS di un file MP3, WAV o FLAC della durata massima di 60 minuti.
Tag di genere, atmosfera e strumenti, separati da virgole, che guidano lo stile del segmento rigenerato.
Punto di riferimento per il tempo iniziale: 'start' conta dall’inizio della traccia, mentre 'end' conta a ritroso dalla fine.
Inizio del segmento modificabile, in secondi, misurato dal punto di riferimento selezionato.
Punto di riferimento per il tempo finale: 'start' conta dall’inizio della traccia, mentre 'end' conta a ritroso dalla fine.
Fine del segmento modificabile, in secondi, misurata dal punto di riferimento selezionato.
Testo opzionale per il segmento rigenerato. Lascia vuoto per farlo scrivere al modello oppure usa [inst] / [instrumental] per escludere la voce.
Seed casuale per ottenere risultati riproducibili. Usa -1 per scegliere un valore casuale.
Idle
The rate is $0.0002 per second of output audio.

Introduzione a ACE-Step Audio Inpaint

ACE-Step Audio Inpaint di ACE Studio risintetizza una porzione selezionata di una traccia esistente a $0.0002 per secondo di audio in uscita. Può sostituire testi, strumentazione o atmosfera lasciando invariato il resto del mix. Gli interventi mirati e guidati dal prompt evitano di rigenerare l'intero brano o modificare manualmente le singole tracce, riducendo i tempi di riparazione e remix per produttori, sound designer, team audio di videogiochi e creativi pubblicitari. Gli sviluppatori possono usare ACE-Step Audio Inpaint su RunComfy nel browser o tramite API HTTP, senza dover ospitare o scalare il modello.
Ideale per: riscrittura di testi e punch-in | restyling e remix di singole sezioni | riparazione di voice-over ed effetti sonori

ACE Studio / ACE-Step Audio Inpaint#


ACE-Step Audio Inpaint è un modello di editing audio che rigenera una porzione definita di una traccia esistente senza alterare il resto. Fornisci l'URL dell'audio sorgente, indica l'inizio e la fine della porzione e descrivi la sostituzione con tag di stile e un testo opzionale. Il modello sintetizza il nuovo segmento e lo ricuce nel mix circostante.


Formato di output: solo audio / sorgente fino a 60 minuti / intervallo modificabile 0–240 secondi / frequenza di campionamento definita dal fornitore.


Funzionalità principali#


  • Riscrittura di singole porzioni: delimita una finestra con tempo iniziale e finale e risintetizza soltanto quel punto; tutto ciò che resta fuori rimane identico bit per bit.
  • Cucitura attenta ai confini: il modello usa l'audio immediatamente precedente e successivo per allineare la modifica in tempo, tonalità e timbro senza giunzioni evidenti.
  • Riferimento da entrambe le estremità: i tempi possono partire dall'inizio o essere calcolati a ritroso dalla fine, semplificando le correzioni di outro e code.
  • Restyling e riscrittura del testo tramite tag: controlla nuova strumentazione, atmosfera o linea vocale con pochi tag e un testo opzionale.
  • Risultati riproducibili: fissa seed per mantenere una versione precisa oppure rendilo casuale per provare varianti dello stesso brief.
  • Parità tra UI e API: gli stessi input funzionano nell'interfaccia RunComfy e tramite API HTTP.

Parametri#


ParametroObbligatorioTipoPredefinitoIntervallo / OpzioniDescrizione
audio*Sì (*)string—URL HTTPS di MP3 / WAV / FLAC, fino a 60 minFile audio sorgente da modificare.
tags*Sì (*)string—Testo liberoTag separati da virgole relativi a genere, atmosfera e strumenti che guidano lo stile del segmento.
start_time_relative_toNostringstartstart, endPunto di riferimento di start_time.
start_timeNonumber—0 – 240Inizio del segmento modificabile, in secondi.
end_time_relative_toNostringstartstart, endPunto di riferimento di end_time.
end_timeNonumber300 – 240Fine del segmento modificabile, in secondi.
lyricsNostring—Testo libero o [inst] / [instrumental]Testo del segmento rigenerato; se vuoto, il modello ne scrive uno.
seedNointeger-1-1 – 2147483647Seed casuale per la riproducibilità; -1 produce un risultato casuale.

Prezzi#


ACE-Step Audio Inpaint su RunComfy viene fatturato in base alla durata dell'audio in uscita.


Unità di fatturazioneTariffa
Per secondo di audio in uscita$0.0002

Esempi di costi stimati


Durata dell'outputCosto indicativo
30 s~$0.006
60 s~$0.012
180 s (3 min)~$0.036

Suggerimenti per prompt e riferimenti#


  • Posiziona i confini del segmento su battute naturali o alla fine di una frase musicale, così le transizioni sembreranno intenzionali.
  • Combina più tag complementari, ad esempio "lofi, mellow piano, soft drums", per definire genere e strumentazione del segmento.
  • Mantieni i nuovi tag vicini all'energia dell'audio circostante per una correzione discreta; differenziali nettamente se desideri un remix.
  • Fornisci un testo strutturato con un numero coerente di sillabe affinché il nuovo fraseggio vocale si allinei alle battute circostanti.
  • Per una sezione strumentale o per rimuovere la voce, imposta lyrics su [inst] o [instrumental].
  • Usa start_time_relative_to: end con un piccolo offset per correggere un fade-out o l'ultimo hook senza ricalcolare il tempo dall'inizio.
  • Fissa seed durante le iterazioni e cambia soltanto tag o testo, così potrai attribuire le differenze alle singole modifiche.
  • Limita l'intervento a finestre precise, di poche battute, per ottenere una fusione più pulita rispetto alla riscrittura di intervalli molto lunghi.

Modelli correlati

wan-2-2/fun-inpaint

Trasforma immagini in video perfetti con controllo del movimento preciso

sam-3/video-to-video

Segmenta l’elemento descritto lungo i fotogrammi di un video.

kling-video-o3/4K/text-to-video

Generazione cinematografica text-to-video in 4K a $0.42 per secondo di output.

kling-3.0/4k/text-to-video

Genera video cinematografici text-to-video nativi in 4K con dialoghi sincronizzati e personaggi coerenti.

seedance-2.5/reference-to-video/480p

Seedance 2.5 Riferimento 480p: Bozza video con più riferimenti a un costo inferiore

kling-2-6/pro/image-to-video

Trasforma un'immagine di riferimento in un video di 5 o 10 secondi, con prompt negativo opzionale e generazione di audio nativo.

Domande Frequenti

Che cos'è ACE-Step Audio Inpaint e che cosa fa in un flusso audio-to-audio?

ACE-Step Audio Inpaint è un modello di editing audio di acestep-ai che riscrive un intervallo scelto di una traccia preservando l'audio circostante. In un flusso audio-to-audio su RunComfy fornisci l'URL sorgente, indichi i tempi iniziale e finale e aggiungi tag di stile o un nuovo testo; ACE-Step Audio Inpaint rigenera soltanto quel segmento. È progettato per riparazioni, restyling e remix mirati senza renderizzare di nuovo l'intero brano.

Per quali attività di generazione è più adatto ACE-Step Audio Inpaint?

ACE-Step Audio Inpaint è ideale per correggere battute fuori tempo o rumorose, riscrivere una strofa o un ritornello, cambiare la strumentazione di una sezione e sostituire una riga di testo in una traccia finita. Funziona bene anche per brevi correzioni di voice-over o effetti sonori, quando l'audio circostante deve restare intatto. Poiché opera su segmenti, è più adatto a remix, preparazione del mastering ed editing di contenuti che alla generazione di interi brani.

Come si confronta ACE-Step Audio Inpaint con i modelli text-to-music completi o con l'editing basato su stem?

Rispetto ai modelli text-to-music completi, ACE-Step Audio Inpaint modifica un intervallo temporale e lo fonde nella traccia esistente invece di creare un brano da zero. Rispetto alla separazione e rigenerazione manuale degli stem, riunisce selezione del segmento, risintesi e crossfade in un unico passaggio audio-to-audio. Gli artisti tecnici controllano così con maggiore precisione ciò che cambia e ciò che rimane invariato.

Quali team e casi d'uso traggono maggiore vantaggio da ACE-Step Audio Inpaint in produzione?

Produttori musicali, sound designer, team audio di videogiochi e creativi pubblicitari usano ACE-Step Audio Inpaint per riparare, riscrivere o cambiare lo stile di sezioni specifiche. Gli sviluppatori possono integrarlo in editor che consentono di selezionare un intervallo e inviare nuovi tag o testi. I content team possono inoltre usarlo per correzioni finali di trailer, podcast e cinematiche di videogiochi.

Quali limiti di input e output è necessario conoscere prima di usare ACE-Step Audio Inpaint?

In genere l'audio sorgente viene fornito tramite URL HTTPS pubblico a un file MP3, WAV o FLAC e, in base alle informazioni disponibili, può durare fino a circa 60 minuti. In ACE-Step Audio Inpaint il segmento è delimitato in secondi da start_time ed end_time; entrambi accettano valori nell'intervallo 0–240 e possono essere ancorati all'inizio o alla fine della traccia. Frequenza di campionamento e formati esatti dipendono dal provider, quindi controlla i limiti attivi nel pannello dei parametri RunComfy.

Come si passa dai test di ACE-Step Audio Inpaint nel Playground all'uso in produzione tramite l'API RunComfy?

Puoi provare ACE-Step Audio Inpaint nella Web UI del RunComfy AI Playground regolando URL dell'audio, intervallo, tag, testo e seed finché il risultato audio-to-audio non corrisponde all'obiettivo. Quando la configurazione è stabile, richiama lo stesso modello ACE-Step Audio Inpaint tramite l'API RunComfy con parametri identici per automatizzare le modifiche dal backend o dalla pipeline di contenuti. L'iterazione resta nel browser e la produzione nel codice, senza cambiare il comportamento del modello.

Come viene calcolato il prezzo di ACE-Step Audio Inpaint su RunComfy?

Le generazioni ACE-Step Audio Inpaint consumano crediti USD dal saldo RunComfy e, in base alle informazioni disponibili sul fornitore, costano $0.0002 per secondo di audio in uscita. In genere i nuovi utenti ricevono un importo di prova gratuito; in seguito si applicano le regole della sezione Generation nella pagina del modello. Consulta quella sezione per le tariffe aggiornate e le eventuali differenze tra modalità.

Posso usare commercialmente gli output di ACE-Step Audio Inpaint?

RunComfy fornisce l'accesso ad ACE-Step Audio Inpaint e al flusso audio-to-audio, ma i diritti commerciali sull'audio modificato dipendono dalla licenza dell'autore e provider originale, acestep-ai, oltre che dai diritti sulla traccia caricata. Prima di pubblicare audio modificato in prodotti, pubblicità, film o videogiochi, verifica la licenza ufficiale ACE-Step e i diritti sull'audio sorgente. Per dubbi relativi alla piattaforma puoi scrivere a hi@runcomfy.com.

Seguici
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Supporto
  • Discord
  • Email
  • Stato del Sistema
  • affiliato
Modelli Video
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Visualizza tutti i modelli →
Modelli Immagine
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Visualizza tutti i modelli →
Legale
  • Termini di Servizio
  • Informativa sulla Privacy
  • Informativa sui Cookie
RunComfy
Copyright 2026 RunComfy. Tutti i Diritti Riservati.

RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.