HappyHorse 1.0 Reference to Video fonde fino a 9 immagini di riferimento e un messaggio in una clip coerente composta da più caratteri con identità stabile. Use HappyHorse 1.0 Reference to Video on RunComfy.
Seed Audio 1.0 è un modello text-to-audio di Bytedance che trasforma prompt scritti in voce e audio parlato chiari e naturali. Puoi guidare il risultato in tre modi: con un semplice prompt testuale, con un massimo di tre brevi clip di riferimento o con una singola immagine di riferimento che orienta l'interpretazione.
Formato di output: solo audio / formati wav, mp3, pcm, ogg_opus / frequenza di campionamento da 8 kHz a 48 kHz.
Seed Audio 1.0 è progettato per una sintesi audio rapida, flessibile e controllabile nell'interpretazione.
| Parametro | Obbligatorio | Tipo | Predefinito | Intervallo / Opzioni | Descrizione |
|---|---|---|---|---|---|
| prompt* | Sì (*) | string | — | Testo libero | Testo da sintetizzare; cita le clip di riferimento in ordine con @Audio1, @Audio2, @Audio3. |
| voice | No | string | vivi_mixed_en_zh_ja_es_id | Elenco voci preimpostate | Voce preimpostata usata per la sintesi. |
| audio_urls | No | array | — | Fino a 3 URL | Clip di riferimento (wav/mp3/pcm/ogg_opus), ciascuna fino a 30s e 10MB. |
| image_url | No | string | — | jpeg/png/webp, fino a 10MB | Una sola immagine di riferimento; non può essere combinata con riferimenti audio. |
| output_format | No | string | mp3 | wav, mp3, pcm, ogg_opus | Contenitore audio di output. |
| sample_rate | No | integer | 24000 | 8000 - 48000 | Frequenza di campionamento in uscita, in Hz. |
| speed | No | number | 1 | 0.5 - 2.0 | Velocità di lettura; 1.0 corrisponde al ritmo normale. |
| volume | No | number | 1 | 0.5 - 2.0 | Volume in uscita; 1.0 corrisponde al volume normale. |
| pitch | No | integer | 0 | -12 - 12 | Variazione dell'altezza tonale in semitoni. |
Seed Audio 1.0 su RunComfy adotta una tariffazione basata sulla durata dell'audio generato.
| Unità di fatturazione | Tariffa |
|---|---|
| Per minuto di audio generato | $0.075 |
Esempi di costo stimato
| Durata | Costo approssimativo |
|---|---|
| 15 s | ~$0.019 |
| 30 s | ~$0.038 |
| 60 s | ~$0.075 |
| 120 s | ~$0.150 |
Segui questi passaggi per ottenere una lettura pulita con Seed Audio 1.0.
HappyHorse 1.0 Reference to Video fonde fino a 9 immagini di riferimento e un messaggio in una clip coerente composta da più caratteri con identità stabile. Use HappyHorse 1.0 Reference to Video on RunComfy.
Genera un video di 5 o 8 secondi da un prompt obbligatorio, con prompt negativo facoltativo, quattro dimensioni di output precise e controllo del seed.
Generazione text-to-video cinematografica di fascia Pro a $0.112 per secondo di output.
FLUX 3 Draft FLF: anteprime video veloci dei fotogrammi di inizio e fine a 720p
Genera video cinematografici text-to-video nativi in 4K con dialoghi sincronizzati e personaggi coerenti.
Crea un breve video con audio sincronizzato da immagini di riferimento e un prompt.
Seed Audio 1.0 è un modello text-to-audio di Bytedance che trasforma prompt scritti in voce e audio parlato chiari e naturali. In un flusso text-to-audio su RunComfy, inserisci il testo da leggere e, facoltativamente, orienti l'interpretazione con una voce preimpostata, clip di riferimento o una singola immagine. È pensato per creator che vogliono produrre audio tramite prompt senza organizzare sessioni di registrazione.
Seed Audio 1.0 è adatto a voice-over, narrazione, battute di personaggi, brevi radiodrammi e letture multilingue. Voci preimpostate e controlli dell'interpretazione consentono di regolare ritmo, volume e altezza tonale in base a scena o brand. Grazie all'audio di riferimento, è utile anche quando serve mantenere un'interpretazione coerente in più clip.
Con Seed Audio 1.0 puoi allegare fino a tre clip di riferimento e citarle in ordine nel prompt come @Audio1, @Audio2 e @Audio3, per combinare sorgenti o trasferire un'interpretazione alla lettura. In alternativa, puoi fornire una sola immagine per orientare il tono, ma riferimenti visivi e audio non possono essere combinati nella stessa richiesta. Per risultati affidabili, ogni clip di riferimento deve restare breve, entro circa 30 secondi e 10MB.
Creator, team di prodotto e studi di localizzazione possono usare Seed Audio 1.0 per voice-over esplicativi, messaggi vocali nelle app, letture pubblicitarie e doppiaggio multilingue. Gli sviluppatori possono integrarlo in pipeline che generano voce su richiesta da copioni o testi di campagne. Voci preimpostate e interpretazione guidata da riferimenti coprono sia bozze rapide sia personaggi più specifici dalla stessa interfaccia.
Seed Audio 1.0 richiede un prompt e accetta facoltativamente una voce preimpostata, audio di riferimento oppure una singola immagine, oltre a controlli per velocità, volume e altezza tonale. Audio e immagine di riferimento sono alternative e non possono essere usati insieme. L'output può essere wav, mp3, pcm o ogg_opus, con frequenze di campionamento da 8 kHz a 48 kHz. Limiti esatti, come dimensione delle clip e formati supportati, possono variare in base alle impostazioni del provider: consulta il pannello dei parametri RunComfy prima dell'integrazione.
Sì. Puoi prima mettere a punto Seed Audio 1.0 nella RunComfy AI Playground Web UI regolando prompt, voce, riferimenti e controlli dell'interpretazione fino a raggiungere il risultato desiderato. Quando la configurazione è stabile, richiama lo stesso modello Seed Audio 1.0 tramite API RunComfy con parametri identici per automatizzare la generazione dal backend o dalla pipeline di contenuti. Puoi così iterare nel browser ed eseguire la produzione nel codice senza cambiare il comportamento del modello.
Le generazioni di Seed Audio 1.0 vengono addebitate sul saldo RunComfy in usd / credits e, in base alle informazioni disponibili sul provider, sono fatturate a $0.075 per minuto di audio generato. I nuovi utenti in genere ricevono un credito di prova gratuito in usd, dopodiché l'utilizzo segue le regole Generation mostrate nella pagina del modello. Per le tariffe aggiornate e le eventuali differenze tra modalità, consulta la sezione Generation della pagina Seed Audio 1.0 su RunComfy.
RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.