Usa l'API RunComfy per eseguire bytedance/seed-audio-1.0/text-to-audio. Per input e output accettati, consulta lo schema.
curl --request POST \
--url https://model-api.runcomfy.net/v1/models/bytedance/seed-audio-1.0/text-to-audio \
--header "Content-Type: application/json" \
--header "Authorization: Bearer <token>" \
--data '{
"prompt": "Welcome back to the late-night show. Settle in, pour something warm, and let's ease into the next track together."
}'Imposta la variabile d'ambiente YOUR_API_TOKEN con la tua chiave API (gestione nel Profilo) e includi in ogni richiesta un token Bearer nell'intestazione Authorization : Authorization: Bearer $YOUR_API_TOKEN.
Invia un job di generazione asincrono e ricevi subito un request_id e URL per stato, risultati e annullamento.
curl --request POST \
--url https://model-api.runcomfy.net/v1/models/bytedance/seed-audio-1.0/text-to-audio \
--header "Content-Type: application/json" \
--header "Authorization: Bearer <token>" \
--data '{
"prompt": "Welcome back to the late-night show. Settle in, pour something warm, and let's ease into the next track together."
}'Recupera lo stato corrente per un request_id ("in_queue", "in_progress", "completed" o "cancelled").
curl --request GET \
--url https://model-api.runcomfy.net/v1/requests/{request_id}/status \
--header "Authorization: Bearer <token>"Recupera output finali e metadati per il request_id; se il job non è completo, la risposta restituisce lo stato corrente per continuare il polling.
curl --request GET \
--url https://model-api.runcomfy.net/v1/requests/{request_id}/result \
--header "Authorization: Bearer <token>"Annulla un job in coda tramite request_id; i job in corso non possono essere annullati.
curl --request POST \
--url https://model-api.runcomfy.net/v1/requests/{request_id}/cancel \
--header "Authorization: Bearer <token>"Fornisci un URL HTTPS raggiungibile pubblicamente. L'host deve consentire fetch lato server (senza login/cookie), senza rate limit eccessivo o blocco bot. Consigliato: immagini ≤ 50 MB (~4K), video ≤ 100 MB (~2–5 min a 720p). Per asset privati, URL stabili o pre-firmati.
{
"type": "object",
"title": "Schema di input",
"required": [
"prompt"
],
"properties": {
"prompt": {
"title": "Prompt",
"description": "Testo da sintetizzare. Cita le clip di riferimento in ordine con @Audio1, @Audio2, @Audio3.",
"type": "string",
"default": "Welcome back to the late-night show. Settle in, pour something warm, and let's ease into the next track together."
},
"voice": {
"title": "Voce",
"description": "Voce preimpostata usata per la sintesi.",
"type": "string",
"enum": [
"vivi_mixed_en_zh_ja_es_id",
"mindy_en_es_id_pt_zh",
"kian_en_zh",
"cedric_en_zh",
"sophie_en_zh",
"jean_en_zh",
"magnus_en_zh",
"mabel_en_zh",
"nadia_en_zh",
"opal_en_zh",
"pearl_en_zh",
"quentin_en_zh",
"corinne_mixed_en_zh",
"esther_mixed_en_zh",
"lyla_mixed_en_zh",
"tracy_es_zh",
"sandy_es_mixed_en_zh",
"felix_zh",
"celeste_zh",
"monkey_king_zh"
],
"default": "vivi_mixed_en_zh_ja_es_id"
},
"audio_urls": {
"title": "URL audio di riferimento",
"description": "Fino a 3 clip di riferimento, citate nel prompt come @Audio1, @Audio2, @Audio3. Ogni clip può durare fino a 30s e pesare 10MB; formati wav/mp3/pcm/ogg_opus.",
"type": "array",
"items": {
"type": "string",
"format": "audio_uri"
},
"maxItems": 3
},
"image_url": {
"title": "URL immagine di riferimento",
"description": "Una sola immagine di riferimento (jpeg/png/webp, fino a 10MB). Non può essere combinata con riferimenti audio.",
"type": "string"
},
"output_format": {
"title": "Formato di output",
"description": "Contenitore audio di output.",
"type": "string",
"enum": [
"wav",
"mp3",
"pcm",
"ogg_opus"
],
"default": "mp3"
},
"sample_rate": {
"title": "Frequenza di campionamento (Hz)",
"description": "Frequenza di campionamento dell'audio in uscita, in Hz.",
"type": "integer",
"enum": [
8000,
16000,
24000,
32000,
44100,
48000
],
"default": 24000
},
"speed": {
"title": "Velocità",
"description": "Velocità di lettura. 1.0 è normale, 0.5 è dimezzata, 2.0 è raddoppiata.",
"type": "number",
"minimum": 0.5,
"maximum": 2,
"default": 1
},
"volume": {
"title": "Volume",
"description": "Volume in uscita. 1.0 è normale, 0.5 è dimezzato, 2.0 è raddoppiato.",
"type": "number",
"minimum": 0.5,
"maximum": 2,
"default": 1
},
"pitch": {
"title": "Altezza tonale",
"description": "Variazione dell'altezza della voce in semitoni. 0 è normale, -12 abbassa di un'ottava, 12 alza di un'ottava.",
"type": "integer",
"minimum": -12,
"maximum": 12,
"default": 0
}
}
}{
"output": {
"type": "object",
"properties": {
"image": {
"type": "string",
"format": "uri",
"description": "URL immagine singola"
},
"video": {
"type": "string",
"format": "uri",
"description": "URL video singolo"
},
"images": {
"type": "array",
"description": "più URL immagine",
"items": {
"type": "string",
"format": "uri"
}
},
"videos": {
"type": "array",
"description": "più URL video",
"items": {
"type": "string",
"format": "uri"
}
}
}
}
}RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.