logo
RunComfy
  • ComfyUI
  • TrainerNuovo
  • Modelli
  • API
  • Prezzi
discord logo
MODELLI
Esplora
Tutti i modelli
LIBRERIA
Generazioni
API DEI MODELLI
Documentazione API
Chiavi API
ACCOUNT
Utilizzo

Seed Audio 1.0: text-to-audio con voci preimpostate e audio di riferimento, su Models e via API | RunComfy

bytedance/seed-audio-1.0/text-to-audio

Genera voce e audio parlato naturali da testo, clip di riferimento o un'immagine con Seed Audio 1.0 su RunComfy. Include voci preimpostate, velocità, altezza tonale e formato di output regolabili, ed è disponibile nel browser e via API.

Indice

1. Per iniziare2. Autenticazione3. Riferimento APIInvia una richiestaStato della richiestaRecupera i risultatiAnnulla richiesta4. File in ingressoFile ospitato (URL)5. SchemaSchema di inputSchema di output

1. Per iniziare

Usa l'API RunComfy per eseguire bytedance/seed-audio-1.0/text-to-audio. Per input e output accettati, consulta lo schema.

curl --request POST \
  --url https://model-api.runcomfy.net/v1/models/bytedance/seed-audio-1.0/text-to-audio \
  --header "Content-Type: application/json" \
  --header "Authorization: Bearer <token>" \
  --data '{
    "prompt": "Welcome back to the late-night show. Settle in, pour something warm, and let's ease into the next track together."
  }'

2. Autenticazione

Imposta la variabile d'ambiente YOUR_API_TOKEN con la tua chiave API (gestione nel Profilo) e includi in ogni richiesta un token Bearer nell'intestazione Authorization : Authorization: Bearer $YOUR_API_TOKEN.

3. Riferimento API

Invia una richiesta

Invia un job di generazione asincrono e ricevi subito un request_id e URL per stato, risultati e annullamento.

curl --request POST \
  --url https://model-api.runcomfy.net/v1/models/bytedance/seed-audio-1.0/text-to-audio \
  --header "Content-Type: application/json" \
  --header "Authorization: Bearer <token>" \
  --data '{
    "prompt": "Welcome back to the late-night show. Settle in, pour something warm, and let's ease into the next track together."
  }'

Stato della richiesta

Recupera lo stato corrente per un request_id ("in_queue", "in_progress", "completed" o "cancelled").

curl --request GET \
  --url https://model-api.runcomfy.net/v1/requests/{request_id}/status \
  --header "Authorization: Bearer <token>"

Recupera i risultati

Recupera output finali e metadati per il request_id; se il job non è completo, la risposta restituisce lo stato corrente per continuare il polling.

curl --request GET \
  --url https://model-api.runcomfy.net/v1/requests/{request_id}/result \
  --header "Authorization: Bearer <token>"

Annulla richiesta

Annulla un job in coda tramite request_id; i job in corso non possono essere annullati.

curl --request POST \
  --url https://model-api.runcomfy.net/v1/requests/{request_id}/cancel \
  --header "Authorization: Bearer <token>"

4. File in ingresso

File ospitato (URL)

Fornisci un URL HTTPS raggiungibile pubblicamente. L'host deve consentire fetch lato server (senza login/cookie), senza rate limit eccessivo o blocco bot. Consigliato: immagini ≤ 50 MB (~4K), video ≤ 100 MB (~2–5 min a 720p). Per asset privati, URL stabili o pre-firmati.

5. Schema

Schema di input

{
  "type": "object",
  "title": "Schema di input",
  "required": [
    "prompt"
  ],
  "properties": {
    "prompt": {
      "title": "Prompt",
      "description": "Testo da sintetizzare. Cita le clip di riferimento in ordine con @Audio1, @Audio2, @Audio3.",
      "type": "string",
      "default": "Welcome back to the late-night show. Settle in, pour something warm, and let's ease into the next track together."
    },
    "voice": {
      "title": "Voce",
      "description": "Voce preimpostata usata per la sintesi.",
      "type": "string",
      "enum": [
        "vivi_mixed_en_zh_ja_es_id",
        "mindy_en_es_id_pt_zh",
        "kian_en_zh",
        "cedric_en_zh",
        "sophie_en_zh",
        "jean_en_zh",
        "magnus_en_zh",
        "mabel_en_zh",
        "nadia_en_zh",
        "opal_en_zh",
        "pearl_en_zh",
        "quentin_en_zh",
        "corinne_mixed_en_zh",
        "esther_mixed_en_zh",
        "lyla_mixed_en_zh",
        "tracy_es_zh",
        "sandy_es_mixed_en_zh",
        "felix_zh",
        "celeste_zh",
        "monkey_king_zh"
      ],
      "default": "vivi_mixed_en_zh_ja_es_id"
    },
    "audio_urls": {
      "title": "URL audio di riferimento",
      "description": "Fino a 3 clip di riferimento, citate nel prompt come @Audio1, @Audio2, @Audio3. Ogni clip può durare fino a 30s e pesare 10MB; formati wav/mp3/pcm/ogg_opus.",
      "type": "array",
      "items": {
        "type": "string",
        "format": "audio_uri"
      },
      "maxItems": 3
    },
    "image_url": {
      "title": "URL immagine di riferimento",
      "description": "Una sola immagine di riferimento (jpeg/png/webp, fino a 10MB). Non può essere combinata con riferimenti audio.",
      "type": "string"
    },
    "output_format": {
      "title": "Formato di output",
      "description": "Contenitore audio di output.",
      "type": "string",
      "enum": [
        "wav",
        "mp3",
        "pcm",
        "ogg_opus"
      ],
      "default": "mp3"
    },
    "sample_rate": {
      "title": "Frequenza di campionamento (Hz)",
      "description": "Frequenza di campionamento dell'audio in uscita, in Hz.",
      "type": "integer",
      "enum": [
        8000,
        16000,
        24000,
        32000,
        44100,
        48000
      ],
      "default": 24000
    },
    "speed": {
      "title": "Velocità",
      "description": "Velocità di lettura. 1.0 è normale, 0.5 è dimezzata, 2.0 è raddoppiata.",
      "type": "number",
      "minimum": 0.5,
      "maximum": 2,
      "default": 1
    },
    "volume": {
      "title": "Volume",
      "description": "Volume in uscita. 1.0 è normale, 0.5 è dimezzato, 2.0 è raddoppiato.",
      "type": "number",
      "minimum": 0.5,
      "maximum": 2,
      "default": 1
    },
    "pitch": {
      "title": "Altezza tonale",
      "description": "Variazione dell'altezza della voce in semitoni. 0 è normale, -12 abbassa di un'ottava, 12 alza di un'ottava.",
      "type": "integer",
      "minimum": -12,
      "maximum": 12,
      "default": 0
    }
  }
}

Schema di output

{
  "output": {
    "type": "object",
    "properties": {
      "image": {
        "type": "string",
        "format": "uri",
        "description": "URL immagine singola"
      },
      "video": {
        "type": "string",
        "format": "uri",
        "description": "URL video singolo"
      },
      "images": {
        "type": "array",
        "description": "più URL immagine",
        "items": {
          "type": "string",
          "format": "uri"
        }
      },
      "videos": {
        "type": "array",
        "description": "più URL video",
        "items": {
          "type": "string",
          "format": "uri"
        }
      }
    }
  }
}
Seguici
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Supporto
  • Discord
  • Email
  • Stato del Sistema
  • affiliato
Modelli Video
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Visualizza tutti i modelli →
Modelli Immagine
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Visualizza tutti i modelli →
Legale
  • Termini di Servizio
  • Informativa sulla Privacy
  • Informativa sui Cookie
RunComfy
Copyright 2026 RunComfy. Tutti i Diritti Riservati.

RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.