logo
RunComfy
  • ComfyUI
  • TreinadorNovo
  • Modelos
  • API
  • Preços
discord logo
MODELOS
Explorar
Todos os modelos
BIBLIOTECA
Gerações
APIS DE MODELOS
Documentação da API
Chaves API
CONTA
Uso

Seed Audio 1.0: geração de áudio a partir de texto com vozes predefinidas e referências | RunComfy Models e API

bytedance/seed-audio-1.0/text-to-audio

Gere fala e áudio naturais a partir de texto, clipes de referência ou uma imagem com Seed Audio 1.0 no RunComfy. Use vozes predefinidas e ajuste velocidade, tom e formato de saída no navegador ou pela API.

Índice

1. Introdução2. Autenticação3. Referência da APIEnviar uma solicitaçãoStatus da solicitaçãoObter resultadosCancelar solicitação4. Arquivos de entradaArquivo hospedado (URL)5. EsquemaEsquema de entradaEsquema de saída

1. Introdução

Use a API RunComfy para executar bytedance/seed-audio-1.0/text-to-audio. Para entradas e saídas aceitas, consulte o esquema.

curl --request POST \
  --url https://model-api.runcomfy.net/v1/models/bytedance/seed-audio-1.0/text-to-audio \
  --header "Content-Type: application/json" \
  --header "Authorization: Bearer <token>" \
  --data '{
    "prompt": "Welcome back to the late-night show. Settle in, pour something warm, and let's ease into the next track together."
  }'

2. Autenticação

Defina a variável de ambiente YOUR_API_TOKEN com sua chave de API (gerenciamento no Perfil) e inclua em cada solicitação um token Bearer no cabeçalho Authorization : Authorization: Bearer $YOUR_API_TOKEN.

3. Referência da API

Enviar uma solicitação

Envie um trabalho de geração assíncrono e receba imediatamente um request_id e URLs para status, resultados e cancelamento.

curl --request POST \
  --url https://model-api.runcomfy.net/v1/models/bytedance/seed-audio-1.0/text-to-audio \
  --header "Content-Type: application/json" \
  --header "Authorization: Bearer <token>" \
  --data '{
    "prompt": "Welcome back to the late-night show. Settle in, pour something warm, and let's ease into the next track together."
  }'

Status da solicitação

Obtém o estado atual de um request_id ("in_queue", "in_progress", "completed" ou "cancelled").

curl --request GET \
  --url https://model-api.runcomfy.net/v1/requests/{request_id}/status \
  --header "Authorization: Bearer <token>"

Obter resultados

Obtém as saídas finais e metadados do request_id; se o trabalho não estiver concluído, a resposta retorna o estado atual para continuar o polling.

curl --request GET \
  --url https://model-api.runcomfy.net/v1/requests/{request_id}/result \
  --header "Authorization: Bearer <token>"

Cancelar solicitação

Cancela um trabalho na fila por request_id; trabalhos em andamento não podem ser cancelados.

curl --request POST \
  --url https://model-api.runcomfy.net/v1/requests/{request_id}/cancel \
  --header "Authorization: Bearer <token>"

4. Arquivos de entrada

Arquivo hospedado (URL)

Forneça uma URL HTTPS publicamente acessível. O host deve permitir buscas no servidor (sem login/cookies), sem limite de taxa agressivo ou bloqueio de bots. Recomendado: imagens ≤ 50 MB (~4K), vídeos ≤ 100 MB (~2–5 min em 720p). Para ativos privados, URLs estáveis ou pré-assinadas.

5. Esquema

Esquema de entrada

{
  "type": "object",
  "title": "Esquema de entrada",
  "required": [
    "prompt"
  ],
  "properties": {
    "prompt": {
      "title": "Prompt",
      "description": "Texto a sintetizar. Cite os clipes de referência na ordem com @Audio1, @Audio2 e @Audio3.",
      "type": "string",
      "default": "Welcome back to the late-night show. Settle in, pour something warm, and let's ease into the next track together."
    },
    "voice": {
      "title": "Voz",
      "description": "Voz predefinida usada na síntese.",
      "type": "string",
      "enum": [
        "vivi_mixed_en_zh_ja_es_id",
        "mindy_en_es_id_pt_zh",
        "kian_en_zh",
        "cedric_en_zh",
        "sophie_en_zh",
        "jean_en_zh",
        "magnus_en_zh",
        "mabel_en_zh",
        "nadia_en_zh",
        "opal_en_zh",
        "pearl_en_zh",
        "quentin_en_zh",
        "corinne_mixed_en_zh",
        "esther_mixed_en_zh",
        "lyla_mixed_en_zh",
        "tracy_es_zh",
        "sandy_es_mixed_en_zh",
        "felix_zh",
        "celeste_zh",
        "monkey_king_zh"
      ],
      "default": "vivi_mixed_en_zh_ja_es_id"
    },
    "audio_urls": {
      "title": "URLs de áudio de referência",
      "description": "Até 3 clipes de referência, citados no prompt como @Audio1, @Audio2 e @Audio3. Cada clipe pode ter até 30s e 10MB, nos formatos wav/mp3/pcm/ogg_opus.",
      "type": "array",
      "items": {
        "type": "string",
        "format": "audio_uri"
      },
      "maxItems": 3
    },
    "image_url": {
      "title": "URL da imagem de referência",
      "description": "Uma imagem de referência (jpeg/png/webp, até 10MB). Não pode ser combinada com referências de áudio.",
      "type": "string"
    },
    "output_format": {
      "title": "Formato de saída",
      "description": "Contêiner do áudio de saída.",
      "type": "string",
      "enum": [
        "wav",
        "mp3",
        "pcm",
        "ogg_opus"
      ],
      "default": "mp3"
    },
    "sample_rate": {
      "title": "Taxa de amostragem (Hz)",
      "description": "Taxa de amostragem do áudio de saída, em Hz.",
      "type": "integer",
      "enum": [
        8000,
        16000,
        24000,
        32000,
        44100,
        48000
      ],
      "default": 24000
    },
    "speed": {
      "title": "Velocidade",
      "description": "Velocidade de leitura. 1.0 é normal, 0.5 é metade e 2.0 é o dobro.",
      "type": "number",
      "minimum": 0.5,
      "maximum": 2,
      "default": 1
    },
    "volume": {
      "title": "Volume",
      "description": "Volume da saída. 1.0 é normal, 0.5 é metade e 2.0 é o dobro.",
      "type": "number",
      "minimum": 0.5,
      "maximum": 2,
      "default": 1
    },
    "pitch": {
      "title": "Tom",
      "description": "Alteração do tom da voz em semitons. 0 é normal, -12 reduz uma oitava e 12 aumenta uma oitava.",
      "type": "integer",
      "minimum": -12,
      "maximum": 12,
      "default": 0
    }
  }
}

Esquema de saída

{
  "output": {
    "type": "object",
    "properties": {
      "image": {
        "type": "string",
        "format": "uri",
        "description": "URL de imagem única"
      },
      "video": {
        "type": "string",
        "format": "uri",
        "description": "URL de vídeo único"
      },
      "images": {
        "type": "array",
        "description": "várias URLs de imagem",
        "items": {
          "type": "string",
          "format": "uri"
        }
      },
      "videos": {
        "type": "array",
        "description": "várias URLs de vídeo",
        "items": {
          "type": "string",
          "format": "uri"
        }
      }
    }
  }
}
Siga-nos
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Suporte
  • Discord
  • E-mail
  • Status do Sistema
  • afiliado
Modelos de Vídeo
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Ver todos os modelos →
Modelos de Imagem
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Ver todos os modelos →
Legal
  • Termos de Serviço
  • Política de Privacidade
  • Política de Cookies
RunComfy
Copyright 2026 RunComfy. Todos os Direitos Reservados.

RunComfy é a principal ComfyUI plataforma, oferecendo ComfyUI online ambiente e serviços, juntamente com fluxos de trabalho do ComfyUI apresentando visuais impressionantes. RunComfy também oferece AI Models, permitindo que artistas utilizem as mais recentes ferramentas de AI para criar arte incrível.