Nutzen Sie die RunComfy-API, um bytedance/seed-audio-1.0/text-to-audio auszuführen. Zulässige Ein- und Ausgaben finden Sie im Schema.
curl --request POST \
--url https://model-api.runcomfy.net/v1/models/bytedance/seed-audio-1.0/text-to-audio \
--header "Content-Type: application/json" \
--header "Authorization: Bearer <token>" \
--data '{
"prompt": "Welcome back to the late-night show. Settle in, pour something warm, and let's ease into the next track together."
}'Weisen Sie der Umgebungsvariable YOUR_API_TOKEN Ihren API-Schlüssel zu (Verwaltung unter Profil). Senden Sie bei jeder Anfrage im Header Authorization einen Bearer-Token: Authorization: Bearer $YOUR_API_TOKEN.
Senden Sie einen asynchronen Generierungsauftrag und erhalten Sie sofort eine request_id sowie URLs für Status, Ergebnisse und Abbruch.
curl --request POST \
--url https://model-api.runcomfy.net/v1/models/bytedance/seed-audio-1.0/text-to-audio \
--header "Content-Type: application/json" \
--header "Authorization: Bearer <token>" \
--data '{
"prompt": "Welcome back to the late-night show. Settle in, pour something warm, and let's ease into the next track together."
}'Ruft den aktuellen Status für eine request_id ab („in_queue“, „in_progress“, „completed“ oder „cancelled“).
curl --request GET \
--url https://model-api.runcomfy.net/v1/requests/{request_id}/status \
--header "Authorization: Bearer <token>"Ruft die endgültigen Ausgaben und Metadaten für die angegebene request_id ab; ist der Auftrag noch nicht fertig, liefert die Antwort den aktuellen Status zum Weiterpollen.
curl --request GET \
--url https://model-api.runcomfy.net/v1/requests/{request_id}/result \
--header "Authorization: Bearer <token>"Bricht einen wartenden Auftrag per request_id ab; laufende Aufträge können nicht abgebrochen werden.
curl --request POST \
--url https://model-api.runcomfy.net/v1/requests/{request_id}/cancel \
--header "Authorization: Bearer <token>"Geben Sie eine öffentlich erreichbare HTTPS-URL an. Der Host muss serverseitige Abrufe erlauben (ohne Login/Cookies), nicht drosseln oder Bots blockieren. Empfohlen: Bilder ≤ 50 MB (~4K), Videos ≤ 100 MB (~2–5 Min. bei 720p). Für private Assets stabile oder vorab signierte URLs verwenden.
{
"type": "object",
"title": "Eingabeschema",
"required": [
"prompt"
],
"properties": {
"prompt": {
"title": "Prompt",
"description": "Text, der vertont werden soll. Verweisen Sie der Reihe nach mit @Audio1, @Audio2 und @Audio3 auf Referenzclips.",
"type": "string",
"default": "Welcome back to the late-night show. Settle in, pour something warm, and let's ease into the next track together."
},
"voice": {
"title": "Stimme",
"description": "Voreingestellte Stimme für die Synthese.",
"type": "string",
"enum": [
"vivi_mixed_en_zh_ja_es_id",
"mindy_en_es_id_pt_zh",
"kian_en_zh",
"cedric_en_zh",
"sophie_en_zh",
"jean_en_zh",
"magnus_en_zh",
"mabel_en_zh",
"nadia_en_zh",
"opal_en_zh",
"pearl_en_zh",
"quentin_en_zh",
"corinne_mixed_en_zh",
"esther_mixed_en_zh",
"lyla_mixed_en_zh",
"tracy_es_zh",
"sandy_es_mixed_en_zh",
"felix_zh",
"celeste_zh",
"monkey_king_zh"
],
"default": "vivi_mixed_en_zh_ja_es_id"
},
"audio_urls": {
"title": "URLs der Referenzaudios",
"description": "Bis zu 3 Referenzclips, auf die Sie im Prompt mit @Audio1, @Audio2 und @Audio3 verweisen. Pro Clip: höchstens 30s und 10MB; Formate: wav/mp3/pcm/ogg_opus.",
"type": "array",
"items": {
"type": "string",
"format": "audio_uri"
},
"maxItems": 3
},
"image_url": {
"title": "URL des Referenzbilds",
"description": "Ein einzelnes Referenzbild (jpeg/png/webp, bis 10MB). Nicht mit Audioreferenzen kombinierbar.",
"type": "string"
},
"output_format": {
"title": "Ausgabeformat",
"description": "Containerformat der Audioausgabe.",
"type": "string",
"enum": [
"wav",
"mp3",
"pcm",
"ogg_opus"
],
"default": "mp3"
},
"sample_rate": {
"title": "Abtastrate (Hz)",
"description": "Abtastrate des ausgegebenen Audios in Hz.",
"type": "integer",
"enum": [
8000,
16000,
24000,
32000,
44100,
48000
],
"default": 24000
},
"speed": {
"title": "Sprechtempo",
"description": "Sprechtempo. 1.0 entspricht normalem Tempo, 0.5 halbem und 2.0 doppeltem Tempo.",
"type": "number",
"minimum": 0.5,
"maximum": 2,
"default": 1
},
"volume": {
"title": "Lautstärke",
"description": "Ausgabelautstärke. 1.0 entspricht der normalen Lautstärke, 0.5 der halben und 2.0 der doppelten Lautstärke.",
"type": "number",
"minimum": 0.5,
"maximum": 2,
"default": 1
},
"pitch": {
"title": "Tonhöhe",
"description": "Verschiebung der Stimmhöhe in Halbtönen. 0 ist neutral, -12 senkt die Stimme um eine Oktave, 12 hebt sie um eine Oktave an.",
"type": "integer",
"minimum": -12,
"maximum": 12,
"default": 0
}
}
}{
"output": {
"type": "object",
"properties": {
"image": {
"type": "string",
"format": "uri",
"description": "Einzelbild-URL"
},
"video": {
"type": "string",
"format": "uri",
"description": "Einzelvideo-URL"
},
"images": {
"type": "array",
"description": "mehrere Bild-URLs",
"items": {
"type": "string",
"format": "uri"
}
},
"videos": {
"type": "array",
"description": "mehrere Video-URLs",
"items": {
"type": "string",
"format": "uri"
}
}
}
}
}RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.