logo
RunComfy
  • ComfyUI
  • TrainerNeu
  • Modelle
  • API
  • Preise
discord logo
MODELLE
Erkunden
Alle Modelle
BIBLIOTHEK
Generierungen
MODELL-APIS
API-Dokumentation
API-Schlüssel
KONTO
Nutzung

ACE-Step Audio Inpaint: Abschnittsweise Audiobearbeitung, neue Lyrics und neuer Stil über Models und API | RunComfy

acestep-ai/ace-step/audio-inpaint

Synthetisiere einen markierten Abschnitt einer Audiospur mit neuen Stil-Tags oder Lyrics neu und füge ihn nahtlos in den Originalmix ein – über RunComfy Models und die HTTP-API.

0:00
0:00
Quellaudio zum Bearbeiten. Geben Sie eine HTTPS-URL zu einer MP3-, WAV- oder FLAC-Datei an (bis zu 60 Minuten).
Durch Kommas getrennte Genre-, Stimmungs- und Instrumenten-Tags, die den Stil des neu generierten Segments steuern.
Bezugspunkt für die Startzeit. „Start“ zählt vom Anfang des Tracks, „End“ zählt vom Ende rückwärts.
Beginn des bearbeitbaren Segments in Sekunden, gemessen vom gewählten Referenzpunkt.
Bezugspunkt für die Endzeit. „Start“ zählt vom Anfang des Tracks, „End“ zählt vom Ende rückwärts.
Ende des bearbeitbaren Segments in Sekunden, gemessen vom gewählten Referenzpunkt.
Optionale Lyrics für den neu erzeugten Abschnitt. Leer lassen, damit das Modell Lyrics schreibt, oder [inst] / [instrumental] für eine Instrumentalversion verwenden.
Zufalls-Seed für reproduzierbare Ergebnisse. Mit -1 wird bei jedem Durchlauf ein neuer Seed gewählt.
Idle
The rate is $0.0002 per second of output audio.

Einführung in ACE-Step Audio Inpaint

ACE-Step Audio Inpaint von ACE Studio synthetisiert einen markierten Abschnitt eines bestehenden Tracks für $0.0002 pro Sekunde Ausgabematerial neu. Dabei lassen sich Lyrics, Instrumentierung oder Stimmung austauschen, während der übrige Mix unverändert bleibt. Statt den gesamten Song neu zu rendern oder einzelne Stems aufwendig zu bearbeiten, ermöglicht das Modell gezielte, promptgesteuerte Korrekturen und verkürzt Reparatur- und Remixschleifen für Produzenten, Sounddesigner, Game-Audio-Teams und Werbekreative. Entwickler können ACE-Step Audio Inpaint auf RunComfy im Browser oder über eine HTTP-API nutzen, ohne das Modell selbst hosten oder skalieren zu müssen.
Ideal für: Neue Lyrics und Punch-ins | Abschnittsweises Restyling und Remixe | Reparatur von Voiceover und Soundeffekten

ACE Studio / ACE-Step Audio Inpaint#


ACE-Step Audio Inpaint ist ein Audiobearbeitungsmodell, das einen definierten Abschnitt eines vorhandenen Tracks neu rendert, ohne den Rest zu stören. Übergeben Sie eine Quell-Audio-URL, markieren Sie den Anfang und das Ende des Abschnitts und beschreiben Sie die Ersetzung mit Stil-Tags und einem optionalen Lyrics-Block. Das Modell synthetisiert ein neues Segment an Ort und Stelle und fügt es wieder in die umgebende Mischung ein.


Ausgabeformat: Nur Audio / Quelle bis zu 60 Minuten / Abschnittsbereich 0–240 Sekunden / vom Anbieter definierte Abtastrate.


Highlights#


  • Gezieltes Umschreiben von Abschnitten: Sperren Sie ein Fenster mit Start- und Endzeiten und synthetisieren Sie nur dieses Fenster neu – alles außerhalb bleibt bitgenau identisch.
  • Nahtloses Zusammenfügen an den Übergängen: Das Modell bezieht das Audiomaterial direkt vor und nach dem Abschnitt ein, damit der neue Teil bei Tempo, Tonart und Klangfarbe ohne hörbare Naht anschließt.
  • Von beiden Enden aus verankern: Zeitmarkierungen können vom Anfang an aufwärts oder vom Ende zurück zählen, was Outro-Korrekturen und Bearbeitungen am Ende unkompliziert macht.
  • Taggesteuertes Restyling und neue Lyrics: Erstellen Sie neue Instrumente, eine neue Stimmung oder eine neue Gesangslinie aus einer kurzen Tag-Liste und einem optionalen Textblock.
  • Reproduzierbare Takes: Fixieren Sie den Seed für einen bestimmten Take oder lassen Sie ihn zufällig wählen, um alternative Variationen desselben Briefings zu testen.
  • Parität zwischen Benutzeroberfläche und API: Identische Eingaben werden in der RunComfy-Modelloberfläche und über eine HTTP-API ausgeführt.

Parameter#


ParameterErforderlichTypStandardBereich / OptionenBeschreibung
audio*Ja (*)string—HTTPS-URL zu MP3 / WAV / FLAC, bis zu 60 minZu bearbeitende Quellaudiodatei.
tags*Ja (*)string—FreitextDurch Kommas getrennte Genre-, Stimmungs- und Instrumenten-Tags steuern den Segmentstil.
start_time_relative_toNeinstringstartstart, endReferenzpunkt für start_time.
start_timeNeinnumber—0 – 240Beginn des bearbeitbaren Segments in Sekunden.
end_time_relative_toNeinstringstartstart, endReferenzpunkt für end_time.
end_timeNeinnumber300 – 240Ende des bearbeitbaren Segments in Sekunden.
lyricsNeinstring—Freitext oder [inst] / [instrumental]Liedtext für das neu generierte Segment; leer lässt das Modell seine eigenen schreiben.
seedNeininteger-1-1 – 2147483647Zufalls-Seed zur Reproduzierbarkeit; -1 randomisiert.

Preise#


ACE-Step Audio Inpaint auf RunComfy verwendet eine zeitbasierte Abrechnung, die an die Dauer der erzeugten Audioausgabe gebunden ist.


AbrechnungseinheitTarif
Pro Sekunde ausgegebenes Audio$0.0002

Beispiele für geschätzte Kosten


AusgabedauerCa. Kosten
30 s~$0.006
60 s~$0.012
180 s (3 min)~$0.036

Prompts und Referenztipps#


  • Wählen Sie Segmentgrenzen auf natürliche musikalische Zählzeiten oder Phrasenenden, damit sich Übergänge gewollt anfühlen.
  • Verwenden Sie mehrere komplementäre Tags (z. B. "lofi, mellow piano, soft drums"), um das Genre und die Instrumentierung des Segments zu sperren.
  • Passen Sie die neuen Tags an die Energie der umgebenden Audiosignale an, wenn Sie eine subtile Reparatur wünschen. Weichen Sie mutig ab, wenn Sie einen Remix wünschen.
  • Stellen Sie strukturierte Liedtexte mit konsistenter Silbenanzahl bereit, damit die neu geschriebene Gesangsphrasierung mit den umgebenden Takten übereinstimmt.
  • Für Instrumentalstücke oder zum Entfernen von Gesang aus einem Segment stellen Sie den Liedtext auf [inst] oder [instrumental] ein.
  • Verwenden Sie start_time_relative_to auf end mit einem kleinen Versatz, um ein Fade-out oder einen Schluss-Hook gezielt zu verschieben, ohne die Zeit von vorne neu zu berechnen.
  • Fixieren Sie den Seed beim Iterieren. Ändern Sie nur Tags oder Liedtexte, damit Sie Ihren Änderungen Unterschiede zuordnen können.
  • Behalten Sie die Bearbeitungen bei fokussierten Fenstern bei (jeweils einige Takte), um eine sauberere Überblendung zu erzielen, als sehr lange Bereiche neu zu schreiben.

Verwandte Modelle

veo-3-1/text-to-video

Erzeuge kinoreife Videoclips mit präziser Steuerung und natürlichem Sound

ltx-2-19b/text-to-video/lora

Erstellt aus Prompts synchronisierte Videoclips mit präziser Audio- und LoRA-Stilsteuerung.

ltx-2.5/audio-to-video/pro

LTX 2.5 Pro Audio-zu-Video für zeitgesteuerte 1080p-Finals

ltx-2.5/image-to-video/pro

LTX 2.5 Pro: Standbild-zu-Video mit synchronisiertem Audio, Qualitätsmodus

video-background-removal/fast/video-to-video

Entfernen Sie Videohintergründe mit der Fast-Variante und steuern Sie Codec, Kantenverfeinerung und Motivtyp.

kling-video-o1/video-to-video/edit

Bearbeiten Sie ein Referenzvideo anhand eines Prompts und optionaler Element- oder Bildreferenzen; auf Wunsch bleibt der Originalton erhalten.

Häufig gestellte Fragen

Was ist ACE-Step Audio Inpaint und welche Funktion hat es in einem Audio-zu-Audio-Workflow?

ACE-Step Audio Inpaint ist ein Audiobearbeitungsmodell von acestep-ai, das einen ausgewählten Zeitbereich innerhalb eines vorhandenen Tracks neu schreibt und dabei das umgebende Audio behält. In einem Audio-zu-Audio-Workflow auf RunComfy geben Sie eine Quell-URL an, markieren Start- und Endzeiten und geben Stil-Tags oder neue Liedtexte an, und ACE-Step Audio Inpaint generiert nur dieses Segment neu. Es ist für Reparatur-, Restyle- und gezielte Remix-Arbeiten konzipiert, ohne dass der gesamte Song neu gerendert werden muss.

Für welche Arten von Generierungsaufgaben ist ACE-Step Audio Inpaint am besten geeignet?

ACE-Step Audio Inpaint eignet sich am besten für Aufgaben wie das Korrigieren von Off-Beat- oder lauten Takten, das Umschreiben einer einzelnen Strophe oder eines Refrains, das Neugestalten der Instrumentierung eines Abschnitts und das Ersetzen einer Textzeile in einem fertigen Track. Es eignet sich auch gut für kurze Voiceover- oder Soundeffekt-Reparaturen, bei denen der umgebende Ton intakt bleiben muss. Da es segmentbasiert ist, eignet es sich besser für Remix-, Mastering-Vorbereitungs- und Content-Edit-Pipelines als für die vollständige Song-Generierung.

Wie schneidet ACE-Step Audio Inpaint im Vergleich zu vollständigen Text-to-Music- oder Stem-basierten Bearbeitungsansätzen ab?

Im Vergleich zu vollständigen Text-to-Music-Modellen konzentriert sich ACE-Step Audio Inpaint auf Zeitbereichsbearbeitungen und die nahtlose Einbindung in den vorhandenen Track, anstatt einen Song von Grund auf neu zu produzieren. Im Vergleich zur manuellen Stem-Trennung plus Regeneration werden Segmentauswahl, Neusynthese und Überblendung in einem einzigen Audio-zu-Audio-Durchgang gebündelt. Dies gibt technischen Künstlern in der Regel eine genauere Kontrolle darüber, was sich ändert und was gleich bleibt.

Welche Teams und Anwendungsfälle profitieren am meisten von ACE-Step Audio Inpaint in der Produktion?

Musikproduzenten, Sounddesigner, Game-Audio-Teams und Werbekreative profitieren von ACE-Step Audio Inpaint, wenn sie bestimmte Abschnitte eines vorhandenen Tracks reparieren, neu schreiben oder neu gestalten müssen. Entwickler können es in Bearbeitungstools integrieren, mit denen Benutzer einen Bereich markieren und über eine Audio-zu-Audio-Schnittstelle neue Tags oder Liedtexte einreichen können. Content-Teams können es auch für Last-Mile-Korrekturen an Trailern, Podcasts oder Spielsequenzen verwenden.

Welche Ein- und Ausgabegrenzen sollte ich kennen, bevor ich ACE-Step Audio Inpaint verwende?

Quellaudio wird normalerweise als öffentliche HTTPS-URL zu einer MP3, WAV oder FLAC bereitgestellt und kann je nach verfügbaren Anbieterinformationen bis zu etwa 60 Minuten lang sein. Das bearbeitbare Segment in ACE-Step Audio Inpaint wird in Sekunden durch start_time und end_time begrenzt, wobei jeder Wert im 0–240-Bereich liegt und entweder am Anfang oder am Ende des Tracks verankert ist. Andere Einschränkungen wie die Abtastrate und die genaue Formatunterstützung hängen von den Anbietereinstellungen ab. Überprüfen Sie daher das RunComfy-Parameterfeld auf die Live-Grenzwerte.

Wie komme ich vom Testen von ACE-Step Audio Inpaint im Playground zur Verwendung in der Produktion über die RunComfy-API?

Sie können einen Prototyp von ACE-Step Audio Inpaint im RunComfy AI Playground erstellen, indem Sie die Audio-URL, den Segmentbereich, die Tags, den Liedtext und den Seed anpassen, bis das Audio-zu-Audio-Ergebnis Ihrem Ziel entspricht. Sobald die Konfiguration stabil ist, rufen Sie dasselbe ACE-Step Audio Inpaint-Modell über die RunComfy-API mit identischen Parametern auf, um Bearbeitungen aus Ihrem Backend oder Ihrer Content-Pipeline zu automatisieren. Dadurch bleibt die kreative Iteration im Browser erhalten und die Produktion läuft im Code, ohne das Modellverhalten zu ändern.

Wie wird die Preisgestaltung gehandhabt, wenn ACE-Step Audio Inpaint auf RunComfy ausgeführt wird?

ACE-Step Audio Inpaint-Generationen verbrauchen USD-Credits von Ihrem RunComfy-Guthaben, und basierend auf den verfügbaren Anbieterinformationen wird das Modell mit $0.0002 pro Sekunde Audioausgabe abgerechnet. Neue Benutzer erhalten in der Regel kostenlose USD-Test-Credits. Anschließend folgt die Nutzung den auf der Modellseite angezeigten Generierungsregeln. Aktuelle Tarife und etwaige modusspezifische Unterschiede finden Sie im Abschnitt „Generierung“ der ACE-Step Audio Inpaint-Seite auf RunComfy.

Kann ich ACE-Step Audio Inpaint-Ausgaben kommerziell nutzen?

RunComfy bietet Zugriff auf das ACE-Step Audio Inpaint-Modell und den Audio-zu-Audio-Workflow. Die kommerziellen Nutzungsrechte für das bearbeitete Audio hängen jedoch von der Lizenz des ursprünglichen Modellautors und -anbieters (acestep-ai) sowie von allen Rechten ab, die Sie an dem von Ihnen hochgeladenen Quelltrack besitzen. Bevor Sie bearbeitetes Audio in kommerziellen Produkten, Anzeigen, Filmen oder Spielen veröffentlichen, überprüfen Sie die offizielle ACE-Step-Lizenz und Ihre Rechte an Quellaudio. Bei Fragen zur Plattform können Sie sich an hi@runcomfy.com wenden.

Folge uns
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Support
  • Discord
  • E-Mail
  • Systemstatus
  • Partner
Videomodelle
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Alle Modelle anzeigen →
Bildmodelle
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Alle Modelle anzeigen →
Rechtliches
  • Nutzungsbedingungen
  • Datenschutzrichtlinie
  • Cookie-Richtlinie
RunComfy
Urheberrecht 2026 RunComfy. Alle Rechte vorbehalten.

RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.