Offenes Bild-zu-Video mit optionalem letztem Bild und nativem Stereo-Audio.
Ace Step 1.5 ist ein Text-to-Music-Generierungsmodell, das durch Kommas getrennte Stil-Tags und optionale strukturierte Lyrics in vollständige Songs mit Gesang, Instrumentierung und synchronisierter Lyrics-Phrasierung umwandelt. Es unterstützt mehr als 50 Sprachen, läuft effizient und ist für schnelle Iterationen mit einer Dauer von wenigen Sekunden bis zu 4 Minuten (240 Sekunden) ausgelegt.
Ausgabeformat: Nur Audio / Dauer 5–240 Sekunden / Stereo / vom Anbieter definierte Abtastrate.
| Parameter | Erforderlich | Typ | Standard | Bereich / Optionen | Beschreibung |
|---|---|---|---|---|---|
| tags* | Ja (*) | string | — | Freitext | Durch Kommas getrennte Liste von Genre-, Stimmungs- und Instrumenten-Tags. |
| lyrics | Nein | string | — | Freitext oder [inst] / [instrumental] | Gesangsinhalt; verwenden Sie Abschnittsmarkierungen wie [Verse], [Chorus], [Bridge], um den Song zu strukturieren. |
| duration | Nein | integer | 60 | 5 – 240 | Audiolänge in Sekunden. |
| seed | Nein | integer | -1 | -1 – 2147483647 | Zufalls-Seed zur Reproduzierbarkeit; -1 randomisiert. |
Ace Step 1.5 auf RunComfy verwendet eine zeitbasierte Abrechnung für generiertes Audio.
| Abrechnungseinheit | Tarif |
|---|---|
| Pro Sekunde generierter Audiodaten | $0.0003 |
Beispiele für geschätzte Kosten
| Dauer | Ca. Kosten |
|---|---|
| 30 s | ~$0.009 |
| 60 s (Standard) | ~$0.018 |
| 120 s | ~$0.036 |
| 240 s (4 min) | ~$0.072 |
1) Öffnen Sie das Ace Step 1.5-Modell in RunComfy und zeigen Sie das Generierungsfenster an.
2) Geben Sie Stil-Tags wie "lofi, hiphop, chill, mellow piano" ein, um Genre, Stimmung und Instrumentierung zu definieren.
3) Fügen Sie optional Lyrics hinzu; halten Sie die Abschnitte [Verse], [Chorus] und [Bridge] klar getrennt oder verwenden Sie [inst] für ein Instrumental.
4) Stellen Sie die Dauer in Sekunden ein (5–240); beginnen Sie mit einem kurzen Entwurf, um die Richtung zu testen, bevor Sie einen vollständigen 4-Minuten-Track rendern.
5) Sperren Sie den Seed, wenn Sie die Auswirkungen von Tag- oder Textänderungen vergleichen möchten, oder belassen Sie ihn zur Abwechslung bei -1.
6) Führen Sie die Generierung aus, zeigen Sie eine Vorschau des Ergebnisses an und laden Sie die Audiodatei aus Ihrem Auftragsverlauf herunter.
7) Senden Sie für die API-Nutzung dieselben Felder an den Endpunkt Ace Step 1.5 auf RunComfy. Es ist kein Selbsthosting erforderlich.
8) Speichern Sie vielversprechende Seed- und Tag-Kombinationen als Voreinstellungen, um Ihre Klangrichtung im gesamten Projekt konsistent zu halten.
Offenes Bild-zu-Video mit optionalem letztem Bild und nativem Stereo-Audio.
FLUX 3 Draft: Schnelle, kostengünstige Text-zu-Video-Vorschau mit 720p
Animieren Sie ein erforderliches Startbild mit einem erforderlichen Prompt mithilfe von Kling 2.1 Pro, mit optionalem Endbild, Dauer, Seitenverhältnis, Negativ-Prompt und Prompt-Stärke.
FLUX 3 Video verwandelt Textansagen in filmische Clips mit nativem Audio
Cineastische Text-zu-Video-Generierung in Pro-Qualität für 0,112 $ pro Sekunde Ausgabe.
Animieren Sie ein Ausgangsbild per Prompt zu einem 5- oder 8-sekündigen Video in 480p oder 720p.
Ace Step 1.5 ist ein Text-to-Music-Modell von acestep-ai, das Style-Tags und optionale strukturierte Lyrics in vollständige Audiospuren mit Melodie, Rhythmus und Gesang umwandelt. In einem Text-zu-Audio-Workflow auf RunComfy beschreiben Sie das Genre, die Stimmung und die Songstruktur, und Ace Step 1.5 generiert ein zusammenhängendes Musikstück mit synchronisierter Lyrics-Phrasierung. Es ist für Künstler konzipiert, die eine schnelle, promptgesteuerte Musikgenerierung ohne manuelle Komposition wünschen.
Ace Step 1.5 eignet sich am besten für Text-zu-Audio-Aufgaben wie Hintergrundmusik für Videos, kurze Songdemos, Ambient-Loops, Werbe-Jingles und Referenztracks für Spielszenen. Es beherrscht Tag-basiertes Styling gut, sodass Sie Genre, Instrumentierung und Energie mit ein paar Deskriptoren steuern können. Dank der Text- und Gesangsgenerierung eignet sich Ace Step 1.5 auch für Songwriting-Entwürfe und kreatives Prototyping.
Im Vergleich zum ursprünglichen Ace Step behält die Version 1.5 die gleiche Tag-gesteuerte Steuerung und die maximale Dauer von 4 Minuten bei, erweitert jedoch die mehrsprachige Textunterstützung auf mehr als 50 Sprachen und verfeinert die strukturierte Textverarbeitung. Im Vergleich zu reinen Instrumentalsystemen erzeugt Ace Step 1.5 nativ Gesang, Instrumentierung und synchronisierte Phrasierung in einem einzigen Durchgang. Die Reproduzierbarkeit durch einen Seed-Parameter hilft Entwicklern, konsistent in einer gewählten Richtung zu iterieren.
Designer, technische Künstler, Videokünstler und Produktteams können Ace Step 1.5 für Trailer, soziale Inhalte, Audio-Prototypen von Spielen, E-Commerce-Videos und Werbemittel verwenden. Entwickler können es in Pipelines einbinden, die On-Demand-Soundtracks benötigen, die mit Szenenmetadaten oder Kampagnenbeschreibungen verknüpft sind. Da Ace Step 1.5 sowohl Gesang als auch Instrumentalstücke in vielen Sprachen unterstützt, deckt es ein breites Spektrum an Audioanforderungen über eine einzige Schnittstelle ab.
Ace Step 1.5 unterstützt eine flexible Dauer, einstellbar von 5 Sekunden bis zu 240 Sekunden (4 Minuten) pro Generation, mit einem einzigen erforderlichen tags-Feld und optionalem strukturiertem lyrics. Andere Einschränkungen wie unterstützte Audioformate und Tag-Kombinationen hängen von der aktuellen Anbieterkonfiguration ab. Überprüfen Sie daher das RunComfy-Parameterfeld auf genaue Grenzwerte, bevor Sie darauf aufbauen. Die Grenzwerte können je nach Modus oder Anbietereinstellungen variieren.
Sie können einen Prototyp von Ace Step 1.5 im RunComfy AI Playground erstellen, indem Sie Stil-Tags, Texte, Dauer und Seed anpassen, bis die Text-zu-Audio-Ausgabe Ihrem Ziel entspricht. Sobald die Konfiguration stabil ist, rufen Sie dasselbe Ace Step 1.5-Modell über die RunComfy-API mit identischen Parametern auf, um die Generierung aus Ihrem Backend oder Ihrer Content-Pipeline zu automatisieren. Dadurch bleiben die kreative Iteration im Browser und die Produktionsläufe im Code erhalten, ohne das zugrunde liegende Modellverhalten zu ändern.
Ace Step 1.5-Generationen verbrauchen USD-Credits von Ihrem RunComfy-Guthaben, und basierend auf den verfügbaren Anbieterinformationen wird das Modell pro Sekunde bei $0.0003 abgerechnet. Neue Benutzer erhalten in der Regel kostenlose USD-Test-Credits. Anschließend folgt die Nutzung den auf der Modellseite angezeigten Generierungsregeln. Die aktuellsten Tarife und alle modusspezifischen Unterschiede finden Sie im Abschnitt „Generierung“ der Ace Step 1.5-Seite auf RunComfy.
RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.