Crea películas de múltiples escenas con diálogos sincronizados y personajes consistentes. Use Kling 3.0 on RunComfy.
Ace Step 1.5 es un modelo de generación de texto a música que convierte etiquetas de estilo separadas por comas y letras estructuradas opcionales en canciones completas con voces, instrumentación y fraseo sincronizado de la letra. Admite más de 50 idiomas, se ejecuta de manera eficiente y está diseñado para una iteración rápida con duraciones desde unos pocos segundos hasta 4 minutos (240 segundos).
Formato de salida: Solo audio / duración 5–240 segundos / estéreo / frecuencia de muestreo definida por el proveedor.
| Parámetro | Requerido | Tipo | Por defecto | Rango / Opciones | Descripción |
|---|---|---|---|---|---|
| tags* | Sí (*) | string | — | Texto libre | Lista de etiquetas de género, ambiente e instrumentos separadas por comas. |
| lyrics | No | string | — | Texto libre o [inst] / [instrumental] | Contenido vocal; utilice marcadores de sección como [Verse], [Chorus], [Bridge] para estructurar la canción. |
| duration | No | integer | 60 | 5 – 240 | Duración del audio en segundos. |
| seed | No | integer | -1 | -1 – 2147483647 | Semilla aleatoria para obtener resultados reproducibles; -1 aleatoriza. |
Ace Step 1.5 en RunComfy utiliza facturación basada en tiempo para el audio generado.
| Unidad de facturación | Tarifa |
|---|---|
| Por segundo de audio generado | $0.0003 |
Ejemplos de costes estimados
| Duración | Coste aprox. |
|---|---|
| 30 s | ~$0.009 |
| 60 s (predeterminado) | ~$0.018 |
| 120 s | ~$0.036 |
| 240 s (4 mín.) | ~$0.072 |
1) Abra el modelo Ace Step 1.5 en RunComfy y abra el panel de generación.
2) Introduzca etiquetas de estilo como "lofi, hiphop, chill, mellow piano" para definir el género, el estado de ánimo y la instrumentación.
3) Añada una letra si lo desea; mantenga las secciones [Verse], [Chorus] y [Bridge] claramente separadas o use [inst] para un instrumental.
4) Establezca la duración en segundos (5–240); empiece con un clip breve para probar la dirección antes de comprometerse con un renderizado completo de 4 minutos.
5) Fije la semilla cuando desee comparar el impacto de los cambios de etiquetas o letras, o déjela en -1 para variar.
6) Ejecute la generación, obtenga una vista previa del resultado y descargue el archivo de audio de su historial de trabajo.
7) Para uso de API, envíe los mismos campos al endpoint de Ace Step 1.5 en RunComfy; no se requiere autohospedaje.
8) Guarde semillas prometedoras y combinaciones de etiquetas como ajustes preestablecidos para mantener la dirección sonora constante en todo el proyecto.
Crea películas de múltiples escenas con diálogos sincronizados y personajes consistentes. Use Kling 3.0 on RunComfy.
Anima una imagen del primer fotograma a un vídeo de 768p o 2K durante hasta 15 segundos
Convierte imágenes estáticas en clips fluidos con control de audio.
Genere un video de 5 o 10 segundos a partir de un prompt obligatorio. Elija `16:9`, `9:16` o `1:1`, agregue un prompt negativo opcional y ajuste la intensidad del prompt.
Transforma imágenes en videos realistas con movimiento fluido y gran calidad.
Redefine el estilo cuadro a cuadro y mantiene coherencia visual en tus videos.
Ace Step 1.5 es un modelo de conversión de texto a música de acestep-ai que convierte etiquetas de estilo y letras estructuradas opcionales en pistas de audio completas con melodía, ritmo y voz. En un flujo de trabajo de texto a audio en RunComfy, usted describe el género, el estado de ánimo y la estructura de la canción, y Ace Step 1.5 genera una pieza musical coherente con fraseo sincronizado de la letra. Está diseñado para creadores que desean una generación de música rápida y ágil sin composición manual.
Ace Step 1.5 es más adecuado para tareas de conversión de texto a audio, como música de fondo para vídeos, demostraciones de canciones cortas, bucles ambientales, jingles publicitarios y pistas de referencia para escenas de juegos. Maneja bien el estilo basado en etiquetas, por lo que puede controlar el género, la instrumentación y la energía con unos pocos descriptores. La generación de letras y voces también hace que Ace Step 1.5 sea útil para escribir borradores y crear prototipos creativos.
En comparación con Ace Step original, la versión 1.5 mantiene el mismo control basado en etiquetas y la duración máxima de 4 minutos al mismo tiempo que amplía el soporte de letras multilingües a más de 50 idiomas y refina el manejo de letras estructuradas. En comparación con los sistemas exclusivamente instrumentales, Ace Step 1.5 produce de forma nativa voces, instrumentación y fraseo sincronizado en una sola pasada. La reproducibilidad mediante el parámetro seed ayuda a los desarrolladores a iterar consistentemente en una dirección elegida.
Los diseñadores, artistas técnicos, creadores de vídeo y equipos de producto pueden usar Ace Step 1.5 para avances, contenido social, prototipos de audio de juegos, vídeos de comercio electrónico y creatividades publicitarias. Los desarrolladores pueden integrarlo en flujos que necesitan bandas sonoras bajo demanda vinculadas a metadatos de escena o briefings de campaña. Debido a que Ace Step 1.5 admite voces e instrumentos en muchos idiomas, cubre una amplia gama de necesidades de audio desde una única interfaz.
Ace Step 1.5 admite una duración flexible, ajustable desde 5 segundos hasta 240 segundos (4 minutos) por generación, con un único campo tags requerido y lyrics estructurado opcional. Otras restricciones, como los formatos de audio admitidos y las combinaciones de etiquetas, dependen de la configuración actual del proveedor, así que consulte el panel de parámetros RunComfy para conocer los límites exactos antes de diseñar el flujo de trabajo. Los límites pueden variar según el modo o la configuración del proveedor.
Puede crear un prototipo de Ace Step 1.5 en la interfaz web de RunComfy AI Playground ajustando las etiquetas de estilo, las letras, la duración y la semilla hasta que la salida de texto a audio coincida con su objetivo. Una vez que la configuración sea estable, llame al mismo modelo Ace Step 1.5 a través de la API de RunComfy con parámetros idénticos para automatizar la generación desde su backend o flujo de contenido. Esto mantiene la iteración creativa en el navegador y la producción se ejecuta en código, sin cambiar el comportamiento del modelo subyacente.
Las generaciones Ace Step 1.5 consumen créditos USD de su saldo RunComfy y, según la información disponible del proveedor, el modelo se factura por segundo en $0.0003. Los nuevos usuarios normalmente obtienen créditos USD de prueba gratuitos para experimentar, después de lo cual el uso sigue las tarifas de generación que se muestran en la página del modelo. Para conocer las tarifas más actuales y las diferencias específicas del modo, consulte la sección Generación de la página Ace Step 1.5 en RunComfy.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.