Compón una escena a partir de 1–6 imágenes y anímala como vídeo con Pikascenes.
Ace Step es un modelo de generación de texto a música que convierte etiquetas de estilo separadas por comas y letras opcionales en canciones completas con voces, instrumentación y letras sincronizadas. El modelo está diseñado para una iteración rápida y admite duraciones desde unos pocos segundos hasta 4 minutos (240 segundos).
Formato de salida: Solo audio / duración 5–240 segundos / estéreo / frecuencia de muestreo definida por el proveedor.
| Parámetro | Requerido | Tipo | Por defecto | Rango / Opciones | Descripción |
|---|---|---|---|---|---|
| tags* | Sí (*) | string | — | Texto libre | Lista de etiquetas de género, ambiente e instrumentos separadas por comas. |
| lyrics | No | string | — | Texto libre o [inst] / [instrumental] | Contenido vocal; déjelo en blanco para letras generadas por IA, use [inst] para instrumental. |
| duration | No | integer | 60 | 5 – 240 | Duración del audio en segundos. |
| seed | No | integer | -1 | -1 – 2147483647 | Semilla aleatoria para obtener resultados reproducibles; -1 aleatoriza. |
Ace Step en RunComfy utiliza facturación basada en tiempo para el audio generado.
| Unidad de facturación | Tarifa |
|---|---|
| Por segundo de audio generado | $0.0002 |
Ejemplos de costes estimados
| Duración | Coste aprox. |
|---|---|
| 30 s | ~$0.006 |
| 60 s (predeterminado) | ~$0.012 |
| 120 s | ~$0.024 |
| 240 s (4 mín.) | ~$0.048 |
1) Abra el modelo Ace Step en RunComfy y abra el panel de generación.
2) Introduzca etiquetas de estilo como "lofi, hiphop, chill, mellow piano" para definir el género, el estado de ánimo y la instrumentación.
3) Añada una letra si lo desea; mantenga las secciones de verso y coro claramente separadas, o use [inst] para un instrumental.
4) Establezca la duración en segundos (5–240); empiece con un clip breve para probar la dirección antes de comprometerse con un renderizado completo de 4 minutos.
5) Fije la semilla cuando desee comparar el impacto de los cambios de etiquetas o letras, o déjela en -1 para variar.
6) Ejecute la generación, obtenga una vista previa del resultado y descargue el archivo de audio de su historial de trabajo.
7) Para uso de API, envíe los mismos campos al endpoint de Ace Step en RunComfy; no se requiere autohospedaje.
8) Guarde semillas prometedoras y combinaciones de etiquetas como ajustes preestablecidos para mantener la dirección sonora constante en todo el proyecto.
Compón una escena a partir de 1–6 imágenes y anímala como vídeo con Pikascenes.
Wan 3.0 convierte una imagen del primer fotograma en un vídeo cinematográfico con sonido
Seedance 2.5 Referencia 480p: Vídeo borrador multireferencia a menor coste
Anima una imagen inicial mediante un prompt y controla LoRA, fotogramas, FPS, resolución, relación de aspecto, pasos y seed.
Dirige escenas con calidad profesional usando plantillas y comandos.
Convierte tus ilustraciones 2D en animaciones fluidas con IA avanzada.
Ace Step es un modelo de conversión de texto a música de acestep-ai que convierte etiquetas de estilo y prompts en pistas de audio completas con melodía, ritmo y voz. En un flujo de trabajo de texto a música en RunComfy, usted describe el género, el estado de ánimo y la estructura, y Ace Step genera una pieza musical coherente con letras sincronizadas. Está diseñado para creadores que desean una generación de música rápida y ágil sin composición manual.
Ace Step es más adecuado para tareas de generación de texto a música, como generar música de fondo, demostraciones de canciones breves, bucles ambientales, jingles publicitarios y pistas de referencia para escenas de vídeo o juegos. Maneja bien el control de etiquetas de estilo, por lo que puede controlar el género, el tempo y la energía con unos pocos descriptores. La generación de voces y letras también lo hace útil para escribir borradores y crear prototipos creativos.
En comparación con muchos modelos de audio generales, Ace Step se centra en una fidelidad acústica detallada, prestando atención al equilibrio dinámico, la calidad espacial y la claridad del instrumento. La interfaz de etiquetas de estilo brinda a los artistas y diseñadores técnicos un control más directo sobre el género y la energía que los prompts de formato libre. La reproducibilidad mediante el parámetro seed también ayuda a los desarrolladores a iterar consistentemente en una dirección elegida.
Los diseñadores, artistas técnicos, creadores de vídeo y equipos de producto pueden utilizar la generación de texto a música Ace Step para avances, contenido social, prototipos de audio de juegos, vídeos de comercio electrónico y creatividades publicitarias. Los desarrolladores pueden integrarlo en flujos que necesitan bandas sonoras bajo demanda vinculadas a metadatos de escena o briefings de campaña. Dado que el modelo admite voces e instrumentos, cubre una amplia gama de necesidades de audio desde una única interfaz.
Ace Step admite una duración flexible, ajustable desde unos pocos segundos hasta aproximadamente 4 minutos (240 segundos) por generación. Otras restricciones, como la longitud del prompt, los formatos de audio admitidos y las combinaciones de etiquetas, dependen de la configuración actual del proveedor, así que consulte el panel de parámetros RunComfy para conocer los límites exactos antes de diseñar el flujo de trabajo. Los límites pueden variar según el modo o la configuración del proveedor, y el panel siempre refleja los valores actuales para el endpoint de texto a música.
Puede crear un prototipo de Ace Step en la interfaz web de RunComfy AI Playground ajustando las etiquetas de estilo, los prompts, la duración y la semilla hasta que el resultado de texto a música coincida con su objetivo. Una vez que la configuración sea estable, llame al mismo modelo Ace Step a través de la API de RunComfy con parámetros idénticos para automatizar la generación desde su backend o flujo de contenido. Esto mantiene la iteración creativa en el navegador y la producción se ejecuta en código, sin cambiar el comportamiento del modelo subyacente.
Las generaciones Ace Step consumen créditos USD de su saldo RunComfy y, según la información disponible del proveedor, el modelo se factura por segundo en $0.0002. Los nuevos usuarios normalmente obtienen créditos USD de prueba gratuitos para experimentar, después de lo cual el uso sigue las tarifas de generación que se muestran en la página del modelo. Para conocer las tarifas más actuales y las diferencias específicas del modo, consulte la sección Generación de la página Ace Step en RunComfy.
RunComfy proporciona acceso al modelo Ace Step y al flujo de trabajo para generar audio, pero los derechos de uso comercial de la música generada dependen de la licencia del creador y del proveedor del modelo original (acestep-ai). Antes de publicar pistas en productos comerciales, anuncios, películas o juegos, revise la licencia oficial Ace Step y los términos del proveedor para confirmar los casos de uso permitidos. Si algo no está claro, puede comunicarse con hi@runcomfy.com para obtener orientación sobre preguntas relacionadas con la plataforma.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.