Convierte imágenes de referencia en un video fluido en 720P o 1080P con un solo prompt.
ACE-Step Audio Inpaint es un modelo de edición de audio que vuelve a renderizar un segmento definido de una pista existente sin alterar el resto. Proporcione una URL del audio fuente, marque el inicio y el final del segmento y describa el reemplazo con etiquetas de estilo más un bloque de letras opcional. El modelo sintetiza un segmento nuevo en su lugar y lo integra de nuevo en la mezcla circundante.
Formato de salida: Solo audio/fuente hasta 60 minutos/intervalo editable 0–240 segundos/frecuencia de muestreo definida por el proveedor.
| Parámetro | Requerido | Tipo | Por defecto | Rango / Opciones | Descripción |
|---|---|---|---|---|---|
| audio* | Sí (*) | string | — | URL HTTPS de un MP3 / WAV / FLAC de hasta 60 min | Archivo de audio fuente para editar. |
| tags* | Sí (*) | string | — | Texto libre | Etiquetas de género, estado de ánimo e instrumento separadas por comas que controlan el estilo del segmento. |
| start_time_relative_to | No | string | start | start, end | Punto de referencia para start_time. |
| start_time | No | number | — | 0 – 240 | Inicio del segmento editable en segundos. |
| end_time_relative_to | No | string | start | start, end | Punto de referencia para end_time. |
| end_time | No | number | 30 | 0 – 240 | Fin del segmento editable en segundos. |
| lyrics | No | string | — | Texto libre o [inst] / [instrumental] | Letra del segmento regenerado; déjela en blanco para que el modelo la escriba. |
| seed | No | integer | -1 | -1 – 2147483647 | Semilla aleatoria para obtener resultados reproducibles; -1 aleatoriza. |
ACE-Step Audio Inpaint en RunComfy utiliza facturación basada en tiempo vinculada a la duración del audio de salida que produce.
| Unidad de facturación | Tarifa |
|---|---|
| Por segundo de audio de salida | $0.0002 |
Ejemplos de costes estimados
| Duración de la salida | Coste aprox. |
|---|---|
| 30 s | ~$0.006 |
| 60 s | ~$0.012 |
| 180 s (3 mín.) | ~$0.036 |
Convierte imágenes de referencia en un video fluido en 720P o 1080P con un solo prompt.
Convierta un retrato y un vídeo de referencia en una animación expresiva guiada por un prompt de texto requerido.
Anime una imagen de inicio requerida con un prompt obligatorio usando Kling 2.1 Pro, con una imagen final, duración, relación de aspecto, prompt negativo e intensidad del prompt opcionales.
Convierte imágenes en videos 1080p realistas con control creativo y fluidez total.
Anime una imagen de origen obligatoria mediante un prompt. Elija 6, 8 o 10 segundos, de 1080p a 2160p, 25 o 50 FPS, formato 16:9 fijo y audio generado opcional.
Crea canciones mediante prompts, con salida WAV de 44,1 kHz y edición por secciones.
ACE-Step Audio Inpaint es un modelo de edición de audio de acestep-ai que reescribe un intervalo temporal concreto dentro de una pista existente preservando el audio circundante. En un flujo de trabajo de audio a audio en RunComfy, usted proporciona una URL de origen, define los tiempos de inicio y fin y proporciona etiquetas de estilo o letras nuevas, y ACE-Step Audio Inpaint regenera solo ese segmento. Está diseñado para trabajos de reparación, cambio de estilo y remezclas específicas sin volver a renderizar la canción completa.
ACE-Step Audio Inpaint es más adecuado para tareas como arreglar compases fuera de tiempo o ruidosos, reescribir un solo verso o estribillo, rediseñar la instrumentación de una sección y reemplazar una línea lírica en una pista terminada. También funciona bien para reparaciones breves de locuciones o efectos de sonido donde el audio circundante debe permanecer intacto. Debido a que está basado en segmentos, se adapta más a los procesos de remezcla, preparación de masterización y edición de contenido que a la generación de canciones completas.
En comparación con los modelos de generación completa de texto a música, ACE-Step Audio Inpaint se centra en ediciones de intervalos temporales y en la combinación perfecta con la pista existente en lugar de producir una canción desde cero. En comparación con la separación manual de stems y la regeneración, combina la selección de segmentos, la resíntesis y el fundido cruzado en un único paso de audio a audio. Por lo general, esto les da a los artistas técnicos un control más estricto sobre qué cambia y qué permanece igual.
Los productores musicales, diseñadores de sonido, equipos de audio de juegos y creativos publicitarios se benefician de ACE-Step Audio Inpaint cuando necesitan reparar, reescribir o cambiar el estilo de secciones específicas de una pista existente. Los desarrolladores pueden integrarlo en herramientas de edición que permiten a los usuarios marcar un rango y enviar nuevas etiquetas o letras a través de una interfaz de audio a audio. Los equipos de contenido también pueden usarlo para correcciones de última hora en avances, podcasts o cinemáticas de juegos.
El audio de origen generalmente se proporciona como una URL HTTPS pública para MP3, WAV o FLAC y, según la información disponible del proveedor, puede durar hasta aproximadamente 60 minutos. El segmento editable en ACE-Step Audio Inpaint está delimitado por start_time y end_time en segundos, con cada valor en el rango 0–240 y anclado al inicio o al final de la pista. Otras limitaciones, como la frecuencia de muestreo y la compatibilidad con el formato exacto, dependen de la configuración del proveedor, así que consulte el panel de parámetros RunComfy para conocer los límites actuales.
Puede crear un prototipo de ACE-Step Audio Inpaint en la interfaz web de RunComfy AI Playground ajustando la URL de audio, el rango de segmento, las etiquetas, la letra y la semilla hasta que el resultado de audio a audio coincida con su objetivo. Una vez que la configuración sea estable, llame al mismo modelo ACE-Step Audio Inpaint a través de la API de RunComfy con parámetros idénticos para automatizar las ediciones desde su backend o flujo de contenido. Esto mantiene la iteración creativa en el navegador y la producción se ejecuta en código, sin cambiar el comportamiento del modelo.
Las generaciones ACE-Step Audio Inpaint consumen créditos USD de su saldo RunComfy y, según la información disponible del proveedor, el modelo se factura a $0.0002 por segundo de audio de salida. Los nuevos usuarios normalmente obtienen créditos USD de prueba gratuitos para experimentar, después de lo cual el uso sigue las tarifas de generación que se muestran en la página del modelo. Para conocer las tarifas actuales y las diferencias específicas del modo, consulte la sección Generación de la página ACE-Step Audio Inpaint en RunComfy.
RunComfy proporciona acceso al modelo ACE-Step Audio Inpaint y al flujo de trabajo de audio a audio, pero los derechos de uso comercial del audio editado dependen de la licencia del creador y del proveedor del modelo original (acestep-ai), así como de cualquier derecho que posea sobre la pista fuente que cargue. Antes de publicar audio editado en productos comerciales, anuncios, películas o juegos, revise la licencia oficial de ACE-Step y sus derechos de audio fuente. Si tiene preguntas sobre la plataforma, puede comunicarse con hi@runcomfy.com.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.