使用Veo 3.1将静态图像一键转化为逼真动态视频,轻松实现创意叙事与视觉表达。
大多数音乐工具会要求重新生成整首歌曲才能延长时长,而 Ace Step Audio Outpaint 能从完成的歌曲向外续写:在开头、结尾或两端创作新小节,同时让源音频逐比特保持不变。提供音轨 URL,指定前后各要增加多少秒,再用逗号分隔的风格标签和可选歌词控制新内容。扩展部分会继承源音轨的节奏感与配器,并通过交叉淡化接入原曲,让接缝听起来像编曲本身,而非明显的剪辑点。
输出格式:仅音频 / 源音频最长 60 分钟 / 每个方向可扩展 0–240 秒 / 采样率由提供方定义。
| 参数 | 必填 | 类型 | 默认值 | 范围 / 选项 | 说明 |
|---|---|---|---|---|---|
| audio* | 是(*) | string | — | MP3 / WAV / FLAC 的 HTTPS URL,最长 60 分钟 | 要扩展的源音频文件。 |
| tags* | 是(*) | string | — | 自由文本 | 以逗号分隔的曲风、情绪和乐器标签,用于控制扩展风格。 |
| extend_before_duration | 否 | number | 0 | 0–240 | 在原音轨之前生成的新音频秒数。 |
| extend_after_duration | 否 | number | 30 | 0–240 | 在原音轨之后生成的新音频秒数。 |
| lyrics | 否 | string | — | 自由文本或 [inst] / [instrumental] | 扩展段落中用于演唱的可选歌词。 |
| seed | 否 | integer | -1 | -1–2147483647 | 用于复现结果的随机种子;-1 表示随机。 |
RunComfy 上的 Ace Step Audio Outpaint 按最终输出总时长计费,即源音频时长加 extend_before_duration 和 extend_after_duration。
| 计费单位 | 费率 |
|---|---|
| 每输出 1 秒总音频 | $0.0002 |
费用估算示例
| 原曲 | 向前扩展 | 向后扩展 | 总时长 | 约计费用 |
|---|---|---|---|---|
| 60 秒 | 0 秒 | 30 秒 | 90 秒 | 约 $0.018 |
| 90 秒 | 10 秒 | 30 秒 | 130 秒 | 约 $0.026 |
| 120 秒 | 0 秒 | 60 秒 | 180 秒 | 约 $0.036 |
| 180 秒 | 30 秒 | 30 秒 | 240 秒 | 约 $0.048 |
使用Veo 3.1将静态图像一键转化为逼真动态视频,轻松实现创意叙事与视觉表达。
来自图像、视频和音频提示的视频的开放权重参考。
Sora 2 轻松将图像转化为逼真视频,视觉与音频自然同步,激发创意灵感。
将一张参考图制作成 5 秒或 10 秒的视频,并可设置反向提示词与原生音频生成。
结合必填的人像图片、参考视频和提示词,生成表情与动作自然的人像动画。
根据文字提示词和 1~3 段参考视频生成视频,并可设置时长、输出尺寸、镜头结构、随机种子、反向提示词和音频生成。
Ace Step Audio Outpaint 是 acestep-ai 推出的音频扩展模型,可在现有音轨之前、之后或两端生成新内容。在 RunComfy 的音频转音频流程中,提供源 URL、设置各方向扩展秒数,再输入风格标签或可选歌词,Ace Step Audio Outpaint 就会生成与原曲自然融合的续写段落,无需重新渲染源音轨即可延长歌曲。
Ace Step Audio Outpaint 适合添加前奏和尾奏、延长视频或播客背景音乐、制作加长混音,以及生成需要超过原剪辑时长的自适应游戏或媒体音频。创作歌曲时,也可用它以相同风格延展已有想法。它支持双向扩展,一次即可同时处理开头和结尾。
与手工循环拼接相比,Ace Step Audio Outpaint 会生成风格匹配的新小节并融合到源音频,而不是重复已有片段。与整曲文字转音乐相比,它保留现有音轨,只在指定端点增加内容,因此原编曲不会被改动,技术美术也能更准确地控制音轨如何变长。
音乐制作人、视频剪辑师、游戏音频团队和广告创意人员需要让现有音轨适配更长场景、节目或活动时,都可使用 Ace Step Audio Outpaint。开发者可以把它接入编辑工具,让用户通过音频转音频界面指定前奏或尾奏秒数;若配乐只比最终剪辑短一点,内容团队也可用它完成最后补足。
源音频通常通过 MP3、WAV 或 FLAC 的公开 HTTPS URL 提供;根据现有提供方信息,最长约 60 分钟。Ace Step Audio Outpaint 的两个扩展方向均支持 0–240 秒:extend_before_duration 控制开头,extend_after_duration 控制结尾。采样率和准确格式支持等限制取决于提供方设置,请以 RunComfy 参数面板的实时值为准。
先在 RunComfy AI Playground 网页界面中调整源 URL、扩展时长、标签、歌词和种子,直到 Ace Step Audio Outpaint 的音频转音频结果符合目标。配置稳定后,即可通过 RunComfy API 以相同参数调用同一模型,在后端或内容流水线中自动扩展;浏览器负责创意迭代,代码负责生产运行,模型行为不变。
Ace Step Audio Outpaint 会从 RunComfy 余额中扣除美元积分。根据现有提供方信息,模型按最终输出总时长,即原音频加两端扩展时长,每秒 $0.0002 计费。新用户通常会获得一笔免费试用美元额度,之后按模型页面 Generation 区域所示规则收费;最新费率和模式差异也请以该区域为准。
RunComfy 提供 Ace Step Audio Outpaint 模型和音频转音频流程,但扩展后音频的商业使用权取决于原模型作者及提供方(acestep-ai)的许可,也取决于您对上传源音轨拥有的权利。将结果用于商业产品、广告、电影或游戏前,请查看 ACE-Step 官方许可并确认源音频权利。平台侧问题可联系 hi@runcomfy.com。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。