logo
RunComfy
  • ComfyUI
  • トレーナー新着
  • モデル
  • API
  • 価格
discord logo
モデル
探索
すべてのモデル
ライブラリ
生成履歴
モデルAPI
APIドキュメント
APIキー
アカウント
使用量

ACE-Step Audio Inpaint:モデルページとAPIで使える区間編集・歌詞変更・スタイル変更 | RunComfy

acestep-ai/ace-step/audio-inpaint

音声トラックの指定区間を新しいスタイルタグや歌詞で再合成し、元のミックスへ自然に戻します。RunComfyのモデルページとHTTP APIから利用できます。

0:00
0:00
編集する元音声です。MP3、WAV、FLACファイルのHTTPS URLを指定してください(最長60分)。
再生成する区間のスタイルを導くジャンル、ムード、楽器をカンマ区切りで指定します。
開始時間の基準点です。'start'は曲の先頭から、'end'は末尾から逆向きに数えます。
選択した基準点から測った、編集区間の開始位置(秒)です。
終了時間の基準点です。'start'は曲の先頭から、'end'は末尾から逆向きに数えます。
選択した基準点から測った、編集区間の終了位置(秒)です。
再生成区間の任意の歌詞です。空欄ではモデルが作詞し、[inst]または[instrumental]ではボーカルなしになります。
結果を再現するためのランダムシードです。-1では毎回ランダムになります。
Idle
The rate is $0.0002 per second of output audio.

ACE-Step Audio Inpaintの概要

ACE StudioのACE-Step Audio Inpaintは、既存トラックの指定区間を出力音声1秒あたり$0.0002で再合成し、残りのミックスを変えずに歌詞、楽器編成、ムードを差し替えます。曲全体の再生成や手作業のステム編集を、対象を絞ったプロンプト制御の処理に置き換え、音楽プロデューサー、サウンドデザイナー、ゲーム音声チーム、広告制作者の修復・リミックス作業を短縮します。開発者はRunComfy上のACE-Step Audio InpaintをブラウザでもHTTP API経由でも利用できるため、モデルを自社でホスティングしたり、処理能力を管理したりする必要はありません。
おすすめの用途:歌詞の書き換えとパンチイン | セクションのスタイル変更とリミックス | ナレーションと効果音の修復

ACE Studio / ACE-Step Audio Inpaint#


ACE-Step Audio Inpaintは、既存トラックの指定区間だけを再レンダリングし、それ以外を変えない音声編集モデルです。元音声のURLと区間の開始・終了位置を指定し、スタイルタグと任意の歌詞で置き換える内容を説明します。新しい区間を同じ位置に合成し、前後のミックスへ自然につなぎます。


出力形式:音声のみ / 元音声は最長60分 / 区間は0~240秒 / サンプルレートはプロバイダー規定


主な特長#


  • 区間単位の書き換え:開始・終了時間で範囲を固定し、その中だけを再合成します。範囲外はビット単位で同一に保たれます。
  • 境界を考慮した接続:区間の直前・直後を参照し、テンポ、キー、音色を合わせて目立つ継ぎ目を抑えます。
  • 先頭・末尾のどちらからでも指定:先頭から数えるほか、末尾から逆算できるため、アウトロや曲末の修正が簡単です。
  • タグによるスタイル・歌詞変更:短いタグ一覧と任意の歌詞で、楽器、ムード、ボーカルラインを差し替えます。
  • 再現可能なテイク:シードを固定して同じテイクを保つか、ランダム化して別案を試せます。
  • 画面とAPIの同等性:RunComfyのモデル画面とHTTP APIで同じ入力を使えます。

パラメータ#


パラメータ必須型デフォルト範囲/選択肢説明
audio*はい(*)string—MP3 / WAV / FLACのHTTPS URL、最長60分編集する元音声。
tags*はい(*)string—自由入力区間のスタイルを導くジャンル、ムード、楽器のタグ。
start_time_relative_toいいえstringstartstart、endstart_timeの基準点。
start_timeいいえnumber—0~240編集区間の開始秒。
end_time_relative_toいいえstringstartstart、endend_timeの基準点。
end_timeいいえnumber300~240編集区間の終了秒。
lyricsいいえstring—自由入力または[inst] / [instrumental]再生成する区間の歌詞。空欄ではモデルが作詞。
seedいいえinteger-1-1~2147483647再現用シード。-1はランダム。

料金#


RunComfy上のACE-Step Audio Inpaintは、生成した出力音声の長さに応じて課金されます。


課金単位料金
出力音声1秒$0.0002

概算料金


出力の長さ概算
30秒約$0.006
60秒約$0.012
180秒(3分)約$0.036

プロンプトと参照素材のコツ#


  • 自然な拍やフレーズの終わりに区間の境界を置くと、意図したつながりに聞こえます。
  • 「lofi, mellow piano, soft drums」のように補完し合うタグを複数使い、ジャンルと楽器編成を固定します。
  • 自然な修復では周囲の音声とエネルギーをそろえ、リミックスでは意図的に異なるタグを使います。
  • 音節数をそろえた構造的な歌詞にすると、書き換えたボーカルが前後の小節に合います。
  • インストゥルメンタル化やボーカル除去では、lyricsを[inst]または[instrumental]にします。
  • start_time_relative_toをendにして小さなオフセットを使うと、先頭から時間を計算せずにフェードアウトや最後のフックを修正できます。
  • 反復時はシードを固定し、タグか歌詞だけを変えて差分の原因を判断します。
  • 長い範囲を一度に書き換えるより、数小節ずつに絞る方が自然につながります。

関連モデル

wan-2-2/text-to-video

Wan 2.2 Plusでプロンプトから5秒の動画を生成し、サイズ、シード、プロンプト拡張を設定します。

runway-gen-4/turbo/image-to-video

高い視覚整合性とリアルな動きを備えた次世代映像生成AI

gemini-omni-flash/text-to-video

テキストプロンプトから同期音声付きのシネマティック動画を生成。

runway-aleph/video-to-video

テキストと画像から高品質な映像を自在に生成・編集可能

sync/lipsync/v2

必須の動画URLと音声URLからリップシンク動画を作成します。`lipsync-2` または `lipsync-2-pro` を選択でき、Proは同じ長さで約1.67倍の料金です。入力時間の不一致には5種類の同期モードを選べます。

fantasy-portrait/image-to-video

必須のポートレート画像と参照動画を使い、プロンプトに沿った表情豊かなアニメーションを生成します。

よくある質問

ACE-Step Audio Inpaintとは何ですか?音声から音声を生成する工程で何ができますか?

ACE-Step Audio Inpaintはacestep-aiの音声編集モデルで、周囲の音声を保ちながら既存トラックの指定時間だけを書き換えます。RunComfyでは元音声URL、開始・終了時間、スタイルタグや新しい歌詞を指定し、その区間だけを再生成します。曲全体を作り直さず、修復、スタイル変更、狙ったリミックスを行うためのモデルです。

ACE-Step Audio Inpaintに適した編集用途は?

ACE-Step Audio Inpaintは、拍のずれやノイズのある小節の修復、1つのバースやコーラスの書き換え、区間の楽器変更、完成曲の歌詞1行の差し替えに適しています。周囲を残す必要がある短いナレーションや効果音の修復にも使え、リミックス、マスタリング前の調整、コンテンツ編集に向きます。

ACE-Step Audio Inpaintは曲全体の音楽生成やステム編集とどう違いますか?

曲をゼロから作るモデルと違い、ACE-Step Audio Inpaintは時間範囲の編集と既存トラックへの自然な接続に特化します。手作業でステムを分離して再生成する方法と比べ、区間選択、再合成、クロスフェードを1回の処理にまとめ、変える部分と残す部分を正確に制御できます。

ACE-Step Audio Inpaintはどのようなチームや制作に適していますか?

音楽プロデューサー、サウンドデザイナー、ゲーム音声チーム、広告制作者が、既存トラックの特定区間を修復、書き換え、スタイル変更するときに役立ちます。開発者は範囲指定と新しいタグ・歌詞の送信機能を編集ツールに組み込めます。予告編、ポッドキャスト、ゲーム映像の最終修正にも利用できます。

ACE-Step Audio Inpaintの入出力制限は?

元音声は通常、公開HTTPS URLのMP3、WAV、FLACで指定し、公開されている情報では最長約60分です。編集区間はstart_timeとend_timeで指定し、各値は0~240秒、基準は曲の先頭または末尾から選べます。サンプルレートや厳密な形式はプロバイダー設定に依存するため、RunComfyの画面で最新値を確認してください。

ACE-Step Audio InpaintをPlaygroundからRunComfy APIの本番運用へ移す方法は?

RunComfy AI Playgroundで音声URL、区間、タグ、歌詞、シードを調整し、ACE-Step Audio Inpaintの結果を確認します。設定が固まったら同一パラメータでRunComfy APIから呼び出し、バックエンドや制作工程を自動化できます。画面とコードでモデルの挙動は変わりません。

RunComfyでACE-Step Audio Inpaintを使う料金は?

ACE-Step Audio InpaintはRunComfyのUSD/クレジット残高を消費し、公開情報では出力音声1秒あたり$0.0002です。新規ユーザーには通常、無料お試しクレジットが付与され、その後はモデルページのGeneration欄に表示される料金が適用されます。

ACE-Step Audio Inpaintの出力は商用利用できますか?

商用権は元の作者・プロバイダーであるacestep-aiのライセンスと、アップロードする元トラックについて保有する権利に従います。製品、広告、映画、ゲームで公開する前に、ACE-Stepの公式ライセンスと元音声の権利を確認してください。プラットフォーム側の質問はhi@runcomfy.comへお問い合わせください。

フォローする
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
サポート
  • Discord
  • メール
  • システムステータス
  • アフィリエイト
ビデオモデル
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • すべてのモデルを見る →
画像モデル
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • すべてのモデルを見る →
法的情報
  • 利用規約
  • プライバシーポリシー
  • Cookieポリシー
RunComfy
著作権 2026 RunComfy. All Rights Reserved.

RunComfyは最高の ComfyUI プラットフォームです。次のものを提供しています: ComfyUIオンライン 環境とサービス、および ComfyUIワークフロー 魅力的なビジュアルが特徴です。 RunComfyはまた提供します AI Models, アーティストが最新のAIツールを活用して素晴らしいアートを作成できるようにする。