必要な 1 つの画像と音声ファイルからアバター 動画を作成します。生成ガイダンス用のオプションのテキスト プロンプトも使用できます。
ACE-Step Audio Inpaintは、既存トラックの指定区間だけを再レンダリングし、それ以外を変えない音声編集モデルです。元音声のURLと区間の開始・終了位置を指定し、スタイルタグと任意の歌詞で置き換える内容を説明します。新しい区間を同じ位置に合成し、前後のミックスへ自然につなぎます。
出力形式:音声のみ / 元音声は最長60分 / 区間は0~240秒 / サンプルレートはプロバイダー規定
| パラメータ | 必須 | 型 | デフォルト | 範囲/選択肢 | 説明 |
|---|---|---|---|---|---|
| audio* | はい(*) | string | — | MP3 / WAV / FLACのHTTPS URL、最長60分 | 編集する元音声。 |
| tags* | はい(*) | string | — | 自由入力 | 区間のスタイルを導くジャンル、ムード、楽器のタグ。 |
| start_time_relative_to | いいえ | string | start | start、end | start_timeの基準点。 |
| start_time | いいえ | number | — | 0~240 | 編集区間の開始秒。 |
| end_time_relative_to | いいえ | string | start | start、end | end_timeの基準点。 |
| end_time | いいえ | number | 30 | 0~240 | 編集区間の終了秒。 |
| lyrics | いいえ | string | — | 自由入力または[inst] / [instrumental] | 再生成する区間の歌詞。空欄ではモデルが作詞。 |
| seed | いいえ | integer | -1 | -1~2147483647 | 再現用シード。-1はランダム。 |
RunComfy上のACE-Step Audio Inpaintは、生成した出力音声の長さに応じて課金されます。
| 課金単位 | 料金 |
|---|---|
| 出力音声1秒 | $0.0002 |
概算料金
| 出力の長さ | 概算 |
|---|---|
| 30秒 | 約$0.006 |
| 60秒 | 約$0.012 |
| 180秒(3分) | 約$0.036 |
必要な 1 つの画像と音声ファイルからアバター 動画を作成します。生成ガイダンス用のオプションのテキスト プロンプトも使用できます。
Kling V3.0シリーズで最高水準の映像品質と動きのリアリズムを備えた、プレミアムな画像動画生成モデルです。
テキストや画像を使って1080pの10秒動画を生成。柔軟で直感的な映像制作を支援。
1枚のポートレートと1本の音声からトーキングアバター動画を生成し、任意のプロンプトで動きや話し方を指定できます。
既存動画の指定区間をプロンプトに従ってリテイクし、音声のみ、映像のみ、または両方を置き換えます。
静止画のポートレートを、表情豊かで自然な動画へ高精度に変換します。
ACE-Step Audio Inpaintはacestep-aiの音声編集モデルで、周囲の音声を保ちながら既存トラックの指定時間だけを書き換えます。RunComfyでは元音声URL、開始・終了時間、スタイルタグや新しい歌詞を指定し、その区間だけを再生成します。曲全体を作り直さず、修復、スタイル変更、狙ったリミックスを行うためのモデルです。
ACE-Step Audio Inpaintは、拍のずれやノイズのある小節の修復、1つのバースやコーラスの書き換え、区間の楽器変更、完成曲の歌詞1行の差し替えに適しています。周囲を残す必要がある短いナレーションや効果音の修復にも使え、リミックス、マスタリング前の調整、コンテンツ編集に向きます。
曲をゼロから作るモデルと違い、ACE-Step Audio Inpaintは時間範囲の編集と既存トラックへの自然な接続に特化します。手作業でステムを分離して再生成する方法と比べ、区間選択、再合成、クロスフェードを1回の処理にまとめ、変える部分と残す部分を正確に制御できます。
音楽プロデューサー、サウンドデザイナー、ゲーム音声チーム、広告制作者が、既存トラックの特定区間を修復、書き換え、スタイル変更するときに役立ちます。開発者は範囲指定と新しいタグ・歌詞の送信機能を編集ツールに組み込めます。予告編、ポッドキャスト、ゲーム映像の最終修正にも利用できます。
元音声は通常、公開HTTPS URLのMP3、WAV、FLACで指定し、公開されている情報では最長約60分です。編集区間はstart_timeとend_timeで指定し、各値は0~240秒、基準は曲の先頭または末尾から選べます。サンプルレートや厳密な形式はプロバイダー設定に依存するため、RunComfyの画面で最新値を確認してください。
RunComfy AI Playgroundで音声URL、区間、タグ、歌詞、シードを調整し、ACE-Step Audio Inpaintの結果を確認します。設定が固まったら同一パラメータでRunComfy APIから呼び出し、バックエンドや制作工程を自動化できます。画面とコードでモデルの挙動は変わりません。
ACE-Step Audio InpaintはRunComfyのUSD/クレジット残高を消費し、公開情報では出力音声1秒あたり$0.0002です。新規ユーザーには通常、無料お試しクレジットが付与され、その後はモデルページのGeneration欄に表示される料金が適用されます。
商用権は元の作者・プロバイダーであるacestep-aiのライセンスと、アップロードする元トラックについて保有する権利に従います。製品、広告、映画、ゲームで公開する前に、ACE-Stepの公式ライセンスと元音声の権利を確認してください。プラットフォーム側の質問はhi@runcomfy.comへお問い合わせください。
RunComfyは最高の ComfyUI プラットフォームです。次のものを提供しています: ComfyUIオンライン 環境とサービス、および ComfyUIワークフロー 魅力的なビジュアルが特徴です。 RunComfyはまた提供します AI Models, アーティストが最新のAIツールを活用して素晴らしいアートを作成できるようにする。