logo
RunComfy
  • ComfyUI
  • トレーナー新着
  • モデル
  • API
  • 価格
discord logo
モデル
探索
すべてのモデル
ライブラリ
生成履歴
モデルAPI
APIドキュメント
APIキー
アカウント
使用量

LTX 2.5 Fast Audio To Video: Models and API のトラック同期 1080p クリップ | RunComfy

lightricks/ltx-2.5/audio-to-video/fast

LTX 2.5 Fast Audio To Video は、短いオーディオ ベッドとオプションの画像とプロンプトをトラックに合わせた 1080p ビデオに変換します。

0:00
0:00
ビデオを駆動するオーディオ ファイルの URL。期間は 2 ~ 20 秒にする必要があります。
オプションの最初のフレーム画像。省略した場合はプロンプトが必要です。
ビデオがオーディオとともにどのように見え、動くかを説明します。画像が提供されていない場合は必須です。
ビデオがプロンプトにどれだけ忠実に従っているか。値が大きいほど、テキストにしっかりと密着します。
出力アスペクト比。 auto は入力画像に従います。または、デフォルトで画像なしの 16:9 になります。
Idle
The rate is $0.14 per second of input audio at 1080p. Native audio is included.

LTX 2.5 Fast Audio To Video の紹介

LTX 2.5 Fast Audio To Video は、速度最適化モードで、オプションの開始画像とプロンプトを使用して、2 ~ 20 秒のオーディオ クリップに合わせた 1080p ビデオを生成します。音楽主導の短編映画、会話のティーザー、および音声に続いて画像を表示する必要があるトラックに合わせた広告に使用します。開発者の場合、RunComfy の LTX 2.5 Fast Audio To Video はブラウザ内で HTTP API 経由で実行されるため、モデルを自分でホストしたりスケーリングしたりする必要はありません。

LTX 2.5 Fast Audio To Video を選ぶ理由#


LTX 2.5 Fast Audio To Video は、速度最適化モードで提供されたオーディオ ベッド (ダイアログ、音楽、または SFX) にピクチャー タイミングが従うクリップを構築します。オーディオ (2 ~ 20 秒) をアップロードし、オプションで開始画像とプロンプトを追加し、トラックに合わせて 1080p ビデオを生成します。オーディオからのカットを実行していない場合は、テキストからビデオへの高速ページまたは画像からビデオへの高速ページを使用します。


利点それはあなたにとって何を意味しますか
音声主導のタイミング画像の長さとフレージングは​​アップロードされたクリップに従います。これは、ミュージック スポット、VO ショート、トラックロック広告に役立ちます。
オプションのビジュアルアンカー開始画像を追加してアイデンティティや製品の外観をロックします。それを省略し、プロンプトのみを信頼してください。
高速プレビュー他の場所で重い最終レンダリングを行う前に、カットのアイデアを反復するための速度重視のモード。
シンプルな配信管理アスペクト比 auto / 16:9 / 9:16、および迅速な遵守を強化するためのガイダンス スケール。

ベストユースケース#


  • 音楽主導のショート動画: LTX 2.5 Fast Audio To Video を使用して、ソーシャル カットやキャンペーン カットのフックやコーラスを視覚化します。
  • ダイアログと VO スポット: リップとジェスチャーのタイミングを話し言葉のテイクに近づけます。
  • 広告ベッド: キー画像がライセンスされたトラックまたはソニックロゴに変わります。
  • ポッドキャスト / インタビュー ティーザー: ホストの静止画と短い音声の抜粋を組み合わせます。

仕組み#


  1. オーディオをアップロードする: 公開されている 2 ~ 20 秒のクリップ (MP3、WAV、M4A、AAC、または OGG) を提供します。
  2. オプションの画像 + プロンプト: 最初のフレームを追加するか、サウンドに合わせてシーンがどのように動くかを説明します。
  3. フレーミングとガイダンスを設定します: アスペクト比とガイダンス スケールを選択し、生成して調整します。

パラメータ#


この LTX 2.5 Fast Audio To Video ページのコントロール:


パラメータ必須タイプデフォルト範囲/オプション選び方
audio_url*はい (*)音声 URLサンプルクリップMP3、OGG、WAV、M4A、AAC; 2 ~ 20 秒清潔なベッドを使用してください。出力の長さはこのクリップの後に続きます。
image_urlいいえ画像の URL—JPG、JPEG、PNG、WEBP、GIF、AVIFアンカーのアイデンティティまたは製品。プロンプトのみを表示するには空のままにします。
プロンプト条件付き文字列プロンプトの例最大 5,000 文字画像が提供されない場合は必須です。音声に合わせて動きを説明します。
guidance_scaleいいえ番号51–50値が大きいほど、プロンプトに従います (プロバイダー側​​にイメージが存在する場合のデフォルトは 9 近くです)。
aspect_ratioいいえ文字列autoauto、16:9、9:16auto が存在する場合は画像の後に続きます。それ以外の場合は、デフォルトで 16:9 が使用されます。

  • 必須フィールドです。ここでは長さと解像度は公開されていません。長さはオーディオに続きます。世代の料金は1080pで請求されます。

価格設定#


LTX 2.5 Fast Audio To Video は 1080p で 入力音声 1 秒あたりに請求されます。


入力音声$0.14/秒の価格
5秒$0.70
10代$1.40
15秒$2.10
20代$2.80

バッチの場合、合計 ≈ audio_秒 × $0.14 × 出力カウント。


プロンプトのヒントと例#


LTX 2.5 Fast Audio To Video に関するヒント:


  • オーディオを一致させる: ダウンビートまたはフレーズの終わりでのジェスチャー、カット、またはカメラの動きに名前を付けます。
  • 主題を単数にしてください: 1 人の出演者または製品は、密集したトラックに対してよりきれいに読み取られます。
  • アイデンティティに画像を使用する: 顔、ロゴ、パッケージは開始フレームでより安定します。
  • ガイダンスを徐々に調整します: プロンプトが無視される場合にのみ guidance_scale を上げます。

改善されたプロンプトの例


> 黒のタートルネックを着たボーカリストが、薄暗いブースでビンテージのリボンマイクに向かってヘッドフォンを付けて歌っています。ソフトなサイドキーライト、ボーカルのフレーズに合わせてゆっくり押し込みます。クリーンなスタジオのリアリズム、テキストや透かしはありません。


さらに LTX 2.5 ページを試す#


  • LTX 2.5 Fast 画像からビデオへ: 運転用オーディオ ベッドがない場合に静止画をアニメーション化します。
  • LTX 2.5 Fast Text-to-Video: コンセプト パス用のプロンプトのみの AV ドラフト。
  • LTX 2 高速画像変換: 前世代の古い LTX 2 パイプライン用の高速静止画アニメーション。

関連モデル

ltx-2/fast/image-to-video

画像とプロンプトから16:9動画を生成し、長さ、解像度、フレームレート、音声生成の有無を選べます。

react-1

必要な音声 トラックを含む短い元動画を駆動し、感情、編集範囲、長さの不一致の動作、表現力を制御します。

runway-gen-4/turbo/image-to-video

高い視覚整合性とリアルな動きを備えた次世代映像生成AI

pika-2-2/text-to-video

Pika 2.2でテキストプロンプトから高品質な動画を生成します。

ace-step-1.5/text-to-audio

スタイルタグと歌詞から、ボーカル入りの楽曲を最長4分まで生成。

ace-step/text-to-audio

スタイルタグと歌詞から、ボーカル入りの楽曲を最長4分まで生成。

よくある質問

LTX 2.5 Fast Audio To Video は何に使用されますか?

LTX 2.5 Fast Audio To Video は、指定されたオーディオ クリップに合わせてビデオを生成します。音楽主導の短編、ダイアログ ティーザー、VO スポット、および音声に続いて画像を表示する必要があるトラックに合わせた広告に適しています。

LTX 2.5 Fast Audio To Video にはどのような入力が必要ですか?

オーディオ URL が必要です (2 ~ 20 秒、MP3、WAV、M4A、AAC、または OGG)。オプションの開始画像でアイデンティティをロックでき、プロンプトでモーションを説明できます。画像を指定しない場合はプロンプトが必要です。

LTX 2.5 Fast Audio To Video はどのような解像度と期間を使用しますか?

生成はこのページの1080pに請求され、配信されます。クリップの長さは、別個の継続時間を制御するのではなく、入力オーディオの継続時間に従います。アスペクト比は、auto、16:9、または 9:16 です。

guidance_scale は LTX 2.5 Fast Audio To Video にどのような影響を与えますか?

ガイダンス スケール (1 ~ 50、デフォルト 5) は、結果がプロンプトにどれだけ厳密に従うかを制御します。テキストが無視されている場合は、徐々に値を上げてください。値が非常に高いと、制約が過剰に見える可能性があります。

LTX 2.5 Fast Audio To Video は静止画像から開始できますか?

はい。オプションの image_url を最初のフレームとして追加して、オーディオがタイミングを制御しながら、フェイス、製品、またはパッケージのアイデンティティを安定させます。画像がない場合は、明確なプロンプトを頼りにしてください。

開発者は RunComfy API を通じて LTX 2.5 Fast Audio To Video を使用できますか?

はい。 RunComfy Web UI で実行を構成し、automation の同じパラメーターを使用して、HTTP API 経由で同じ LTX 2.5 Fast Audio To Video モデルを呼び出します。

LTX 2.5 Fast Audio To Video の RunComfy の価格はいくらですか?

1080p では、入力音声 1 秒あたり 0.14 ドルが請求されます。たとえば、10 秒の音声の場合、出力ごとに 1.40 ドルかかります。世代ごとに USD/クレジットが消費されます。通常、新規ユーザーは無料試用版を受け取ります。

テキストからビデオへの変換ではなく、LTX 2.5 Fast Audio To Video を選択する必要があるのはどのような場合ですか?

完成したミュージックベッド、VO、またはダイアログテイクでカットタイミングを設定する必要がある場合は、LTX 2.5 Fast Audio To Video を選択してください。プロンプトからサウンドと画像を組み合わせて作成する場合は、テキストからビデオへの高速変換を使用します。

フォローする
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
サポート
  • Discord
  • メール
  • システムステータス
  • アフィリエイト
ビデオモデル
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • すべてのモデルを見る →
画像モデル
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • すべてのモデルを見る →
法的情報
  • 利用規約
  • プライバシーポリシー
  • Cookieポリシー
RunComfy
著作権 2026 RunComfy. All Rights Reserved.

RunComfyは最高の ComfyUI プラットフォームです。次のものを提供しています: ComfyUIオンライン 環境とサービス、および ComfyUIワークフロー 魅力的なビジュアルが特徴です。 RunComfyはまた提供します AI Models, アーティストが最新のAIツールを活用して素晴らしいアートを作成できるようにする。

LTX 2.5 Fast Audio To Video の例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...