logo
RunComfy
  • ComfyUI
  • トレーナー新着
  • モデル
  • API
  • 価格
discord logo
モデル
探索
すべてのモデル
ライブラリ
生成履歴
モデルAPI
APIドキュメント
APIキー
アカウント
使用量

LTX-2 19B Text-to-Video LoRA:音声同期対応の高品質テキスト動画生成 | RunComfy

ltx/ltx-2-19b/text-to-video/lora

テキストプロンプトから、同期音声、LoRA によるスタイル制御、4K 級の鮮明さ、滑らかな動きを備えた動画を生成。映画的な広告、物語、ブランド動画に適しています。

出力解像度です。
出力形式です。
動画の長さ(5~20 秒、デフォルト:5 秒)。
適用する LoRA の一覧です(最大 3 個)。
再現性を確保するシード値です(-1 はランダム)。
Idle
The rate is $0.017 per second for 480p, $0.022 per second for 720p, and $0.033 per second for 1080p.

LTX-2 19B Text-to-Video LoRA の概要

Lightricks の LTX-2 19B Text-to-Video LoRA は、プロンプトから同期音声と LoRA によるスタイル制御を備えた動画を生成します。RunComfy での料金は、480p が 1 秒あたり 0.017 ドル、720p が 0.022 ドル、1080p が 0.033 ドルで、動画の長さは 5~20 秒です。基盤モデルはネイティブ 4K・50 fps の出力に対応しています。音声と映像の同時生成、カメラ制御、IC-LoRA ガイドにより、フレーム単位の編集、別工程の音声処理、大量のマスクを使う合成作業を減らせます。

おすすめの用途:成果重視の動画広告 | 映画のプリビジュアライゼーション | ブランド統一されたソーシャル動画

Lightricks / LTX-2 19B Text-to-Video LoRA#


LTX-2 19B Text-to-Video LoRA は、テキストから同期音声付きの短い動画を生成する、190 億パラメータの LoRA 対応 Diffusion Transformer です。prompt と任意の LoRA アダプターを受け取り、複数の解像度、長さ、アスペクト比で、構図とスタイルの揃った動画を生成します。ブランドコンテンツ、ソーシャル動画、アニメーション、迅速なプロトタイピングに適しています。


出力仕様:480p~1080p / 5~20 秒 / 16:9 または 9:16 / 音声付き


主な特長#

  • LoRA によるカスタマイズ:最大 3 個のアダプターを適用し、シーンの意図を保ちながらスタイル、キャラクター、動きを調整できます。
  • 音声と映像を同時生成:環境音、効果音、会話と映像を一つの処理で生成し、自然に同期させます。
  • 柔軟な出力設定:480p、720p、1080p、16:9 または 9:16、5~20 秒から選択できます。
  • 再現性のある試行:seed を固定し、同じ基礎結果を保ちながら prompt を調整できます。
  • 安定した被写体と動き:フレーム間で被写体の一貫性を保ち、滑らかに変化させます。
  • 効率的な制作:RunComfy と API を使い、GPU インフラを管理せずにすばやく反復できます。

パラメータ#


パラメータ必須型デフォルト範囲・選択肢説明
prompt*はい (*)string——シーン、動作、音声の指示
resolutionいいえenum720p480p、720p、1080p出力解像度
aspect_ratioいいえenum16:916:9、9:16出力アスペクト比
durationいいえnumber55~20 秒動画の長さ
lorasいいえlist—最大 3 個適用する LoRA アダプター
seedいいえinteger-1-1 はランダム再現性を確保するシード値

料金#


料金は生成秒数と解像度によって決まります。


解像度1 秒あたりの料金課金単位
480p$0.017生成 1 秒あたり
720p$0.022生成 1 秒あたり
1080p$0.033生成 1 秒あたり

使い方#


  1. RunComfy のモデル一覧から LTX-2 19B Text-to-Video LoRA を選択します。
  2. prompt に被写体、動作、場所、カメラワーク、照明、環境音や会話などの音声要件を記述します。
  3. 必要に応じて loras に最大 3 個の LoRA を指定し、スタイルやキャラクターを調整します。
  4. resolution、aspect_ratio、duration を用途に合わせて設定します。
  5. 同じ傾向の結果を再現する場合は seed を固定整数にし、新しいバリエーションを得る場合は -1 にします。
  6. 生成した同期音声付き動画をプレビューします。
  7. prompt や LoRA を調整し、構図が合わない場合は長さやアスペクト比も見直します。同じ seed を使うと比較しやすくなります。
  8. RunComfy API を使えば、GPU やインフラを管理せずにバッチ生成を自動化できます。

プロンプトのヒント#


  • 被写体、動作、ショットの種類、音声の意図を具体的に記述してください。
  • 互いに矛盾するスタイルは避け、1 本の動画では主要なスタイル LoRA またはキャラクター LoRA を一つに絞ると安定しやすくなります。
  • 5~8 秒の短い動画は動きがまとまりやすく、物語上必要な場合のみ 20 秒まで延長するのがおすすめです。
  • seed を固定したまま prompt を少しずつ変えると、差を比較しやすくなります。
  • 縦型のソーシャル動画には 9:16、横型には 16:9 を選び、配信先に合う解像度を設定してください。
  • 同時に多くの動作や効果音を指示すると一貫性が下がる場合があります。重要な要素を優先してください。
  • 画面が窮屈な場合は動画を短くするかアスペクト比を変更し、スタイルが強すぎる場合は LoRA の数や影響を減らします。

関連モデル#


  • LTX-2 19B Image-to-Video LoRA
  • LTX-2 19B Video-to-Video LoRA

公式リソース#


  • 公式サイト:https://app.ltx.studio/ltx-2-playground/t2v
  • 公式 GitHub:https://github.com/Lightricks/LTX-2/tree/main
  • 公式 Hugging Face:https://huggingface.co/Lightricks/LTX-2

関連モデル

kling/lipsync/text-to-video

テキストから音声を生成して動画に同期し、音声ID、言語、速度を設定します。

kling-2-6/motion-control-pro

映画品質の高精度なモーション転写と、柔軟な映像制御を実現します。

kling/lipsync/audio-to-video

必須の動画URLと音声URLを使って、既存動画に音声を同期します。

ltx-2/pro/text-to-video

必須のプロンプトから動画を生成します。6/8/10 秒、1080p~2160p、25/50 FPS、固定 16:9、音声生成の有無を指定できます。

happyhorse-1.1/text-to-video

テキスト、画像、参照素材からネイティブ音声付き動画を生成できるマルチモーダルAIモデル。

wan-2-2/image-to-video

AIが画像を滑らかに動画化。Wan 2.2で創造性あふれる映像制作をスマートに実現。

よくある質問

出力解像度とアスペクト比には、どのような技術的制限がありますか?

LTX-2 19B Text-to-Video LoRA はモデルとして最大ネイティブ 4K(3840×2160)、50 fps に対応します。このワークフローで選択できるプリセットは 480p、720p、1080p、アスペクト比は 16:9 と 9:16 です。1 回の生成で使用できるプロンプトは現在およそ 512 tokens です。

参照アダプターは同時に何個まで使えますか?

最大 3 個の LoRA モジュールを同時に読み込めます。姿勢、深度、エッジなどを制御して構図の一貫性を高める IC-LoRA も利用できます。

RunComfy のモデルページから本番運用へ移行するには?

まずブラウザでプロンプトと設定を調整します。本番では RunComfy API を使い、動画生成、アダプターの読み込み、後処理を自動化できます。料金にはモデルページと同じ米ドル建てのクレジット制度が適用されます。

どのようなコンテンツ制作に向いていますか?

マーケティング動画、教育用解説、アニメキャラクターの会話、高フレームレートと同期音声を活かした短編動画に適しています。設定可能な LoRA はブランド表現の一貫性にも役立ちます。

映像と音声はどのように同期されますか?

Diffusion Transformer(DiT)が映像フレームと音声波形を同時にモデル化します。対話のタイミング、リップシンク、環境音を 1 回の処理で生成するため、音声を別工程で合成する必要がありません。

モデル全体を再学習せずに独自の LoRA を学習できますか?

はい。軽量な LoRA 学習でスタイル、動き、キャラクターを調整し、アダプターをメインの処理に組み込めます。独自の LoRA は RunComfy Trainer で学習できます。

フォローする
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
サポート
  • Discord
  • メール
  • システムステータス
  • アフィリエイト
ビデオモデル
  • MiniMax H3 Max
  • MiniMax H3 Max Reference to video
  • MiniMax H3 Max text to video
  • MiniMax H3 Open Reference To Video
  • Wan 3.0 Prime
  • Wan 2.7 Image to Video
  • すべてのモデルを見る →
画像モデル
  • Wan 2.6 Image to Image
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • GPT Image 2 Image Edit
  • Qwen Image 3.0 Edit
  • Qwen Image 3.0 Pro Edit
  • すべてのモデルを見る →
法的情報
  • 利用規約
  • プライバシーポリシー
  • Cookieポリシー
RunComfy
著作権 2026 RunComfy. All Rights Reserved.

RunComfyは最高の ComfyUI プラットフォームです。次のものを提供しています: ComfyUIオンライン 環境とサービス、および ComfyUIワークフロー 魅力的なビジュアルが特徴です。 RunComfyはまた提供します AI Models, アーティストが最新のAIツールを活用して素晴らしいアートを作成できるようにする。

LTX-2 19B Text-to-Video LoRA の生成例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...