logo
RunComfy
  • ComfyUI
  • 訓練器新
  • 模型
  • API
  • 定價
discord logo
模型
探索
所有模型
資源庫
生成記錄
模型 API
API 文檔
API 金鑰
帳戶
使用情況

LTX-2 19B Text-to-Video LoRA:生成帶同步音訊的逼真文字影片 | RunComfy

ltx/ltx-2-19b/text-to-video/lora

將文字提示詞生成帶同步音訊的影片,透過 LoRA 控制風格,並提供 4K 級清晰度與流暢動態,適合電影感廣告、故事短片和品牌內容。

輸出解析度。
輸出格式。
影片時長(5–20 秒,預設 5 秒)。
要套用的 LoRA 清單(最多 3 個)。
用於重現結果的隨機種子(-1 表示隨機)。
Idle
The rate is $0.017 per second for 480p, $0.022 per second for 720p, and $0.033 per second for 1080p.

LTX-2 19B Text-to-Video LoRA 簡介

Lightricks 的 LTX-2 19B Text-to-Video LoRA 可將提示詞生成音訊與影片同步的短片:480p 每秒 0.017 美元、720p 每秒 0.022 美元、1080p 每秒 0.033 美元;支援 5–20 秒時長,模型能力最高可達原生 4K、50 fps,並在一次生成中完成音訊與影片同步和基於 LoRA 的風格控制。它以模態感知控制、攝影機動態與 IC-LoRA 引導以及穩定的角色風格,取代手動逐格編輯、獨立音訊後期和大量遮罩合成,協助電影製作、VFX、遊戲、教育和行銷團隊簡化短影片製作並省去重新同步流程。
適合:高轉換影片廣告 | 電影預演 | 維持品牌一致的社群短片

Lightricks / LTX-2 19B Text-to-Video LoRA#


LTX-2 19B Text-to-Video LoRA 是一款擁有 190 億參數、支援 LoRA 適配的 Diffusion Transformer,可直接根據文字生成帶同步音訊的短影片。它接受提示詞和可選 LoRA 適配器,輸出構圖連貫、風格明確的影片,支援多種解析度、時長和長寬比,適用於品牌內容、社群媒體、動畫和快速原型製作。


輸出規格:480p–1080p / 時長 5–20 秒 / 長寬比 16:9 或 9:16 / 包含音訊


亮點#

  • LoRA 自訂:最多套用 3 個適配器,用於控制風格、角色或動態,同時盡量維持場景意圖。
  • 一次生成音訊與影片:同時生成畫面與聲音,使環境音、音效或對白自然同步。
  • 彈性輸出:可選 480p、720p、1080p;16:9 或 9:16;時長 5–20 秒。
  • 可重現迭代:固定 seed 後,可在維持基礎結果的前提下逐步最佳化 prompt。
  • 角色和動態一致性:通常能在跨格過程中維持主體連貫與平滑過渡。
  • 高效流程:可接入 RunComfy,無需自建基礎設施,並適合透過 API 快速迭代。

參數#


參數必填類型預設值範圍/選項說明
prompt*是 (*)string——描述場景、動作和音訊要求
resolution否enum720p480p、720p、1080p輸出解析度
aspect_ratio否enum16:916:9、9:16輸出長寬比
duration否number55–20 秒影片時長
loras否list—最多 3 個要套用的 LoRA 適配器清單
seed否integer-1-1 表示隨機用於重現結果的隨機種子

價格#


LTX-2 19B Text-to-Video LoRA 按生成影片的秒數和解析度計費。


解析度每秒價格計費單位
480p$0.017每生成 1 秒
720p$0.022每生成 1 秒
1080p$0.033每生成 1 秒

使用方法#


  1. 在 RunComfy 模型目錄中選擇 LTX-2 19B Text-to-Video LoRA。
  2. 編寫 prompt:說明主體、動作、環境、攝影機動態、光線,以及環境音、音效或對白等關鍵音訊要求。
  3. 加入適配器(可選):在 loras 中指定最多 3 個 LoRA,用於引導風格或角色身分。
  4. 設定輸出:選擇 resolution(480p/720p/1080p)、aspect_ratio(16:9 或 9:16)和 duration(5–20 秒)。
  5. 控制重現:將 seed 設為固定整數可重現結果,設為 -1 則生成新的變化。
  6. 生成並預覽帶同步音訊的單一影片檔案。
  7. 檢查並迭代:調整 prompt 或 LoRA 清單;如果構圖不合適,可修改時長或長寬比,並使用相同 seed 進行可控比較。
  8. API 自動化:透過 RunComfy API 批次提交任務,無需管理基礎設施或 GPU。

提示詞與參考技巧#


  • 從具體資訊開始:說明主體、動作、鏡頭類型(如「廣角跟拍」)和音訊意圖(如「細雨聲、遠處車流」)。
  • 維持風格統一:避免混合互相衝突的美學方向;每段影片通常使用一個主要風格或角色 LoRA 更穩定。
  • 合理設定時長:5–8 秒的短片通常動態更緊湊;只有敘事需要時才延長到 20 秒。
  • 固定 seed 後小幅調整 prompt,有助於穩定比較不同結果。
  • 為平台構圖:直向社群內容使用 9:16,橫向使用 16:9,並按發佈管道選擇解析度。
  • 避免過載:同時安排太多動作或音效可能降低連貫性,應優先保留最重要的敘事節點。
  • 常見修正:畫面過於擁擠時可縮短時長或切換長寬比;風格過強時可移除 LoRA 或降低適配器影響。

更多可嘗試的模型#


  • LTX-2 19B Image-to-Video LoRA
  • LTX-2 19B Video-to-Video LoRA

官方資源#


  • 官方網站:https://app.ltx.studio/ltx-2-playground/t2v
  • 官方 GitHub:https://github.com/Lightricks/LTX-2/tree/main
  • 官方 Hugging Face:https://huggingface.co/Lightricks/LTX-2

相關模型

veo-3-1/fast/text-to-video

以 Veo 3.1 Fast 快速將文字或圖像轉為高質感影片,實現創意即時視覺化。

ltx-2/retake-video

根據提示詞重做現有影片中的指定片段,並可選擇替換音訊、畫面或同時替換兩者。

wan-2-1/image-to-video

以 AI 將靜態圖像轉換為流暢動態影片,呈現電影級畫面與真實運動感。

wan-2-6/text-to-video

根據文字提示詞生成 5 秒、10 秒或 15 秒影片,可加入來源音訊,並設定尺寸、鏡頭結構、反向提示詞、隨機種子、提示詞擴寫和生成音訊。

seedance-2.5/image-to-video/4k

Seedance 2.5 4K Image to Video:將靜態影像動畫化為 4K 運動

hunyuan/video-to-video

使用騰訊 Hunyuan Video 將現有影片轉換為新的視覺風格。

常見問題

LTX-2 19B Text-to-Video LoRA 的輸出解析度和長寬比有哪些技術限制?

模型能力最高可達原生 4K(3840×2160)、50 fps;目前可選預設為 480p、720p 和 1080p,長寬比支援 16:9 與 9:16。每次生成的文字提示詞上限約為 512 tokens。

LTX-2 19B Text-to-Video LoRA 最多可以同時套用多少個適配器?

最多可同時載入 3 個 LoRA 模組,其中可包括用於姿態、深度或邊緣引導等控制訊號的 IC-LoRA,以增強文生影片畫面的結構一致性。

如何從 RunComfy 模型頁面過渡到生產部署?

先在 RunComfy 的瀏覽器介面中調整提示詞和參數;準備投入生產後,再透過 RunComfy API 自動執行文生影片、載入風格適配器和接入後處理流程。API 使用同一套按美元計價的額度系統。

哪些內容生成任務最適合 LTX-2 19B Text-to-Video LoRA?

它適合行銷短片、教學講解、動畫角色對話和風格化短影片。高影格率、同步音訊、穩定的文字遵循與可設定 LoRA,有助於維持品牌一致性並提高創意製作效率。

LTX-2 19B Text-to-Video LoRA 如何實現音訊與影片同步?

它採用 Diffusion Transformer(DiT)主幹,同時建模影片影格和對應音訊波形,並在一次推理中完成文生影片,從而讓對白時序、對嘴和環境音自然對齊,無需另行合成音訊。

可以為 LTX-2 19B Text-to-Video 訓練自訂 LoRA,而不重新訓練整個模型嗎?

可以。輕量 LoRA 訓練流程可有效率地微調風格、動態或角色表徵,再將適配器接入主流程,在維持文生影片一致性的同時形成獨特的創意或品牌風格。你也可以使用 RunComfy Trainer 訓練自己的 LoRA。

關注我們
  • 領英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 電子郵件
  • 系統狀態
  • 附屬
視頻模型
  • MiniMax H3 Max
  • MiniMax H3 Max Reference to video
  • MiniMax H3 Max text to video
  • MiniMax H3 Open Reference To Video
  • Wan 3.0 Prime
  • Wan 2.7 Image to Video
  • 查看所有模型 →
影像模型
  • Wan 2.6 Image to Image
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • GPT Image 2 Image Edit
  • Qwen Image 3.0 Edit
  • Qwen Image 3.0 Pro Edit
  • 查看所有模型 →
法律
  • 服務條款
  • 隱私政策
  • Cookie 政策
RunComfy
版權 2026 RunComfy. 保留所有權利。

RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。

LTX-2 19B Text-to-Video LoRA 生成範例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...