以 Veo 3.1 Fast 快速將文字或圖像轉為高質感影片,實現創意即時視覺化。
LTX-2 19B Text-to-Video LoRA 是一款擁有 190 億參數、支援 LoRA 適配的 Diffusion Transformer,可直接根據文字生成帶同步音訊的短影片。它接受提示詞和可選 LoRA 適配器,輸出構圖連貫、風格明確的影片,支援多種解析度、時長和長寬比,適用於品牌內容、社群媒體、動畫和快速原型製作。
輸出規格:480p–1080p / 時長 5–20 秒 / 長寬比 16:9 或 9:16 / 包含音訊
seed 後,可在維持基礎結果的前提下逐步最佳化 prompt。| 參數 | 必填 | 類型 | 預設值 | 範圍/選項 | 說明 |
|---|---|---|---|---|---|
prompt* | 是 (*) | string | — | — | 描述場景、動作和音訊要求 |
resolution | 否 | enum | 720p | 480p、720p、1080p | 輸出解析度 |
aspect_ratio | 否 | enum | 16:9 | 16:9、9:16 | 輸出長寬比 |
duration | 否 | number | 5 | 5–20 秒 | 影片時長 |
loras | 否 | list | — | 最多 3 個 | 要套用的 LoRA 適配器清單 |
seed | 否 | integer | -1 | -1 表示隨機 | 用於重現結果的隨機種子 |
LTX-2 19B Text-to-Video LoRA 按生成影片的秒數和解析度計費。
| 解析度 | 每秒價格 | 計費單位 |
|---|---|---|
| 480p | $0.017 | 每生成 1 秒 |
| 720p | $0.022 | 每生成 1 秒 |
| 1080p | $0.033 | 每生成 1 秒 |
prompt:說明主體、動作、環境、攝影機動態、光線,以及環境音、音效或對白等關鍵音訊要求。loras 中指定最多 3 個 LoRA,用於引導風格或角色身分。resolution(480p/720p/1080p)、aspect_ratio(16:9 或 9:16)和 duration(5–20 秒)。seed 設為固定整數可重現結果,設為 -1 則生成新的變化。prompt 或 LoRA 清單;如果構圖不合適,可修改時長或長寬比,並使用相同 seed 進行可控比較。seed 後小幅調整 prompt,有助於穩定比較不同結果。以 Veo 3.1 Fast 快速將文字或圖像轉為高質感影片,實現創意即時視覺化。
根據提示詞重做現有影片中的指定片段,並可選擇替換音訊、畫面或同時替換兩者。
以 AI 將靜態圖像轉換為流暢動態影片,呈現電影級畫面與真實運動感。
根據文字提示詞生成 5 秒、10 秒或 15 秒影片,可加入來源音訊,並設定尺寸、鏡頭結構、反向提示詞、隨機種子、提示詞擴寫和生成音訊。
Seedance 2.5 4K Image to Video:將靜態影像動畫化為 4K 運動
使用騰訊 Hunyuan Video 將現有影片轉換為新的視覺風格。
模型能力最高可達原生 4K(3840×2160)、50 fps;目前可選預設為 480p、720p 和 1080p,長寬比支援 16:9 與 9:16。每次生成的文字提示詞上限約為 512 tokens。
最多可同時載入 3 個 LoRA 模組,其中可包括用於姿態、深度或邊緣引導等控制訊號的 IC-LoRA,以增強文生影片畫面的結構一致性。
先在 RunComfy 的瀏覽器介面中調整提示詞和參數;準備投入生產後,再透過 RunComfy API 自動執行文生影片、載入風格適配器和接入後處理流程。API 使用同一套按美元計價的額度系統。
它適合行銷短片、教學講解、動畫角色對話和風格化短影片。高影格率、同步音訊、穩定的文字遵循與可設定 LoRA,有助於維持品牌一致性並提高創意製作效率。
它採用 Diffusion Transformer(DiT)主幹,同時建模影片影格和對應音訊波形,並在一次推理中完成文生影片,從而讓對白時序、對嘴和環境音自然對齊,無需另行合成音訊。
可以。輕量 LoRA 訓練流程可有效率地微調風格、動態或角色表徵,再將適配器接入主流程,在維持文生影片一致性的同時形成獨特的創意或品牌風格。你也可以使用 RunComfy Trainer 訓練自己的 LoRA。
RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。





