使用兩段音訊與一張圖片生成影片,並設定兩位人物的發言順序。
LTX 2.5 Fast Text To Video 將書面提示一次轉換為同步的音訊視訊剪輯。它是 LTX 2.5 的速度優化的文本到視頻層 - 專為鎖定最終結果之前的快速草稿和預覽而構建。此頁面純文字;當您要跟隨靜止圖像或配樂時,請使用“圖像到視訊”或“音訊到視訊”快速頁面。
| 優勢 | 這對您意味著什麼 |
|---|---|
| 提示→AV一通 | 一起生成图片和原生音频,以便对话、SFX 和氛围融入镜头中。 |
| 快速迭代 | 以速度为中心的模式,用于探索相机语言、灯光和节拍,无需等待重量级渲染。 |
| 靈活的長度和解析度 | 選擇「auto」持續時間或 6-20 秒,並在 720p、1080p、1440p 或 4K (2160p) 進行投放。 |
| 可选相机宏 | 当您需要规定的相机路径时,应用移动车、摇臂、static 或焦点移动预设。 |
## 參數
此 LTX 2.5 Fast Text To Video 頁面上的控制項:
| 參數 | 必填 | 類型 | 預設 | 範圍/選項 | 如何選擇 |
|---|---|---|---|---|---|
提示* | 是 (*) | 字串 | 範例提示 | 最多 5,000 個字元 | 建立主題、動作、攝影機、背景、風格和音訊。 |
持續時間 | 沒有 | 字串 | auto | auto、6、8、10、12、14、16、18、20 | 使用「auto」作為模型推斷的長度;計時固定秒數在計時。 |
決議 | 沒有 | 字串 | 1080p | 720p、1080p、1440p、2160p | 匯票更便宜,720p;為決賽加油。 |
aspect_ratio | 沒有 | 字串 | 16:9 | 16:9、9:16 | 匹配橫向網路/廣告或垂直社交。 |
fps | 沒有 | 整數 | 25 | 24、25、48、50 | 社論 (24/25) 或更平滑的運動 (48/50)。 |
generate_audio | 沒有 | 布林 | 真實 | “真”/“假” | 開啟表示同步聲音;關閉靜音板。 |
camera_motion | 沒有 | 字串 | — | dolly_in、dolly_out、dolly_left、dolly_right、jib_up、jib_down、static、focus_shift | 可選的指定相機路徑。 |
LTX 2.5 Fast Text To Video 按產生影片的每秒計費。每個解析度都包含本機音訊。
| 解析度 | 每秒價格 | 6秒 | 10 秒 | 20 多歲 |
|---|---|---|---|---|
| 720p | 0.10 美元 | 0.60 美元 | 1.00 美元 | 2.00 美元 |
| 1080p | 0.14 美元 | 0.84 美元 | 1.40 美元 | 2.80 美元 |
| 1440p | 0.21 美元 | 1.26 美元 | 2.10 美元 | 4.20 美元 |
| 4K (2160p) | 0.33 美元 | 1.98 美元 | 3.30 美元 | 6.60 美元 |
對於批次,總計 ≈“持續時間 × 每秒速率 × 輸出計數”。當時長為「auto」時,依實際產生的時長計費。
LTX 2.5 Fast Text To Video 的可重複使用結構:
[主題 + 細節] + [隨時間變化的動作] + [攝影機] + [背景 + 燈光] + [外觀] + [音訊] + [結局]
改進的提示範例
> 爵士三重奏在木鑲板俱樂部中表演:直立式貝斯、拉絲鼓和穿著午夜藍色西裝的小號手。溫暖的鎢絲壁燈、柔和的薄霧、前景中的觀眾剪影。從左到右緩慢橫向移動,然後輕輕推入喇叭鈴。模擬膠片顆粒。音訊:現場喇叭聲、柔和的筆觸、安靜的房間雜音。
使用兩段音訊與一張圖片生成影片,並設定兩位人物的發言順序。
以 AI 將靜態圖像轉化為動態影片,打造自然順暢的角色敘事效果。
智慧AI影片創作工具,將文字轉化為1080p動態影像,輕鬆打造富有情感與張力的視覺故事。
透過必填參考圖片與元素陣列生成影片,使用按順序編號的 @Image 和 @Element 標記,並精確控制片長與長寬比。
以單張圖片輕鬆生成流暢影片,動作自然、轉場順暢,為創作者開啟更多靈感可能。
以 Kling 2.1 將靜態圖片與文字提示轉化為高畫質動態影片,展現真實立體運動效果。
LTX 2.5 Fast Text To Video 以速度最佳化模式將書面提示轉換為同步音訊視訊剪輯。當您沒有啟動影像或駕駛音訊床時,它是概念草稿、社交掛鉤和相機/燈光預覽的理想選擇。
此頁面僅包含文字:沒有圖像或音訊參考輸入。使用 LTX 2.5 Fast Text To Video 進行提示優先探索,然後在仍然必須鎖定構圖或身份時切換到圖像到影片快速。
您可以將持續時間設定為 auto 或 6-20 秒,解析度從 720p 到 4K (2160p),寬高比 16:9 或 9:16,FPS 24/25/48/50,可選的攝影機運動預設以及 generate_audio 開啟或關閉。
是的。啟用 generate_audio 後,影像和聲音會一起產生,本機音訊包含在每種解析度的每秒價格中。禁用靜音板的音訊。
提示最多可包含 5,000 個字元。清晰的結構——主題、一個主要動作、攝影機、燈光、風格和音訊——通常比滿足限制更重要。
是的。在 RunComfy Web UI 中設定原型,然後透過 HTTP API 重複使用相同的 LTX 2.5 Fast Text To Video 參數進行批次作業和產品整合。
按生成影片的每秒計費:720p 為 0.10 美元,1080p 為 0.14 美元,1440p 為 0.21 美元,4K (2160p) 為 0.33 美元。自動時長依實際產生時長計費。幾代人消費美元/信用;新用戶通常會收到免費試用金額。
當您需要快速預覽和提示迭代時,請選擇 LTX 2.5 Fast Text To Video。當您需要更重的參考控製或鎖定的最終外觀時,請轉向更費力的管道或其他模型。
RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。





