依照提示詞將現有影片延長 7 秒,以 720p 輸出,並可選擇是否產生音訊。
此 LTX 2.5 Pro Audio To Video 頁面上的控制項:
| 參數 | 必填 | 類型 | 預設 | 範圍/選項 | 說明 |
|---|---|---|---|---|---|
audio_url* | 是 (*) | 音訊網址 | 範例剪輯 | MP3、OGG、WAV、M4A、AAC;2–20 秒 | 駕駛床;輸出時序遵循該剪輯。 |
image_url | 沒有 | 圖片網址 | — | JPG、JPEG、PNG、WEBP、GIF、AVIF | 可選的第一框架用於鎖定身分或產品外觀。 |
提示 | 有條件 | 字串 | 範例提示 | 最多 5,000 個字元 | 未提供圖片時為必填項;描述與音訊同步的運動。 |
guidance_scale | 沒有 | 數量 | 9 | 1–50 | 值越高,越能嚴格遵循提示。 |
aspect_ratio | 沒有 | 字串 | auto | auto、16:9、9:16 | 當存在時,「auto」跟隨圖像。 |
LTX 2.5 Pro Audio To Video 按每秒輸入音訊計費,1080p:
| 輸入音訊 | 價格為 0.19 美元/秒 |
|---|---|
| 5秒 | 0.95 美元 |
| 8 秒 | 1.52 美元 |
| 10 秒 | 1.90 美元 |
| 15 秒 | 2.85 美元 |
| 20 多歲 | 3.80 美元 |
對於批次,總計 ≈ audio_seconds × $0.19 × 輸出計數。
依照提示詞將現有影片延長 7 秒,以 720p 輸出,並可選擇是否產生音訊。
根據 1 張必填圖片和 1 個必填音訊檔案生成數字人影片,並可用文字提示詞補充生成指令。
根據文字提示詞生成 5 秒、10 秒或 15 秒影片,可加入來源音訊,並設定尺寸、鏡頭結構、反向提示詞、隨機種子、提示詞擴寫和生成音訊。
以 AI 精準移轉動作,快速產生穩定流暢的角色動畫。
使用參考圖與來源影片生成動畫影片,可選擇輸出尺寸並設定隨機種子。
根據風格標籤和歌詞生成最長 4 分鐘、帶人聲的歌曲。
LTX 2.5 Pro Audio To Video 在註重品質的模式下產生 1080p 視頻,與提供的 2-20 秒音頻剪輯同步。它適合音樂插曲、對話預告片和需要圖片與聲音鎖定的配樂主導的廣告。
兩者都遵循上傳的音訊床,但 LTX 2.5 Pro Audio To Video 的目標是以專業價格提供交付導向的保真度。如果您希望在決賽之前獲得更便宜的賽道定時預覽,請使用“快速”。
需要音訊(2-20 秒)。您可以添加可選的開始圖像和提示;如果沒有提供圖像,則需要提示。也提供縱橫比和引導比例。
選擇 auto、16:9 或 9:16。如果存在,則自動跟隨起始影像,或在沒有影像的情況下預設為 16:9。檢查 RunComfy 參數面板的目前預設值。
是的。提供起始影像來錨定臉孔、產品或包裝,並使用提示來描述與音訊同步的動作。如果沒有圖像,則僅靠提示來驅動外觀。
是的。在 RunComfy Web UI 中建立原型,然後透過 HTTP API 呼叫相同的 LTX 2.5 Pro Audio To Video 模型,並使用 automation 和生產工作流程的匹配參數。
按每秒 1080p 的輸入音訊計費:每秒 0.19 美元。幾代人在 RunComfy 上消費美元/積分;新用戶通常會收到免費試用金額。
支援 MP3、WAV、M4A、AAC 和 OGG 等常見格式,剪輯長度在 2 到 20 秒之間。輸出時序遵循上傳的音訊長度。
RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。





