使用一段音訊與一張圖片生成影片,並可視需要設定提示詞與隨機種子。
Wan 3.0 Text To Video 讀取簡單語言描述並傳回一個簡短的影片剪輯。您描述主題、動作、攝影機和光線;該模型可以構圖、驅動動作,並且可以一次添加匹配的音訊。
本頁涵蓋 Wan 3.0 系列的純文字端點。無需上傳圖像,因此這是一種快速探索想法、勾勒場景或僅透過文字製作完成的短鏡頭的方法。
| 參數 | 必填 | 類型 | 預設 | 範圍/選項 | 說明 |
|---|---|---|---|---|---|
| 提示* | 是 (*) | 字串 | - | - | 場景、主題、動作、攝影機、燈光和動作。 |
| 解析度 | 沒有 | 字串 | 720p | 480p、720p、1080p | 輸出解析度層。 |
| aspect_ratio | 沒有 | 字串 | 16:9 | 16:9、9:16、1:1、4:3、3:4、adaptive | 輸出縱橫比。 |
| 持續時間 | 沒有 | 整數 | 5 | 2-30 | 2-30輸出長度(以秒為單位)。 |
| thinking_mode | 沒有 | 布爾 | 假 | 真/假 | 對複雜提示進行更深入的解釋。 |
| enable_audio | 沒有 | 布爾 | 真 | 真/假 | 包含同步音軌。 |
| 種子 | 沒有 | 整數 | 隨機 | 0-2147483647 | 可重複結果的種子。 |
定價取決於所選解析度:480p 每秒 0.06 美元,720p 每秒 0.12 美元,1080p 每秒 0.25 美元。啟用或停用音訊不會更改速率。
使用一段音訊與一張圖片生成影片,並可視需要設定提示詞與隨機種子。
FLUX 3 Draft I2V:720p 快速靜態影片預覽草稿
精確重製音軌中的指定片段,其餘部分保持不變。
根據文字提示詞生成影片,可選擇長寬比以及 5 秒或 10 秒時長。
以Hailuo 2.3 Fast Standard輕鬆將靜態圖片轉化為流暢動態影片,展現真實創意。
使用 Pikadditions 將圖像中的人物或物件加入現有影片。
Wan 3.0 Text To Video 直接根據書面提示產生簡短的影片剪輯,無需參考影像。它對於概念預視覺化、廣告和促銷鏡頭以及社交影片非常有用,讓您只需幾分鐘即可透過文字將想法形象化。
文字到視訊端點僅從提示開始,因此模型組成了整個場景,而圖像到視訊端點則對您提供的特定第一幀進行動畫處理。當您希望模型發明取景時,請選擇 Wan 3.0 Text To Video;當您已經有了開場鏡頭時,請選擇影像到影片。
Wan 3.0 Text To Video 遵循結構化提示,命名主題、動作、攝影機移動和燈光,並產生連貫的、電影般的動作。清晰、具體的提示以及每次拍攝的單一攝影機方向通常會給出最可預測的結果。
它支持 480p、720p 和 1080p 输出,持续时间从 2 到 30 秒,宽高比包括 16:9、9:16、1:1、4:3 和 3:4。使用 480p 進行快速草稿,使用 1080p 進行交付;檢查 RunComfy 面板以了解確切的電流限制。
是的。 Wan 3.0 Text To Video 可以產生與視訊同步的音軌,並且您可以停用音訊以進行靜默匯出。啟用或停用音訊不會影響價格。
思考模式可以對提示進行更審慎的解釋,這在場景結合了多個動作、主題或構圖規則時會有所幫助。它是可選的,預設為關閉狀態,因此您可以針對複雜的提示啟用它,而對於簡單的提示則將其關閉。
是的。您可以在 RunComfy 模型 UI 中對 Wan 3.0 Text To Video 進行原型設計,然後使用相同的參數透過 RunComfy HTTP API 呼叫相同的模型。這使得從瀏覽器測試轉移到自動化生產工作流程變得簡單。
各世代根據解析度和持續時間消耗美元或積分:480p 每秒 0.06 美元,720p 每秒 0.12 美元,1080p 每秒 0.25 美元。新用戶通常會收到免費試用金額以先測試 Wan 3.0 Text To Video。
RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。





