logo
RunComfy
  • ComfyUI
  • 訓練器新
  • 模型
  • API
  • 定價
discord logo
模型
探索
所有模型
資源庫
生成記錄
模型 API
API 文檔
API 金鑰
帳戶
使用情況

Wan 3.0:影像到影片、首尾幀、Models and API 上的音訊 | RunComfy

wan-ai/wan-3.0/image-to-video

Wan 3.0 將第一幀圖像動畫化為連貫的視頻,並具有可選的最後一幀控制、靈活的持續時間、寬高比和音頻,以實現精美的短片。

描述您希望第一格動畫呈現的動作、動作、攝影機移動、燈光和風格。
模型將第一幀圖像動畫化為影片。使用清晰、高品質的影像可以更好地保留拍攝對象。
可選的最後一幀影像,用於指導影片的結束姿勢、構圖或場景。
輸出分辨率層。使用 480p 進行快速草稿,使用 1080p 獲得更高品質的輸出。
輸出縱橫比。使用 adaptive 匹配輸入影像比例。
產生影片的長度(以秒為單位)。範圍為 2-30。開始時進行短距離迭代,然後在運動看起來正確後增加。
為具有多種動作或構圖要求的複雜場景提供更深入的提示解釋。
開啟時,輸出視訊包括同步音軌。關閉以獲得無聲剪輯。
隨機種子以獲得可重複的結果。範圍為 0 到 2147483647。
Idle
The rate is $0.06 per second for 480p, $0.12 per second for 720p, and $0.25 per second for 1080p.

Wan 3.0 簡介

Wan 3.0 影像到影片將單一第一幀影像以影片剪輯的形式呈現出來,並具有可選的最後一幀引導、2-30 秒的持續時間、寬高比控制和同步音訊。將緩慢的手動關鍵影格換成快速驅動的運動,使主題和場景保持一致,它適合產品行銷人員、肖像和生活方式創作者以及快速發布短片的社交團隊。對於開發人員來說,RunComfy 上的 Wan 3.0 既可以在瀏覽器中使用,也可以透過 HTTP API 使用,因此您無需自行託管或擴充模型。
非常適合:產品和行銷剪輯|肖像動畫|垂直社交視頻

為什麼選擇Wan 3.0#


Wan 3.0 是 Wan-AI 的一體化視訊生成模型,可將文字、圖像、視訊、音訊、檔案和網頁轉換為具有同步聲音的連貫剪輯。此頁面提供 Wan 3.0 Image to Video:為其提供第一幀圖像和提示,然後將該幀動畫化為 2-30 秒的剪輯,並可選用最後一幀來確定鏡頭的結束方式。相同的底層模型還運行文本到視頻和參考到視頻,因此您在這裡開發的外觀可以在整個系列中傳輸。


Wan 3.0優勢這對您意味著什麼
一種模型,多種輸入Wan 3.0 處理文字、第一幀/最後一幀圖像、參考圖像、視頻、音頻、文檔和鏈接,因此您很少需要在想法之間切換工具。
首幀和末幀控制在此頁面上,您可以設定開始幀和結束幀,與僅第一幀的動畫相比,Wan 3.0 可以更嚴格地控制鏡頭的開始和結束方式。
靈活的 2–30 秒輸出Wan 3.0 渲染短草稿或較長的單次拍攝,因此快速迭代和完成的鏡頭來自同一端點。
同步音頻,可選每個 Wan 3.0 結果都可以包含匹配的音軌,或者您可以導出無聲剪輯 - 切換音頻不會改變價格。

最佳用例#


  • 產品和行銷影片: 使用 Wan 3.0 將產品或包裝照片變成具有受控運動和取景的簡短宣傳剪輯。
  • 肖像和生活方式動畫: 讓 Wan 3.0 將肖像、時尚或生活方式動畫化為自然的品牌時刻。
  • 社群媒體內容: 從單一影像產生垂直、方形或寬螢幕 Wan 3.0 剪輯,用於捲軸、短片、故事或提要展示位置。
  • 創意原型製作: 在進行完整的生產過程之前,使用 Wan 3.0 從固定框架測試相機方向、運動和視覺風格。

它是如何工作的#


  1. 設定起始影格: 上傳 Wan 3.0 將帶來的乾淨、高解析度的第一幀影像。
  2. 描述運動: 告訴 Wan 3.0 什麼在移動、相機如何移動以及光線和場景如何隨時間變化。
  3. 引導結局(可選): 當最終姿勢、構圖或場景很重要時添加最後一幀圖像,Wan 3.0 將在兩者之間架起橋樑。
  4. 選擇交付格式: 選擇解析度、寬高比、2-30 秒的持續時間以及是否產生音頻,然後查看 Wan 3.0 結果並每次最佳化一條指令。

## 參數


第一個表格列出了此頁面上 Wan 3.0 Image to Video 工具公開的控制項。


參數必填類型預設範圍/選項如何選擇
提示*是 (*)字串範例提示最多 20,000 個字元描述主體、其運動、相機移動、燈光和風格。清晰的結構比長度更重要。
image_url*是 (*)字串範例圖片圖片 URL 或 Base64第一幀 Wan 3.0 產生動畫。使用清晰、光線充足、整潔的影像,以實現最佳的主題保留。
end_image_url沒有字串空白圖片 URL 或 Base64可選的最後一幀;當結束姿勢或構圖固定時設定它。
決議沒有字串720p480p、720p、1080p使用「480p」進行快速草稿,使用「1080p」進行更詳細的交付。
aspect_ratio沒有字串adaptiveadaptive、16:9、9:16、1:1、4:3、3:4保留「adaptive」以跟隨輸入影像,或強制指定特定位置的比例。
持續時間沒有整數52–30 秒在完善動作時保持較短的距離,然後在方向確定後將其升高。
thinking_mode沒有布林假「真」/「假」啟用結合了多個動作或合成規則的複雜提示。
enable_audio沒有布林真實“真”/“假”繼續播放同步音軌;關閉以取得靜音剪輯。
種子沒有整數隨機0–2147483647修復種子以重現結果,同時進行小的、可比較的編輯。

  • 必填欄位。

下表總結了更廣泛的 Wan 3.0 模型。參考、文件和純文字輸入可透過模型的其他模式和同級工具取得,而不是作為此影像到影片頁面上的控制項。


核心維度Wan 3.0
型號wan3.0-video
生成模式文字轉視訊;圖像到視訊(第一幀,或第一幀+最後一幀);來自圖像、視訊和音訊的視訊參考;加上文件和網路連結參考。
輸出持續時間2-30 秒。使用視訊輸入時,輸入加輸出保持在 30 秒內。智慧持續時間選項讓 Wan 3.0 推薦長度。
解析度“480P”、“720P”或“1080P”。
輸出縱橫比adaptive(從輸入中推薦)或16:9、4:3、1:1、3:4、9:16。
輸出音訊可選的同步音頻,與圖片一起產生並預設為開啟。
第一幀/最後一幀輸入最多 1 個「first_frame」和 1 個「last_frame」。圖:JPEG、JPG、PNG、BMP 或 WEBP;每邊「240–8000」像素;寬高比高達「8:1」;每個最多 20 MB。
參考圖片最多 10 個參考影像,以確保主題、物件或場景的一致性。
參考影片最多 5 個剪輯; MP4 或 MOV;每次「1–15」秒;組合影片長達 15 秒;每邊「240–4096」像素;每個剪輯最多 100 MB。
參考音訊最多 5 個剪輯; WAV 或 MP3;組合音訊長達 15 秒;每個最多 15 MB。
文檔/網頁輸入一份文檔(DOCX、PDF、PPTX、XLSX、TXT 及類似文檔,最多 50 頁)或一個公共 Web 連結。
模式獨家第一幀/最後一幀輸入不能與同一請求中的參考、文檔或連結輸入組合。
提示限制最多 20,000 個字元。

定價#


Wan 3.0 定價取決於您選擇的解析度和產生的持續時間。啟用或停用 Wan 3.0 音訊不會變更速率。


解析度每秒價格5秒10 秒30 多歲
480p0.06 美元0.30 美元0.60 美元1.80 美元
720p0.12 美元0.60 美元1.20 美元3.60 美元
1080p0.25 美元1.25 美元2.50 美元7.50 美元

對於 1-4 個輸出的批次,計算總數為「持續時間 × 每秒速率 × 輸出計數」。


提示和參考提示#


使用這個可重複使用的 Wan 3.0 結構:


[主題 + 定義細節] + [隨著時間的推移一個動作] + [相機取景和移動] + [設定 + 燈光] + [視覺處理] + [音訊] + [結束影格或約束]


  • 引導主題: 說出第一幀包含的內容,然後描述 Wan 3.0 應如何移動它。
  • 將相機與主體分開: 獨立描述主體運動和相機運動,以獲得更清晰的 Wan 3.0 結果。
  • 使用清晰的第一幀: 視訊輸入出現模糊、混亂或低解析度。
  • 錨定結局: 當特定的最終姿勢或構圖無可協商時,取得最後一幀影像。
  • 開啟思考模式: 當 Wan 3.0 鏡頭分層多個動作或構圖規則時啟用它。
  • 修復種子: 一旦鏡頭看起來正確就鎖定種子,這樣您就可以公平地比較小的提示編輯。

Wan 3.0 比較如何#


使用此 Wan 3.0 比較作為模型系列指南;最大解析度和持續時間可能無法同時使用,不同的工具可以公開不同的輸入和控制項。基於公開資訊。


型號解析度最長持續時間音訊傑出
Wan 3.0480p–1080p30 多歲可選同步音訊一個一體化模型,涵蓋文字、第一幀/最後一幀以及來自圖像、視訊和音訊的視訊參考,以及文件和 Web 輸入。
克林3.0高達 4K15 秒具有口型同步的原生音訊協調腳本廣告和角色場景的多鏡頭攝影機變化和揚聲器分配的對話。
海螺021080p〜10 秒無以物理為中心的運動和對無聲動作和產品鏡頭的強烈提示依從性。
種子之舞 2.51080p30 多歲音視頻聯合具有同步語音和效果的參考大量生成,用於身份敏感的編輯。
維奧 3.14K8 秒原生對話和效果適用於電影過渡和組合序列的第一幀/最後一幀和參考控制。

Wan 3.0 的獨特之處在於其廣度:單一模型可以對第一幀進行動畫處理,尊重最後一幀,並且可以從圖像、視頻、音頻、文檔和鏈接中提取數據,同時生成可選的同步聲音。當您有一個可以賦予生命的開放框架時,請選擇 Wan 3.0 Image to Video;當您的起點發生變化時,請移至文字或參考工具。


更多模型可供嘗試#


  • Wan 3.0 文字到影片: 當您沒有起始影像時,僅根據提示產生剪輯。
  • Wan 3.0 視訊參考: 組合影像、視訊和音訊參考以實現角色和物件的一致性。
  • Seedance 2.5 文字到影片: 從文字產生快速、低成本的草稿渲染。
  • Kling 3.0: 使用可選的結束幀和同步音訊對起始影像進行動畫處理。

官方資源#


  • Wan 3.0影片產生API參考(阿里雲Model Studio)
  • Wan模型家族概述

相關模型

seedance-v1.5-pro/image-to-video

使用 Seedance 1.5 Pro 將靜態圖像轉換為具有流暢、逼真過渡和創意靈活性的電影級影片剪輯。

kling-3.0/pro/text-to-video

Kling V3.0 系列中具有最高視覺保真度的優質電影文字轉影片。

kling-2-6/pro/image-to-video

將一張參考圖製作成 5 秒或 10 秒的影片,並可設定反向提示詞與原生音訊產生。

wan-2-1/fusionx/image-to-video

以 AI 技術打造電影級影片,精準控制圖像轉化流程,激發無限創意

hunyuan-video-v1.5/image-to-video

依圖片與提示詞生成 5 秒或 8 秒的 480p 或 720p 影片。

ltx-2-19b/text-to-video/lora

根據提示詞生成音訊與影片同步的動態短片,並精確控制 LoRA 風格。

常見問題

Wan 3.0 在影像到視訊工作流程的用途是什麼?

Wan 3.0 影像到影片採用單一第一幀影像,並根據您的文字提示將其動畫化為簡短、連貫的剪輯。它非常適合將產品照片、肖像、生活方式照片或概念藝術轉變為動態,而無需索具或手動關鍵影格。

Wan 3.0 中的第一幀和最後一幀選項如何運作?

您始終提供第一幀影像,並且當結束姿勢或構圖很重要時,您可以選擇新增最後一幀影像。然後,Wan 3.0 會產生從第一幀開始一直到最後一幀的連續運動,讓您可以更嚴格地控制鏡頭的開始和結束方式。

Wan 3.0 從輸入影像保留主體的效果如何?

由於第一幀直接用作影片的開頭,Wan 3.0 傾向於在整個剪輯中保持主體的外觀和取景一致。使用清晰、明亮、整潔的輸入影像可以最好地保留主題。

Wan 3.0 影像到影片支援哪些解析度、持續時間和寬高比?

Wan 3.0 支援 480p、720p 和 1080p 輸出,其中 720p 作為常見預設值。持續時間可在 2 至 30 秒之間調節,寬高比可以是寬螢幕、垂直、方形或經典,或設定為 adaptive 以使其跟隨輸入影像。檢查 RunComfy 參數面板以了解確切的電流限制。

Wan 3.0 可以與影片一起產生音訊嗎?

是的。 Wan 3.0 可以與剪輯一起產生同步音軌,並且當您只需要無聲素材時可以關閉音訊。切換音訊不會改變生成成本。

在使用 Wan 3.0 之前我應該了解哪些輸入限制?

輸入影像應為常見格式,例如 JPEG、PNG 或 WEBP,並具有合理的解析度和寬高比。品質極低或嚴重混亂的幀會降低運動質量,因此最好選擇乾淨、高解析度的第一幀。限制可能因提供者設定而異。

開發人員可以透過 RunComfy API 使用 Wan 3.0 嗎?

是的。您可以在 RunComfy 模型 UI 中對 Wan 3.0 進行原型設計,然後透過 RunComfy HTTP API 使用相同的參數呼叫相同的模型以進行生產或自動化。這使您可以從瀏覽器測試轉移到整合管道,而無需更改模型。

在 RunComfy 上使用 Wan 3.0 產生需要多少錢?

各世代根據輸出解析度和持續時間消耗美元或積分:480p 每秒 0.06 美元,720p 每秒 0.12 美元,1080p 每秒 0.25 美元。新用戶通常會獲得免費試用量來嘗試 Wan 3.0,然後再進行更大規模的運行。

關注我們
  • 領英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 電子郵件
  • 系統狀態
  • 附屬
視頻模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
影像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服務條款
  • 隱私政策
  • Cookie 政策
RunComfy
版權 2026 RunComfy. 保留所有權利。

RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。

Wan 3.0 的範例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...