logo
RunComfy
  • ComfyUI
  • 訓練器新
  • 模型
  • API
  • 定價
discord logo
模型
探索
所有模型
資源庫
生成記錄
模型 API
API 文檔
API 金鑰
帳戶
使用情況

Wan 2.6 Text to Image:支援參考圖的精準文字生成圖片模型 | RunComfy

wan-ai/wan-2-6/text-to-image

根據文字提示與參考圖生成高品質圖片,精準控制風格與主體一致性,適合品牌視覺、廣告素材和電商商品圖。

提示詞長度須少於 2000 個字元。
可選的參考圖。支援 JPEG、JPG、PNG(不含 Alpha 色版)、BMP 和 WEBP;單邊解析度為 384~5000 px,檔案上限為 10 MB。
填寫不希望出現在生成圖片中的內容。
單次最多生成的圖片數量。實際數量由模型推論結果決定,可能少於設定值;例如設為 5 時,模型可能依內容只生成 3 張。
Idle
The rate is $0.017 per image.

Wan 2.6 Text to Image 簡介

Wan AI 的 Wan 2.6 Text to Image 能以每張 $0.015 的價格,將提示詞轉化為可直接投入製作的圖片。你可以上傳參考圖,精準控制畫面風格、主體一致性與品牌特徵,減少素材搜尋、複雜遮罩與手動修圖,讓視覺創作更一致、更有效率。此模型適合行銷負責人、創意總監與電商品牌團隊。在 RunComfy 中,Wan 2.6 Text to Image 既可直接透過瀏覽器使用,也能串接 HTTP API,無需自行部署或擴充模型。
適合情境:高轉換廣告素材 | 商品主視覺 | 分鏡關鍵畫面

模型概述#


  • 提供者: Alibaba Cloud
  • 任務: text-to-image
  • 支援的圖片尺寸: 1024×1024、800×1200、1200×800、960×1280、1280×960、720×1280、1280×720、1344×576 px
  • 概述: Wan 2.6 Text to Image 可依自然語言提示生成高品質圖片,並能透過可選的參考圖控制畫面風格、主體一致性或編輯方向。模型著重準確理解提示詞、呈現真實質感,並維持穩定構圖。

核心能力#


參考圖驅動的主體與風格控制#

  • 參考圖提供視覺依據,提示詞則負責描述目標畫面與具體調整。
  • 有助於在多次生成中維持角色特徵與品牌元素的一致性。

高保真、準確遵循提示詞#

  • 可理解英文或中文輸入的主體、風格、光線、氛圍與構圖要求。
  • 能生成結構合理、紋理自然的畫面,適用於電商、行銷與編輯配圖。

文字與圖片結合的創作流程#

  • 將文字說明與參考圖結合,用於生成變化版本或進行針對性調整。
  • 可透過負向提示詞排除不需要的物件、顏色或瑕疵。

輸入參數#


提示詞#

參數類型預設值/限制說明
promptstring少於 2000 個字元描述目標圖片的主體、風格、光線、氛圍與構圖。
negative_promptstring最多 500 個字元指定需要避開的元素或畫面特徵。

參考圖#

參數類型預設值/限制說明
image_urlimage_uri可選;JPEG/JPG/不含 Alpha 色版的 PNG/BMP/WEBP;單邊 384~5000 px;最大 10 MB用於控制風格、主體一致性或編輯方向的參考圖。

輸出與重現#

參數類型預設值/限制說明
image_sizestring預設:1024*1024 (1:1);共 8 種固定尺寸可選 10241024 (1:1)、8001200 (2:3)、1200800 (3:2)、9601280 (3:4)、1280960 (4:3)、7201280 (9:16)、1280720 (16:9) 或 1344576 (21:9)。
max_imagesinteger預設:1;範圍:1~5設定單次生成數量上限;模型實際回傳的圖片可能少於此數值。
seedinteger預設:0;範圍:0~2147483647固定隨機種子有助於重現結果。

與其他模型的比較#


  • 對比 Flux 2: Wan 2.6 Text to Image 將文字生成與參考圖控制整合在同一流程中,更適合需要維持主體一致性並持續調整畫面的情境。Flux 2 Dev 目前可在 RunComfy 免費使用。
  • 對比 Z-Image-Turbo: Wan 2.6 Text to Image 更重視複雜提示詞下的參考圖還原度與合理構圖,而非一味追求最快生成速度。
  • 對比 Nano Banana Pro: Wan 2.6 Text to Image 兼顧參考圖控制與穩定編輯,適合需要統一視覺識別的系列創作。
  • 建議情境: 對風格、主體一致性與穩定修改流程要求較高的品牌視覺、廣告素材與電商圖片。

API 串接#


開發者可透過標準 HTTP 請求串接 RunComfy API,呼叫 Wan 2.6 Text to Image。提交提示詞、可選參考圖與輸出尺寸,即可在創意流程或 CI/CD 管線中自動生成圖片。


說明:Wan 2.6 Text to Image API 端點


官方資源與授權#


  • Alibaba Cloud: Wan 2.6 系列
  • Alibaba Cloud Model Studio: 模型列表
  • Wan: 官方網站
  • 授權: 此模型為透過 Alibaba Cloud Model Studio 託管的專有模型。商業使用須遵守 Alibaba Cloud 的條款;依部署方式與所在地區,可能需要另行簽署協議。免費方案不包含商業授權。

相關能力#


如需生成動態畫面與敘事內容,請使用 Wan 2.6 Text to Video:https://www.runcomfy.com/models/wan-ai/wan-2-6/text-to-video


如需讓現有圖片動起來,請使用 Wan 2.6 Image to Video:https://www.runcomfy.com/models/wan-ai/wan-2-6/image-to-video


相關模型

ovis-image

依文字生成圖片,可設定負面提示詞、6 種長寬比與取樣參數。

wan-2-2/text-to-image

使用 Wan 2.2 Plus 依提示詞生成圖像,並設定尺寸、隨機種子與提示詞擴充。

flux-2/flash/text-to-image

透過精細控制和可重現設定,快速產生準確的設計視覺。

z-image/turbo/inpainting

透過遮罩精準局部重繪,完成照片精修、物件修改與場景修復。

z-image/turbo/text-to-image

依提示詞生成 1–4 張圖片,並可選擇長寬比、推論步數、隨機種子與檔案格式。

flux-1-kontext/max/edit

使用 FLUX Kontext Max 依提示詞編輯圖像,並設定隨機種子與 9 種長寬比之一。

常見問題

Wan 2.6 Text to Image 主要能做什麼?

Wan 2.6 Text to Image 可根據文字提示生成高品質靜態圖片,也能使用可選的參考圖進一步控制畫面風格、主體一致性或具體修改方向。模型著重準確遵循提示詞、呈現真實紋理,並維持穩定構圖。

Wan 2.6 Text to Image 與 Flux 2 或 Nano Banana Pro 有什麼不同?

Wan 2.6 Text to Image 將文字生成圖片與可選的參考圖控制整合在同一流程中。相較於不使用參考圖的單次生成,它更適合重視視覺識別、品牌元素和定向修改的創作任務。

Wan 2.6 Text to Image 支援哪些解析度與長寬比?

可選尺寸為 1024×1024(1:1)、800×1200(2:3)、1200×800(3:2)、960×1280(3:4)、1280×960(4:3)、720×1280(9:16)、1280×720(16:9)和 1344×576(21:9)。目前介面不支援其他尺寸或自訂寬高。

使用 Wan 2.6 Text to Image 時有哪些輸入限制?

提示詞須少於 2000 個字元,負向提示詞最多 500 個字元。可選的參考圖須為 JPEG、JPG、PNG(不含 Alpha 色版)、BMP 或 WEBP 格式;單邊需介於 384~5000 像素,檔案上限為 10 MB。

如何從 RunComfy 線上測試切換到正式環境 API?

在 RunComfy 模型介面完成測試後,可使用 API 金鑰呼叫 Wan 2.6 Text to Image API 端點,透過 HTTP 提交提示詞、可選參考圖與輸出尺寸。目前頁面標示的價格為每張 $0.015;呼叫前請確認帳戶內有可用點數。

Wan 2.6 Text to Image 如何維持視覺主體的一致性?

可選的參考圖用來提供主體特徵與風格依據,提示詞則負責描述目標場景。持續使用同一張參考圖並維持指令清楚,有助於提高一致性,但無法保證每次生成都完全相同。

Wan 2.6 Text to Image 能生成音訊或影片嗎?

不能。此模型只生成靜態圖片。如需影片,請使用 Wan 2.6 Text to Video 或 Wan 2.6 Image to Video;音訊同步與對嘴同步不屬於此文字生成圖片端點的功能。

Wan 2.6 Text to Image 的生成結果可以商用嗎?

此模型依 Alibaba Cloud Model Studio 的相關條款提供。是否可商用取決於這些條款、所在地區與具體合約;模型頁面註明免費方案不包含商業授權。正式發布前請務必查看最新授權條款。

Wan 2.6 Text to Image 可以一次生成多張一致的圖片嗎?

max_images 可將生成數量上限設為 1~5 張,但模型實際回傳的圖片可能更少。使用 0~2147483647 範圍內的固定 seed 有助於重現結果,但不保證整組圖片在像素層級完全一致。

Wan 2.6 Text to Image 適合行動裝置與社群媒體尺寸嗎?

適合。直式內容可選擇 720×1280(9:16)、800×1200(2:3)或 960×1280(3:4);方形與橫式素材還可選擇 1:1、4:3、3:2、16:9 或 21:9。

關注我們
  • 領英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 電子郵件
  • 系統狀態
  • 附屬
視頻模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
影像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服務條款
  • 隱私政策
  • Cookie 政策
RunComfy
版權 2026 RunComfy. 保留所有權利。

RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。

Wan 2.6 Text to Image 生成範例