FLUX 3 Image 是一款支援參考圖引導和清晰文字生成的多模態圖像模型
Vidu Q2 Text to Image 根據文字指令產生靜態圖片。提示詞用於描述主體、場景、構圖、光線與風格;本頁面另外提供長寬比、輸出解析度和隨機種子控制。
這個端點只支援文生圖,schema 中沒有參考圖、反向提示詞、影片或音訊輸入。
| 參數 | 類型 | 預設值/範圍 | 說明 |
|---|---|---|---|
| prompt | string | 必填; 最多 1500 個字元 | 描述要產生的圖片。 |
| aspect_ratio | string | 選填; 預設: 16:9; 可選值: 16:9, 9:16, 1:1 | 輸出圖片的長寬比。 |
| resolution | string | 選填; 預設: 1080p; 可選值: 1080p, 2k, 4k | 請求的輸出解析度。 |
| seed | integer | 選填; 預設: 0 | 用於改變或對比產生結果的隨機種子。 |
aspect_ratio:橫向版式用 16:9,豎向版式用 9:16,方形素材用 1:1。resolution 只能使用 1080p、2k 或 4k。主體與動作,環境,構圖或鏡頭角度,光線,材質,配色,視覺風格
例如:啞光鈷藍色無線耳機置於白色亞克力檯面,居中產品攝影,柔和頂光,清晰陰影,剋制的編輯風格。
在適合的情況下,可先用預設 1080p 設定迭代提示詞;如果最終候選需要更高解析度,再請求 2k 或 4k。提示詞不超過 1500 個字元,並且只使用文件中列出的列舉值。
可在 RunComfy 介面中試用 Vidu Q2 Text to Image 模型。商用前,請查看目前的模型供應商與 RunComfy 條款,並確認你對提示詞和產生結果擁有必要權利。
FLUX 3 Image 是一款支援參考圖引導和清晰文字生成的多模態圖像模型
使用 Wan 2.2 Plus 依提示詞生成圖像,並設定尺寸、隨機種子與提示詞擴充。
依文字生成圖片,並以個別權重組合最多 3 個 LoRA。
根據文字指令編輯或轉換 1–10 張參考圖片,並精確設定尺寸、背景、品質、輸入保真度與輸出格式。
4 步亞秒級文字到圖像,具有即時準確的視覺效果
根據提示詞為一張必填的來源圖片重新布光或進行編輯,並可設定六種輸出尺寸、推理步數、引導強度、1–4 張結果圖、隨機種子以及 JPEG/PNG 輸出。
它根據文字提示詞產生靜態圖片。這個頁面還可以設定 aspect_ratio、resolution 和 seed。長寬比可選 16:9、9:16 或 1:1,解析度可選 1080p、2k 或 4k。
在條件允許時使用相同的提示詞、長寬比、解析度和隨機種子,再比較提示詞遵循度、構圖、細節與一致性。本頁面沒有提供 Vidu Q2 相對 Vidu Q1 的經過驗證的速度或品質基準,因此應使用自己的內容測試,而不是預設它在所有場景下都更好。
本頁面沒有承諾無限免費產生或固定期限的促銷額度。積分、價格與資格可能變化,規劃使用前請以 RunComfy 帳號中顯示的最新資訊為準。
它適合需要用提示詞產生靜態圖片的創作者、設計師、行銷人員和製作團隊,可用於概念圖、故事板、行銷草稿、產品視覺和版式探索。請根據最終用途選擇長寬比與解析度。
resolution 可選 1080p、2k 或 4k,預設 1080p;aspect_ratio 可選 16:9、9:16 或 1:1,預設 16:9。API 請求中必須使用這些正確值。
不可以。本頁面的 schema 沒有圖片輸入,只接受 prompt、aspect_ratio、resolution 和 seed。如需用一張或多張現有圖片引導結果,請使用單獨的 Vidu Q2 Reference to Image 模型。
你可以透過 RunComfy 的瀏覽器介面使用這個模型。頁面記錄的欄位也是接入對應服務時需要驗證的值;可用性與帳號限制請以目前產品介面顯示的資訊為準。
提示詞的說明上限為 1500 個字元;長寬比和解析度只能使用列出的列舉值;seed 必須是整數。這個端點沒有參考圖、反向提示詞、影片或音訊欄位。
本頁面不保證固定渲染時間。完成速度可能受請求解析度、模型供應商負載與帳號條件影響。如果延遲很重要,請在自己的工作流中分別測試有代表性的 1080p、2k 和 4k 請求。
RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。





