基於 LoRA 的圖片編輯模型,可在維持結構和主體一致性的同時精準修改創意素材。


Gemini 3 Pro Text-to-Image 會根據必填的文字提示詞產生 1–4 張圖片。
| 參數 | 類型 | 預設值/範圍 | 說明 |
|---|---|---|---|
| prompt | string | 必填;已預填範例 | 描述要產生圖片的文字提示詞。 |
| num_images | integer | 1–4;預設:1 | 要產生的圖片數量。 |
| aspect_ratio | string | 預設:16:9 | 可選 21:9、16:9、3:2、4:3、5:4、1:1、4:5、3:4、2:3 或 9:16。 |
| resolution | string | 1K、2K 或 4K;預設:1K | 產生圖片的解析度。 |
| output_format | string | jpeg、png 或 webp;預設:png | 產生圖片的檔案格式。 |
| sync_mode | boolean | 預設:false | 設為 true 時,以 data URI 傳回媒體,且不在請求記錄中儲存輸出資料。 |
prompt 中描述主體、構圖、光線、視覺風格以及需要準確呈現的文字。num_images 設為 1–4。aspect_ratio 之一。resolution 設為 1K、2K 或 4K。output_format 中選擇 jpeg、png 或 webp。sync_mode 保持為 false。基於 LoRA 的圖片編輯模型,可在維持結構和主體一致性的同時精準修改創意素材。
根據最多三張來源圖片進行圖片編輯,並可調整引導強度、推理步數、輸出數量、提示詞擴充、尺寸、隨機種子和格式。
使用 Ideogram 3 依提示詞重混圖像,並設定圖像權重、長寬比等選項。
使用 FLUX Kontext Max 依提示詞編輯圖像,並設定隨機種子與 9 種長寬比之一。
根據必填提示詞編輯或融合 1–10 張必填 JPEG 或 PNG 圖片。可選擇 `1K`、`2K`、`4K` 或八種固定解析度。
依提示詞生成 1–4 張圖片,並可選擇長寬比、推論步數、隨機種子與檔案格式。
它會根據必填文字欄位 prompt 產生圖片。
num_images 接受 1–4 的整數,預設值為 1。
可選 21:9、16:9、3:2、4:3、5:4、1:1、4:5、3:4、2:3 或 9:16,預設值為 16:9。
resolution 支援 1K、2K 和 4K,預設值為 1K。
output_format 支援 jpeg、png 和 webp,預設值為 png。
sync_mode 為 true 時,媒體以 data URI 傳回,且輸出資料不會出現在請求記錄中。預設值為 false。
描述主體、構圖、光線、視覺風格以及需要準確出現在畫面中的文字。
先選擇符合目標寬幅、橫向、方形、豎向構圖的 aspect_ratio,再設定所需的 resolution。
確認已填寫 prompt,num_images 為 1–4,aspect_ratio 屬於 10 個可選值之一,resolution 為 1K、2K 或 4K,並且 output_format 為 jpeg、png 或 webp。
RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。









