根據 800 個字元以內的必填指令編輯 1–3 張必填來源圖片。可請求 1–6 張結果,新增 500 個字元以內的負面提示詞,並設定 0–2147483647 的隨機種子。
prompt 與 image_urls 為必填。image_urls 可填入 1–10 個圖片 URL。image_size 提供 auto、square_hd、square、portrait_4_3、portrait_16_9、landscape_4_3 與 landscape_16_9,預設為 auto。enable_prompt_expansion 預設為 true。seed 是整數,預設值為 0。output_format 支援 jpeg 與 png,預設為 jpeg。guidance_scale 範圍為 1.5–10,預設值為 3.5。num_inference_steps 範圍為 2–50,預設值為 28。提供服務可存取的圖片 URL,並明確說明要修改什麼、希望保留什麼。選擇 auto 時由模型決定尺寸,也可從 6 個固定值中選擇。若提示詞擴充加入不需要的細節,可比較開啟與關閉後的結果。使用同一種子測試引導強度或步數,並檢查每張輸出是否出現意外變化。
若要在沒有原始圖片的情況下生成,請使用 Flux 2 Flex Text-to-Image。
根據 800 個字元以內的必填指令編輯 1–3 張必填來源圖片。可請求 1–6 張結果,新增 500 個字元以內的負面提示詞,並設定 0–2147483647 的隨機種子。
根據文字生成圖片,提供 6 個精確尺寸預設,並可設定推理步數、引導強度、隨機種子以及 JPEG、PNG 或 WebP 輸出。
WAN 2.7 文字轉圖像:精準理解提示詞,提供多種尺寸預設,每次最多生成 5 張圖像
結合原圖、提示詞和最多 3 個 LoRA 完成圖片轉換,推理步數可設為 1–8。
Flux 2 Turbo Edit 可依照明確的文字指令編輯最多 4 張參考圖,並精確控制尺寸和輸出格式。
Qwen Image 3.0:詳細的文字到圖像,排版清晰
它會依文字提示詞編輯一張或多張原始圖片。
prompt 與 image_urls 都是必填項目。
image_urls 至少要有 1 個 URL,最多可有 10 個。
可選 auto、square_hd、square、portrait_4_3、portrait_16_9、landscape_4_3 與 landscape_16_9,預設為 auto。
設為 enable_prompt_expansion: true 時,模型會擴充提示詞。預設值為 true。
支援 jpeg 與 png,預設為 jpeg。
guidance_scale 範圍為 1.5–10,num_inference_steps 範圍為 2–50,預設值分別為 3.5 與 28。
seed 是整數,預設值為 0。
寫清楚需要修改的物件、目標變化與希望保留的部分,並在生成後檢查結果。
RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。