對一張必填輸入圖片進行放大,並可調整推理步數、LoRA 作用強度、種子和輸出格式。
Nano Banana 2(Gemini 3.1 Flash Image)是 Google DeepMind 的 Flash 級別圖像生成模型,專為高速視覺創作而設計,具備精確的指令追隨、出色的排版渲染和現實世界知識整合。
Nano Banana 2 文字轉圖像將單個文字提示詞轉化為 1 張圖像,支援透過種子控制進行可重現生成,以及 0.5K 到 4K 的靈活解析度層級。針對快速迭代、可預測的構圖和可用於生產的輸出進行了最佳化。
輸出格式:png、jpeg 或 webp。輸出:靜態圖像(批次大小:1)。
以下控制項可用於 Nano Banana 2 文字轉圖像。
| 參數 | 必填 | 類型 | 預設值 | 範圍 / 選項 | 說明 |
|---|---|---|---|---|---|
| prompt* | 是 (*) | string (str) | A cinematic close-up portrait... | — | 描述被寫體、場景、光照、風格和構圖的文字提示詞。 |
| aspect_ratio | 否 | string | auto | auto, 21:9, 16:9, 3:2, 4:3, 5:4, 1:1, 4:5, 3:4, 2:3, 9:16 | 構圖。"auto" 保持自然構圖。 |
| resolution | 否 | string | 1K | 0.5K, 1K, 2K, 4K | 目標解析度。越高細節越豐富。 |
創意階段用低解析度×多種子嘗試,構圖確定後再提升解析度。
1) 編寫結構化提示詞:被寫體 → 動作 → 環境 → 風格 → 相機/光照。
2) 根據最終交付物設定 aspect_ratio(或保持 "auto")。
3) 根據草稿 vs. 正式生產選擇解析度。
4) 需要可重現結果時固定種子。
5) 生成 1 張圖像,檢查構圖、光照和排版。
6) 透過調整小變數(姿勢、顏色、氛圍)迭代,而非重寫整個提示詞。
對一張必填輸入圖片進行放大,並可調整推理步數、LoRA 作用強度、種子和輸出格式。
WAN 2.7 Pro 文字生成圖片模型,操作方式與標準版相同,支援中英文提示詞,每次最多生成 5 張適合印刷與大型版面的高精細靜態圖片。
根據必填文字指令編輯一張必填圖片,並可設定提示詞擴寫、兩種輸出解析度、種子和輸出格式。
FLUX 3 Image 是一款支援參考圖引導和清晰文字生成的多模態圖像模型
由參考圖片引導的圖片編輯,支援版面控制、圖層分離和多語言文字
根據文字生成圖片,提供 6 個精確尺寸預設,並可設定推理步數、引導強度、隨機種子以及 JPEG、PNG 或 WebP 輸出。
Nano Banana 2 文字轉圖像專為快速迭代和穩定的提示詞追隨而設計,非常適合快速概念探索、行銷創意草稿、縮圖以及批次生成多種變體。
Nano Banana 2 文字轉圖像支援常見的寬高比,包括 21:9、16:9、3:2、4:3、5:4、1:1、4:5、3:4、2:3 和 9:16。請選擇與目標版面(橫幅、方形貼文、限時動態等)相符的比例。
Nano Banana 2 文字轉圖像支援每次請求生成 1-4 張圖像。如需更多變化,可保留相同提示詞,使用不同的種子或稍作修改後重新生成。
啟用後,enhance_prompt 會嘗試擴展或優化你的提示詞,以提高描述力和連貫性。如果你更偏好精確控制,請將其關閉,自己明確指定被寫體、風格、光照和構圖等約束。
Nano Banana 2 文字轉圖像可以輸出 jpeg、png 或 webp 格式的圖像。png 適合清晰的圖形和文字,jpeg 適合較小的檔案,webp 則在品質和大小之間提供了良好的平衡。
RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。









