logo
RunComfy
  • ComfyUI
  • 訓練器新
  • 模型
  • API
  • 定價
discord logo
模型
探索
所有模型
資源庫
生成記錄
模型 API
API 文檔
API 金鑰
帳戶
使用情況

GPT Image 1.5:多參考圖編輯 | RunComfy

openai/gpt-image-1-5/image-to-image

根據文字指令編輯或組合 1–10 張參考圖片,並設定尺寸、背景、品質、保真度和輸出格式。

Image 1
用於生成或編輯的參考圖片 URL,需提供 1–10 張。
生成圖片的輸出尺寸。
生成圖片的背景類型。
生成圖片的品質等級。
對第一張輸入圖片內容的保留強度。
生成圖片的輸出格式。
Idle
The rate is $0.009 per image for low quality, $0.034 per image for medium quality, and $0.133 per image for high quality.

GPT Image 1.5 圖片編輯簡介

GPT Image 1.5 會依照文字編輯指令處理一張或多張參考圖片。RunComfy 頁面接收 1–10 個圖片 URL,並提供輸出尺寸、背景、品質、輸入保真度和檔案格式設定。它適合定向修改、視覺合成、產品變體或風格調整;正式使用前,請檢查重要人物特徵、文字與版面細節。相同參數也能透過 HTTP API 呼叫。
適用情境:產品圖修改 | 多參考圖合成 | 行銷與設計變體

X 平台上的 GPT Image 1.5 Image to Image

模型概覽#


  • 提供者: OpenAI
  • 任務: 圖片轉圖片編輯
  • 參考圖片: 1–10 張
  • 輸出尺寸: auto、1024x1024、1536x1024、1024x1536
  • 簡介: GPT Image 1.5 會依照自然語言指令編輯或組合上傳的參考圖片。頁面設定可控制第一張輸入圖的保留強度,以及輸出尺寸、背景模式、品質和檔案格式。

輸入參數#


參數類型預設值/範圍說明
promptstring必填描述生成或編輯需求的指令。
image_urlsarray (image_uris)1–10; 必填來源圖片或參考圖片的 URL。
image_sizestringauto, 1024x1024, 1536x1024, 1024x1536; 預設 auto輸出尺寸;auto 由端點選擇。
backgroundstringauto, transparent, opaque; 預設 auto結果的背景處理方式。
qualitystringlow, medium, high; 預設 high目前端點提供的品質等級。
input_fidelitystringlow, high; 預設 high對第一張輸入圖片內容的保留強度。
output_formatstringjpeg, png, webp; 預設 png回傳圖片的檔案格式。

使用建議#


  • 將最重要的來源圖片放在第一位,因為 input_fidelity 是針對第一張輸入圖定義。
  • 明確寫出需要修改的內容,以及必須保持不變的內容。
  • 只加入任務真正需要的參考圖;圖片更多不代表效果一定更好。
  • 需要較強的人物特徵或版面保留時使用 high input_fidelity;可接受較自由的重新詮釋時再測試 low。
  • 複雜編輯後,請檢查臉部、手部、標誌、小字、反射與物件邊緣。

API 整合#


RunComfy API 接收與模型頁面一致的欄位:prompt、image_urls、image_size、background、quality、input_fidelity 和 output_format。


注意:GPT Image 1.5 API 端點


官方資源與條款#


  • OpenAI 資源: https://openai.com/blog/chatgpt-images-gpt-image-1-5
  • 圖片文件: https://platform.openai.com/docs/guides/images/image-generation
  • 條款: 商業部署前,請查閱最新 OpenAI 與 RunComfy 條款,包括輸入資料和輸出使用要求。

相關模型#


  • 如需在沒有參考圖的情況下生成圖片,請使用 GPT Image 1.5 Text To Image。
  • 來源頁面另有提及:Flux 2。

相關模型

q2/reference-to-image

根據提示詞和最多 7 張參考圖產生圖片,並可選擇長寬比、1080p 至 4k 解析度和隨機種子。

wan-2-5/text-to-image

根據 2000 字元以內的必填提示詞生成圖片。可填寫選填負面提示詞,並從 13 種輸出尺寸中選擇。

longcat-image/text-to-image

根據文字生成圖片,提供 6 個精確尺寸預設,並可設定推理步數、引導強度、隨機種子以及 JPEG、PNG 或 WebP 輸出。

flux-1-1-pro/ultra/text-to-image

使用 FLUX1.1 Pro Ultra 生成最高 2K 的寫實圖片。

seedream-5.0-pro/image-to-image

由參考圖片引導的圖片編輯,支援版面控制、圖層分離和多語言文字

qwen-image/qwen-image-edit-2511/lora

基於 LoRA 的圖片編輯模型,可在維持結構和主體一致性的同時精準修改創意素材。

常見問題

GPT Image 1.5 圖片編輯有哪些主要功能?

它會依照文字指令編輯或組合 1–10 張參考圖片。頁面可設定輸出尺寸、背景、品質、輸入保真度,以及 JPEG、PNG 或 WEBP 輸出。

GPT Image 1.5 與較早的圖片編輯模型有何不同?

此工作流程把自然語言編輯、最多 10 張參考圖和明確的 input_fidelity 設定結合在一起。頁面 schema 沒有公布速度或品質比較資料,因此建議用具代表性的編輯任務與其他模型直接測試。

開發者需要了解哪些技術限制?

每次請求必須提供 prompt 和 1–10 個 image_urls。輸出尺寸可選 auto、1024x1024、1536x1024 或 1024x1536。頁面 schema 沒有公布提示詞 token 上限,也不接受超過 10 張參考圖片。

有哪些尺寸、背景和輸出格式選項?

image_size 支援 auto、1024x1024、1536x1024 和 1024x1536;background 支援 auto、transparent 和 opaque;output_format 支援 jpeg、png 和 webp。

如何從 RunComfy 測試轉移到 API 正式環境?

先在 RunComfy 模型頁面驗證具代表性的編輯,再向 API 傳入相同的 prompt、image_urls、image_size、background、quality、input_fidelity 和 output_format 欄位,並加入驗證、輪詢、重試與輸出檢查。

GPT Image 1.5 相較其他圖片編輯器有什麼優勢?

沒有任何模型適合所有編輯情境,本頁 schema 也沒有建立競品排名。如果你需要提示詞編輯、最多 10 張參考圖,以及保留強度、尺寸、背景、品質和格式設定,GPT Image 1.5 是一個直接的選擇。

GPT Image 1.5 能否在編輯時保留或生成文字?

可以用指令要求保留或生成文字,但重要的拼字、排版、標誌和小標籤都應仔細檢查。如果第一張參考圖的內容保留很重要,請使用清楚提示詞和 high input_fidelity。

GPT Image 1.5 能否用於商業圖片編輯專案?

商用取決於最新 OpenAI 與 RunComfy 條款,也取決於你是否擁有輸入圖片的相應權利。投入正式製作前,請確認這些條款以及隱私和品牌要求。

如何在多次編輯中保持視覺特徵一致?

把主要參考圖放在第一位,需要更強保留時將 input_fidelity 設為 high,並在提示詞中說明哪些特徵必須不變。即使如此,每次結果仍需檢查人物特徵、版面、光線和細節。

如何控制生成成本?

目前價格沒有寫入本頁內容 schema。請查看 RunComfy 顯示的費用,選擇適合任務的 quality 等級,用明確提示詞和必要數量的參考圖進行測試,並把較高品質的生成留給篩選後的方案。

關注我們
  • 領英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 電子郵件
  • 系統狀態
  • 附屬
視頻模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
影像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服務條款
  • 隱私政策
  • Cookie 政策
RunComfy
版權 2026 RunComfy. 保留所有權利。

RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。

GPT Image 1.5 圖片編輯範例

Hyper-realistic winter portrait of a woman in a snow-covered fur-lined hood.
Silhouetted fisherman on a bridge at sunset near a mosque skyline, reflecting soft golden tones, inspired by GPT Image 1.5.
Overhead view of a vintage typewriter, journal, pencil, and coffee cup floating on fabric in a pool, crafted using GPT Image 1.5.
Two men wearing Santa hats sharing Coca-Cola in a festive setting, created using GPT Image 1.5.
Golden retriever, tabby cat, and pet rat snuggled on a couch watching TV, depicted using GPT Image 1.5 Image model.
Man reading a newspaper featuring a comparison between a humanoid robot and a banana with a computer chip, highlighting GPT Image 1.5 model.