logo
RunComfy
  • ComfyUI
  • 训练器新
  • 模型
  • API
  • 定价
discord logo
模型
探索
所有模型
资源库
生成记录
模型 API
API 文档
API 密钥
账户
使用情况

GPT Image 1.5:多参考图编辑 | RunComfy

openai/gpt-image-1-5/image-to-image

根据文字指令编辑或组合 1–10 张参考图片,并设置尺寸、背景、质量、保真度和输出格式。

Image 1
用于生成或编辑的参考图片 URL,需提供 1–10 张。
生成图像的输出尺寸。
生成图像的背景类型。
生成图像的质量等级。
对第一张输入图片内容的保留强度。
生成图像的输出格式。
Idle
The rate is $0.009 per image for low quality, $0.034 per image for medium quality, and $0.133 per image for high quality.

GPT Image 1.5 图片编辑简介

GPT Image 1.5 根据文字编辑指令处理一张或多张参考图片。RunComfy 页面接收 1–10 个图片 URL,并提供输出尺寸、背景、质量、输入保真度和文件格式设置。它适合定向修改、视觉合成、产品变体或风格调整;正式使用前,请检查关键人物特征、文字与版式细节。相同参数也可通过 HTTP API 调用。
适用场景:产品图修改 | 多参考图合成 | 营销与设计变体

X 平台上的 GPT Image 1.5 Image to Image

模型概览#


  • 提供方: OpenAI
  • 任务: 图片到图片编辑
  • 参考图片: 1–10 张
  • 输出尺寸: auto、1024x1024、1536x1024、1024x1536
  • 简介: GPT Image 1.5 根据自然语言指令编辑或组合上传的参考图片。页面设置可控制第一张输入图的保留强度,以及输出尺寸、背景模式、质量和文件格式。

输入参数#


参数类型默认值/范围说明
promptstring必填描述生成或编辑需求的指令。
image_urlsarray (image_uris)1–10; 必填源图片或参考图片的 URL。
image_sizestringauto, 1024x1024, 1536x1024, 1024x1536; 默认 auto输出尺寸;auto 由端点选择。
backgroundstringauto, transparent, opaque; 默认 auto结果的背景处理方式。
qualitystringlow, medium, high; 默认 high当前端点提供的质量等级。
input_fidelitystringlow, high; 默认 high对第一张输入图片内容的保留强度。
output_formatstringjpeg, png, webp; 默认 png返回图片的文件格式。

使用建议#


  • 将最重要的源图片放在第一位,因为 input_fidelity 针对第一张输入图定义。
  • 明确写出需要修改的内容,以及必须保持不变的内容。
  • 只加入任务真正需要的参考图;图片更多不代表效果一定更好。
  • 需要较强的人物特征或版式保留时使用 high input_fidelity;可接受更自由的重新诠释时再测试 low。
  • 复杂编辑后,请检查人脸、手部、标志、小字、反射与物体边缘。

API 集成#


RunComfy API 接收与模型页面一致的字段:prompt、image_urls、image_size、background、quality、input_fidelity 和 output_format。


注意:GPT Image 1.5 API 端点


官方资源与条款#


  • OpenAI 资源: https://openai.com/blog/chatgpt-images-gpt-image-1-5
  • 图片文档: https://platform.openai.com/docs/guides/images/image-generation
  • 条款: 商用部署前,请查阅最新 OpenAI 与 RunComfy 条款,包括输入数据和输出使用要求。

相关模型#


  • 如需在没有参考图的情况下生成图片,请使用 GPT Image 1.5 Text To Image。
  • 源页面还提及:Flux 2。

相关模型

ideogram-v3/reframe

使用 Ideogram 3 Reframe 更改图像的宽高比和分辨率。

qwen-edit-2509/lora/multiple-angles

根据必填提示词调整一张源图的镜头角度或进行其他编辑,并可设置六种输出尺寸、推理步数、引导强度、1–4 张结果图以及 JPEG/PNG 输出。

flux-2/flash/edit

Flux 2 Flash Edit 可根据明确的文字指令编辑最多 4 张参考图,并精确控制尺寸和输出格式。

ideogram-v3/edit

使用 Ideogram 3 根据提示词编辑图像中的遮罩区域。

gemini-3-pro-image-preview/edit

根据提示词编辑或转换最多 20 张参考图片,并设置生成数量、格式、宽高比和分辨率。

longcat-image/edit

根据文字提示词编辑 1 张源图片,并可设置推理步数、引导强度、随机种子以及 JPEG、PNG 或 WebP 输出。

常见问题

GPT Image 1.5 图片编辑有哪些主要能力?

它根据文字指令编辑或组合 1–10 张参考图片。页面可设置输出尺寸、背景、质量、输入保真度,以及 JPEG、PNG 或 WEBP 输出。

GPT Image 1.5 与较早的图片编辑模型有何不同?

此工作流把自然语言编辑、最多 10 张参考图和明确的 input_fidelity 设置结合在一起。页面 schema 没有公布速度或质量对比数据,因此建议用有代表性的编辑任务与备选模型直接测试。

开发者需要了解哪些技术限制?

每次请求必须提供 prompt 和 1–10 个 image_urls。输出尺寸可选 auto、1024x1024、1536x1024 或 1024x1536。页面 schema 没有公布提示词 token 上限,也不接受超过 10 张参考图片。

有哪些尺寸、背景和输出格式选项?

image_size 支持 auto、1024x1024、1536x1024 和 1024x1536;background 支持 auto、transparent 和 opaque;output_format 支持 jpeg、png 和 webp。

如何从 RunComfy 测试过渡到 API 生产环境?

先在 RunComfy 模型页面验证有代表性的编辑,再向 API 传入相同的 prompt、image_urls、image_size、background、quality、input_fidelity 和 output_format 字段,并加入鉴权、轮询、重试与输出验证。

GPT Image 1.5 相比其他图片编辑器有什么优势?

没有任何模型适合所有编辑场景,本页 schema 也没有建立竞品排名。如果你需要提示词编辑、最多 10 张参考图,以及保留强度、尺寸、背景、质量和格式设置,GPT Image 1.5 是一个直接的选择。

GPT Image 1.5 能否在编辑时保留或生成文字?

可以用指令要求保留或生成文字,但重要的拼写、排版、标志和小标签都应仔细检查。如果第一张参考图的内容保留很重要,请使用清晰提示词和 high input_fidelity。

GPT Image 1.5 能否用于商业图片编辑项目?

商用取决于最新 OpenAI 与 RunComfy 条款,也取决于你是否拥有输入图片的相应权利。投入生产前,请核对这些条款以及隐私和品牌要求。

如何在多次编辑中保持视觉特征一致?

把主要参考图放在第一位,需要更强保留时将 input_fidelity 设为 high,并在提示词中说明哪些特征必须不变。即便如此,每次结果仍需检查人物特征、版式、光线和细节。

如何控制生成成本?

当前价格没有写入本页内容 schema。请查看 RunComfy 显示的费用,选择适合任务的 quality 等级,用明确提示词和必要数量的参考图进行测试,并把更高质量的生成留给筛选后的方案。

关注我们
  • 领英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 电子邮件
  • 系统状态
  • 附属
视频模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
图像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服务条款
  • 隐私政策
  • Cookie 政策
RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。

GPT Image 1.5 图片编辑示例

Hyper-realistic winter portrait of a woman in a snow-covered fur-lined hood.
Silhouetted fisherman on a bridge at sunset near a mosque skyline, reflecting soft golden tones, inspired by GPT Image 1.5.
Overhead view of a vintage typewriter, journal, pencil, and coffee cup floating on fabric in a pool, crafted using GPT Image 1.5.
Two men wearing Santa hats sharing Coca-Cola in a festive setting, created using GPT Image 1.5.
Golden retriever, tabby cat, and pet rat snuggled on a couch watching TV, depicted using GPT Image 1.5 Image model.
Man reading a newspaper featuring a comparison between a humanoid robot and a banana with a computer chip, highlighting GPT Image 1.5 model.