logo
RunComfy
  • ComfyUI
  • 训练器新
  • 模型
  • API
  • 定价
discord logo
模型
探索
所有模型
资源库
生成记录
模型 API
API 文档
API 密钥
账户
使用情况

GPT-4o 图片生成 | 文本转图片

openai/gpt-4o-image/text-to-image

生成细节丰富、符合提示词的图片,并精确控制文字呈现、版面布局和视觉风格。

尽量具体地描述希望生成的图片。
选择 `transparent` 或 `opaque`,默认值为 `opaque`。
选择输出宽高比。
Idle
The rate is $0.11 per image.

GPT-4o 图片生成简介

GPT-4o 图片生成功能由 OpenAI 开发,于 2025 年 4 月发布,是内置于 GPT-4o 的原生多模态图片生成器。该功能旨在生成准确、写实且实用的视觉内容,尤其擅长准确呈现文字、遵循提示词和控制风格。

GPT-4o 图片生成的主要功能

准确呈现文字与符号

GPT-4o Image 能在路牌、菜单、图表和信息图中清晰呈现拼写正确的文字与精确符号。它不仅适合艺术创作,也适合需要准确传达信息的视觉内容。

精准遵循提示词,画面更可控

即使提示词包含 10–20 个对象和复杂要求,模型也能保持画面清晰,并把属性准确对应到指定对象,让结果更可预测、更易控制。

利用上传图片理解上下文

模型可以分析上传图片,并自然地把其中的细节融入新图。无需借助其他工具,也能让参考素材、设计和视觉主题保持一致。

丰富风格与写实表现

从照片级写实到艺术插画、复古或超现实风格,模型都能灵活呈现。它可根据所需风格和氛围调整,适用于创意和专业场景。

相关模型

gpt-image-2/text-to-image

生成品牌视觉素材,准确呈现图片内文字和 Logo。

seedream-4-0/sequential

以智能序列和风格一致的图像生成为设计师打造连贯的视觉故事体验。

flux-2/flash/edit

Flux 2 Flash Edit 可根据明确的文字指令编辑最多 4 张参考图,并精确控制尺寸和输出格式。

qwen-image/qwen-image-2512/lora

根据文本生成精致图像,通过精准细节与灵活风格控制服务设计工作流。

qwen-edit-2509/lora/edit-skin

编辑单张图片的皮肤细节,并设置尺寸、步数、引导强度、生成数量、格式和随机种子。

wan-2.7/text-to-image

WAN 2.7 文生图:精准理解提示词,提供多种尺寸预设,每次最多生成 5 张图像

常见问题

这个页面上的 GPT-4o Image 可以做什么?

你可以根据文字提示词生成图片,并设置背景和宽高比。

哪个输入项是必填的?

只有 prompt 是必填项。请在其中说明主体、场景、构图和风格;如果图片内需要出现文字,也应写明准确内容。

可以选择哪些图片尺寸?

size 支持 3:2、1:1 和 2:3,默认值为 1:1。

怎样设置背景?

将 background 设为 transparent 或 opaque。默认值为 opaque。

希望图片内出现文字时,提示词应该怎么写?

请写出需要显示的准确文字,并说明位置、字体观感和周围环境。尤其是文字较长时,发布前应检查生成结果。

页面上有随机种子、负向提示词或输入图片字段吗?

没有。这个页面目前只有 prompt、background 和 size。

关注我们
  • 领英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 电子邮件
  • 系统状态
  • 附属
视频模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
图像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服务条款
  • 隐私政策
  • Cookie 政策
RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。