logo
RunComfy
  • ComfyUI
  • ТренерНовое
  • Модели
  • API
  • Цены
discord logo
МОДЕЛИ
Обзор
Все модели
БИБЛИОТЕКА
Генерации
API МОДЕЛЕЙ
Документация API
API-ключи
АККАУНТ
Использование

Изображение GPT 2. Редактирование изображения: высококачественное редактирование изображений в игровой площадке и через API | Models and API | RunComfy

openai/gpt-image-2/edit

Преобразуйте исходные изображения в безупречные визуальные эффекты 4K с многоязычным текстом, точной прорисовкой и готовыми к использованию изменениями для быстрого обновления продуктов, проведения кампаний и творческих рабочих процессов дизайна.

Image 1
Эталонные изображения для редактирования, до 10 изображений.
Соотношение сторон редактируемого изображения. Автоматически определяется из входного изображения, если опущено.
Выходное разрешение.
Качество изображения.
Формат выходного изображения.
Idle
Price per image (quality × resolution): low $0.03 / $0.06 / $0.09, medium $0.069 / $0.138 / $0.207, high $0.27 / $0.54 / $0.81 for 1K / 2K / 4K.

Введение в GPT Image 2 Image Edit

GPT Image 2 от OpenAI на RunComfy превращает эталонные изображения и инструкции в готовые к использованию визуальные эффекты от 0,03 доллара США за изображение, с выходным разрешением до 4K и надежным многоязычным рендерингом текста для высокоточного редактирования изображений. Заменив ручное маскирование, повторную съемку и многослойное ретуширование контекстно-зависимой прорисовкой, закрашиванием и точной типографикой, это устраняет сложное маскирование и ускоряет утверждение для команд электронной коммерции, дизайнеров брендов и маркетинговых рабочих процессов с помощью GPT Image 2 Image Edit. Разработчики могут использовать GPT Image 2 Image Edit на RunComfy как в браузере, так и через HTTP API, поэтому вам не нужно самостоятельно размещать или масштабировать модель.
Идеально подходит для: улучшения фотографий продукта | Визуальная адаптация кампании | Локализация брендовых активов

OpenAI / GPT Image 2 Image Edit#


В RunComfy GPT Image 2 предлагает современную генерацию изображений, а также GPT Image 2 Image Edit для точных преобразований на основе инструкций с использованием одного или нескольких эталонных изображений. Он принимает изображения и текстовые запросы, возвращая высококачественные неподвижные изображения, подходящие для коммерческих визуальных эффектов, снимков продуктов, макетов пользовательского интерфейса и маркетинговых материалов.


Основные моменты#

  • Редактирование с учетом инструкций: использует естественный язык для изменения эталонных изображений с надежным соблюдением сложных указаний.
  • Высокая разборчивость текста: часто отображает метки, текст пользовательского интерфейса и многоязычную типографику с большей точностью, чем более ранние модели изображений GPT.
  • Гибкая обработка ввода: работает с 10 входными изображениями для пакетного обновления или ссылок под разными углами с помощью GPT Image 2 Image Edit.
  • Согласованная композиция: улучшает освещение, отражения и структуру сцены для получения более последовательных фотореалистичных результатов на всех итерациях.
  • Предварительные настройки разрешения и соотношения сторон, оптимизированные для рабочего процесса: выберите уровень разрешения (1K, 2K, 4K) и соотношение сторон (1:1, 3:2, 2:3, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 21:9), чтобы сбалансировать детализацию и скорость.
  • Надежная точность редактирования: GPT Image 2 Image Edit обычно сохраняет идентичность, элементы фирменного оформления и макет при внесении управляемых изменений.

Параметры#


ПараметрТребуетсяТипПо умолчаниюДиапазон/ОпцииОписание
изображения*Да (*)Список изображений—От 1 до 10 изображенийСправочные изображения для редактирования, до 10 изображений
prompt*Да (*)Строка——Текстовое описание желаемого редактирования
resolutionНетПеречисление (строка)1K1K, 2K, 4KУровень выходного разрешения сгенерированного изображения
соотношение сторонНетПеречисление (строка)1:11:1, 3:2, 2:3, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 21:9Соотношение сторон сгенерированного изображения

Похожие модели

wan-2.7/text-to-image

WAN 2.7 Text-to-Image: точное понимание промптов, гибкие размеры и до пяти изображений за запрос

z-image/turbo/text-to-image/lora

Создавайте изображения по тексту, применяя до трёх LoRA-адаптеров и настраивая размеры, веса и сид.

nano-banana-2-lite/edit

Быстрое и недорогое редактирование изображений по промпту в фиксированном разрешении 1K.

flux-2-klein/4b/text-to-image

Четырехэтапное преобразование текста в изображение за доли секунды с мгновенными точными визуальными эффектами

nano-banana/edit

Отредактируйте или объедините от 1 до 10 изображений по промпту и выберите соотношение сторон, формат и число результатов.

z-image/turbo/controlnet/lora

Создавайте изображения из одного управляющего изображения, используя до трёх LoRAs, четыре режима предобработки, настраиваемый период влияния ControlNet и 1–8 шагов.

Часто задаваемые вопросы

Каковы ограничения на максимальное разрешение и соотношение сторон при использовании GPT Image 2 Image Edit для рабочих процессов преобразования изображений в изображения?

GPT Image 2 Image Edit поддерживает выходные разрешения примерно до 4K, придерживаясь ограничений бюджета пикселей, определенных базовой моделью. При редактировании изображений лучше всего поддерживать соотношения сторон, аналогичные входному изображению, чтобы обеспечить точность. Превышение этих параметров может привести к автоматическому изменению размера или снижению визуальной согласованности.

Существуют ли какие-либо ограничения на запросы или ввод данных в GPT Image 2 Image Edit при выполнении высококачественных обновлений изображений?

Да. GPT Image 2 Image Edit обычно ограничивает текстовые подсказки несколькими тысячами токенов и может ограничивать ввод ссылочных данных одним основным изображением для задач преобразования изображения в изображение. Расширенное управление несколькими ссылками (например, ControlNet или IP-адаптер) может стать доступным в более поздних версиях API, но в текущих реализациях приоритет отдается управлению одним изображением.

Как перенести прототип преобразования изображения в изображение GPT Image 2 из RunComfy Playground в рабочий процесс на основе API?

Чтобы перейти от пробной версии к рабочей, экспортируйте конфигурации редактирования изображения GPT Image 2 из RunComfy Playground, замените шаги ручного редактирования конечной точкой API RunComfy и выполните аутентификацию с помощью ключей рабочего API. Убедитесь, что вы управляете ограничениями скорости API и балансом долларов США, поскольку производственные запросы потребляют платные вычислительные ресурсы, а в пробной версии Playground используется ограниченная бесплатная квота.

Что отличает GPT Image 2 Image Edit от более ранних моделей, таких как GPT Image 1.5, с точки зрения согласованности изображений?

Редактирование изображения GPT Image 2 обеспечивает превосходную визуальную стабильность и следование инструкциям по сравнению с GPT Image 1.5. При операциях преобразования изображения в изображение он более эффективно сохраняет сходство персонажей, точность освещения и согласованность сцены благодаря новой авторегрессионной мультимодальной архитектуре, заменяющей предыдущие системы, основанные на диффузии.

Насколько хорошо GPT Image 2 Image Edit отображает текст и многоязычный контент в случаях использования изображения в изображении?

GPT Image 2 Image Edit превосходно воспроизводит наложенный текст, включая нелатинские и многоязычные сценарии. Это представляет собой заметный шаг вперед по сравнению со старыми моделями, поскольку сводит к минимуму искажения и сохраняет читаемость текста даже после многократного редактирования изображений в течение одного сеанса.

Может ли GPT Image 2 Image Edit обрабатывать фотореалистичные изображения продуктов лучше, чем конкуренты, такие как Nano Banana Pro?

GPT Image 2 Image Edit обеспечивает превосходную точность для фотореалистичных и композиционных задач, особенно там, где точная визуализация текста или маркировка продуктов имеют решающее значение. В то время как Nano Banana Pro может генерировать немного быстрее и с более плавной реалистичностью текстур кожи в некоторых тестах, GPT Image 2 Image Edit предлагает более сильный контроль и точность сцены для рабочих процессов преобразования изображения в изображение коммерческого уровня.

Как GPT Image 2 Image Edit поддерживает визуальную согласованность во время итеративных уточнений в сеансе преобразования изображения в изображение?

GPT Image 2 Image Edit использует авторегрессионный дизайн, который отслеживает контекстную согласованность на протяжении нескольких поколений. В результате при выполнении итеративных уточнений от изображения к изображению он лучше сохраняет геометрическую структуру, отражения и согласованность освещения по сравнению с диффузионными моделями, которые могут меняться при редактировании.

Есть ли какие-либо соображения по задержке или советы по производительности при запуске GPT Image 2 Image Edit для крупномасштабных производственных пакетов изображения в изображение?

При пакетном использовании GPT Image 2 Image Edit может иметь немного большую задержку, чем облегченные генераторы. Разработчикам следует управлять параллелизмом запросов и учитывать меньшие размеры пакетов изображений для повышения эффективности. Кэширование повторно используемых ссылок и минимизация избыточных загрузок также могут повысить производительность производства.

Для каких типов творческих задач больше всего подходит модальность преобразования изображения в изображение в GPT Image 2 Image Edit?

GPT Image 2 Image Edit исключительно хорошо работает для профессиональной визуализации продуктов, макетов UX/UI и обновлений брендинга, где важно точное сохранение композиции. Режим редактирования изображений позволяет пользователям аккуратно преобразовывать существующие изображения, уточнять размещение объектов или изменять цвета и наложения текста, сохраняя при этом визуальную точность.

Подписывайтесь на нас
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Поддержка
  • Discord
  • Email
  • Статус системы
  • партнёр
Модели видео
  • Runway Aleph 2
  • Wan 2.5
  • Wan 2.6 Flash
  • MiniMax H3 Max
  • Wan 3.0 Reference To Video
  • Seedance 2.5 Reference to Video 480p
  • Посмотреть все модели →
Модели изображений
  • Wan 2.6 Image to Image
  • Seedream 5.0 Pro
  • Flux 2 Klein 9B
  • Nano Banana Pro
  • Nano Banana 2 Edit
  • Z Image Turbo LoRA
  • Посмотреть все модели →
Юридическая информация
  • Условия обслуживания
  • Политика конфиденциальности
  • Политика в отношении файлов cookie
RunComfy
Авторское право 2026 RunComfy. Все права защищены.

RunComfy - ведущая ComfyUI платформа, предлагающая ComfyUI онлайн среду и услуги, а также рабочие процессы ComfyUI с потрясающей визуализацией. RunComfy также предоставляет AI Models, позволяя художникам использовать новейшие инструменты AI для создания невероятного искусства.

Примеры редактирования изображений (GPT Image 2)