logo
RunComfy
  • ComfyUI
  • EntrenadorNuevo
  • Modelos
  • API
  • Precios
discord logo
MODELOS
Explorar
Todos los modelos
BIBLIOTECA
Generaciones
APIS DE MODELOS
Documentación de la API
Claves API
CUENTA
Uso

GPT Image 1.5: Edición de imágenes multireferencia | RunComfy

openai/gpt-image-1-5/image-to-image

Edite o combine de una a diez imágenes de referencia a partir de una instrucción de texto con controles explícitos de tamaño, fondo, calidad, fidelidad y formato.

Image 1
Las URL de las imágenes para usar como referencia para la generación.
Relación de aspecto de la imagen generada.
Fondo para la imagen generada.
Calidad de la imagen generada.
Fidelidad de entrada para la imagen generada.
Formato de salida de las imágenes.
Idle
The rate is $0.009 per image for low quality, $0.034 per image for medium quality, and $0.133 per image for high quality.

Introducción a la edición de imágenes GPT Image 1.5

GPT Image 1.5 aplica una instrucción de edición escrita a una o más imágenes de referencia. La página RunComfy acepta de una a diez URL de imágenes y expone las configuraciones de tamaño de salida, fondo, calidad, fidelidad de entrada y formato de archivo. Úselo para cambios específicos, composición visual, variaciones de productos o ajustes de estilo, luego inspeccione detalles importantes de identidad, texto y diseño antes de usarlo en producción. Los mismos controles están disponibles a través de un HTTP API.
Ideal para: Revisiones de imágenes de productos | Composiciones multireferencia | Variaciones de campaña y diseño.

GPT Image 1.5 Image to Image en la plataforma X

Descripción general del modelo#


  • Proveedor: OpenAI
  • Tarea: edición de imagen a imagen
  • Imágenes de referencia: 1–10
  • Tamaños de salida: auto, 1024x1024, 1536x1024, 1024x1536
  • Resumen: GPT Image 1.5 edita o combina imágenes de referencia cargadas según instrucciones en lenguaje natural. Los controles expuestos le permiten elegir con qué intensidad desea conservar la primera entrada, junto con el tamaño de salida, el modo de fondo, la calidad y el formato del archivo.

Parámetros de entrada#


ParámetroTipoPredeterminado/RangoDescripción
promptstringObligatorioInstrucción que describe la generación o edición.
image_urlsarray (image_uris)1–10; ObligatorioURL de imágenes fuente o de referencia.
image_sizestringauto, 1024x1024, 1536x1024, 1024x1536; predeterminado autoTamaño de salida; auto permite que el punto final elija.
backgroundstringauto, transparent, opaque; predeterminado autoManejo en segundo plano del resultado.
qualitystringlow, medium, high; predeterminado highConfiguración de calidad expuesta por este punto final.
input_fidelitystringlow, high; predeterminado highFuerza de preservación de la primera imagen de entrada.
output_formatstringjpeg, png, webp; predeterminado pngFormato de archivo de imagen devuelto.

Consejos prácticos#


  • Coloque la imagen de origen más importante primero porque input_fidelity se define en relación con la primera entrada.
  • Indique exactamente qué debería cambiar y qué debería permanecer sin cambios.
  • Utilice únicamente las imágenes de referencia necesarias para la tarea; más entradas no mejoran automáticamente el resultado.
  • Utilice input_fidelity alto cuando la semejanza o la retención del diseño sean importantes, y pruebe bajo cuando sea aceptable una reinterpretación más flexible.
  • Inspeccione rostros, manos, logotipos, texto pequeño, reflejos y límites de objetos después de ediciones complejas.

Integración API#


La API RunComfy acepta los mismos campos utilizados por la interfaz del modelo: prompt, image_urls, image_size, background, quality, input_fidelity y output_format.


Nota: Punto final de API para GPT Image 1.5


Recursos y términos oficiales#


  • OpenAI recurso: https://openai.com/blog/chatgpt-images-gpt-image-1-5
  • Documentación de imagen: https://platform.openai.com/docs/guides/images/image-generation
  • Términos: Revise los términos actuales OpenAI y RunComfy, incluidos los requisitos de uso de datos de entrada y salida, antes de la implementación comercial.

Modelo relacionado#


  • Para generar una imagen sin referencias, utilice GPT Image 1.5 Texto a imagen.
  • También se hace referencia en la página de origen: Flux 2.

Modelos relacionados

flux-1-kontext/max/text-to-image

Crea y edita imágenes desde texto con control preciso y resultados coherentes.

gpt-image-2/edit

Edición de imagen GPT Image 2 de OpenAI: ediciones de imagen a imagen con control de texto preciso y pintura de entrada y salida

wan-2-2/text-to-image

Crea una imagen con Wan 2.2 Plus desde un prompt y elige tamaño, seed y ampliación del prompt.

nano-banana/pro/text-to-image

Genera entre 1 y 4 imágenes desde un prompt y elige relación de aspecto, resolución, formato y modo de devolución.

recraft-v3/text-to-image

Cree imágenes rasterizadas, de ilustración digital o de estilo vectorial con controles detallados de estilo, tamaño y color.

qwen-edit-2509/lora/next-scene

Cree una edición de la escena siguiente a partir de un prompt obligatorio y exactamente una imagen de origen. Elija entre seis tamaños de salida y configure entre 2 y 50 pasos de inferencia, una escala de guía de 0 a 20 (valor predeterminado: 6), de 1 a 4 resultados, la semilla y salida JPEG o PNG.

Preguntas Frecuentes

¿Cuáles son las principales capacidades de GPT Image 1.5 imagen a imagen?

Sigue una instrucción escrita para editar o combinar de una a diez imágenes de referencia. La página proporciona controles para el tamaño de salida, el fondo, la calidad, la fidelidad de entrada y la entrega JPEG, PNG o WEBP.

¿En qué se diferencia GPT Image 1.5 de los modelos de edición de imágenes anteriores?

Este flujo de trabajo combina la edición en lenguaje natural con hasta diez imágenes de referencia y un control input_fidelity explícito. El esquema de la página no publica puntos de referencia comparativos de velocidad o calidad, así que pruebe las ediciones representativas con cualquier alternativa que esté considerando.

¿Qué límites técnicos deben conocer los desarrolladores?

Una solicitud requiere prompt y de uno a diez valores image_urls. El tamaño de salida puede ser automático, 1024x1024, 1536x1024 o 1024x1536. El esquema de la página no publica un límite de token de aviso ni acepta más de diez imágenes de referencia.

¿Qué opciones de tamaño, fondo y formato de salida están disponibles?

image_size admite auto, 1024x1024, 1536x1024 y 1024x1536. background admite auto, transparent y opaque. output_format admite jpeg, png y webp.

¿Cómo puedo pasar de probar GPT Image 1.5 en RunComfy a producción a través de la API?

Valide una edición representativa en la interfaz del modelo RunComfy y luego envíe los mismos campos prompt, image_urls, image_size, background, quality, input_fidelity y output_format a la API. Agregue autenticación, sondeo, reintentos y validación de salida para producción.

¿Qué hace que GPT Image 1.5 sea preferible a los editores de imágenes de la competencia?

Ningún modelo es mejor para cada edición y el esquema de esta página no establece una clasificación de la competencia. GPT Image 1.5 es una opción práctica cuando necesita una edición basada en indicaciones, hasta diez referencias y controles directos de conservación, tamaño, fondo, calidad y formato.

¿Puede GPT Image 1.5 conservar o representar texto durante la edición de imágenes?

Puede indicarle que retenga o cree texto, pero se deben revisar cuidadosamente la ortografía, la tipografía, los logotipos y las etiquetas pequeñas importantes. Utilice un mensaje claro y alto input_fidelity cuando la preservación de la primera referencia sea importante.

¿Se puede utilizar GPT Image 1.5 para proyectos comerciales de edición de imágenes?

El uso comercial depende de los términos actuales OpenAI y RunComfy y de sus derechos sobre las imágenes ingresadas. Revise esos términos y cualquier requisito de privacidad o marca antes de utilizar el flujo de trabajo en producción.

¿Cómo puedo mantener la coherencia de la identidad visual en todas las ediciones?

Coloque la referencia principal primero, establezca input_fidelity en alto cuando se necesite una preservación más sólida e indique los atributos que deben permanecer sin cambios. Incluso entonces, inspeccione la identidad, el diseño, la iluminación y los detalles finos después de cada resultado en lugar de asumir una consistencia perfecta.

¿Cómo puedo gestionar el coste de generación?

El precio actual no se almacena en el esquema de contenido de esta página. Verifique el costo mostrado de RunComfy, elija el nivel de quality apropiado para la tarea, pruebe con un mensaje enfocado y solo las referencias necesarias, y reserve ejecuciones de mayor calidad para resultados seleccionados.

Síguenos
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Soporte
  • Discord
  • Correo electrónico
  • Estado del sistema
  • afiliado
Modelos de Video
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Ver todos los modelos →
Modelos de Imagen
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Ver todos los modelos →
Legal
  • Términos de servicio
  • Política de privacidad
  • Política de cookies
RunComfy
Derechos de autor 2026 RunComfy. Todos los derechos reservados.

RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.

Ejemplos creados con GPT Image 1.5

Hyper-realistic winter portrait of a woman in a snow-covered fur-lined hood.
Silhouetted fisherman on a bridge at sunset near a mosque skyline, reflecting soft golden tones, inspired by GPT Image 1.5.
Overhead view of a vintage typewriter, journal, pencil, and coffee cup floating on fabric in a pool, crafted using GPT Image 1.5.
Two men wearing Santa hats sharing Coca-Cola in a festive setting, created using GPT Image 1.5.
Golden retriever, tabby cat, and pet rat snuggled on a couch watching TV, depicted using GPT Image 1.5 Image model.
Man reading a newspaper featuring a comparison between a humanoid robot and a banana with a computer chip, highlighting GPT Image 1.5 model.