logo
RunComfy
  • ComfyUI
  • TrainerNeu
  • Modelle
  • API
  • Preise
discord logo
MODELLE
Erkunden
Alle Modelle
BIBLIOTHEK
Generierungen
MODELL-APIS
API-Dokumentation
API-Schlüssel
KONTO
Nutzung

GPT Image 1.5: Multi-Referenz-Bildbearbeitung | RunComfy

openai/gpt-image-1-5/image-to-image

Bearbeiten oder kombinieren Sie ein bis zehn Referenzbilder aus einer Textanweisung mit expliziten Steuerelementen für Größe, Hintergrund, Qualität, Wiedergabetreue und Format.

Image 1
Die URLs der Bilder, die als Referenz für die Generierung verwendet werden sollen
Seitenverhältnis für das generierte Bild
Hintergrund für das generierte Bild
Qualität für das generierte Bild
Eingabetreue für das generierte Bild
Ausgabeformat für die Bilder
Idle
The rate is $0.009 per image for low quality, $0.034 per image for medium quality, and $0.133 per image for high quality.

Einführung in die GPT Image 1.5 Bildbearbeitung

GPT Image 1.5 wendet eine schriftliche Bearbeitungsanweisung auf ein oder mehrere Referenzbilder an. Die Seite RunComfy akzeptiert eine bis zehn Bild-URLs und stellt Einstellungen für Ausgabegröße, Hintergrund, Qualität, Eingabetreue und Dateiformat bereit. Verwenden Sie es für gezielte Änderungen, visuelle Kompositionen, Produktvariationen oder Stilanpassungen und überprüfen Sie dann wichtige Identitäts-, Text- und Layoutdetails vor dem Produktionseinsatz. Die gleichen Steuerelemente sind über ein HTTP API verfügbar.
Ideal für: Überarbeitungen von Produktbildern | Kompositionen mit mehreren Referenzen | Kampagnen- und Designvarianten

GPT Image 1.5 Image to Image auf der X-Plattform

Modellübersicht#


  • Anbieter: OpenAI
  • Aufgabe: Bild-zu-Bild-Bearbeitung
  • Referenzbilder: 1–10
  • Ausgabegrößen: auto, 1024x1024, 1536x1024, 1024x1536
  • Zusammenfassung: GPT Image 1.5 bearbeitet oder kombiniert hochgeladene Referenzbilder gemäß einer Anweisung in natürlicher Sprache. Mit den freigelegten Steuerelementen können Sie auswählen, wie stark die erste Eingabe beibehalten werden soll, zusammen mit der Ausgabegröße, dem Hintergrundmodus, der Qualität und dem Dateiformat.

Eingabeparameter#


ParameterTypStandard/BereichBeschreibung
promptstringErforderlichAnweisung, die die Generierung oder Bearbeitung beschreibt.
image_urlsarray (image_uris)1–10; ErforderlichURLs von Quell- oder Referenzbildern.
image_sizestringauto, 1024x1024, 1536x1024, 1024x1536; Standard autoAusgabegröße; Auto lässt den Endpunkt wählen.
backgroundstringauto, transparent, opaque; Standard autoHintergrundverarbeitung für das Ergebnis.
qualitystringlow, medium, high; Standard highVon diesem Endpunkt bereitgestellte Qualitätseinstellung.
input_fidelitystringlow, high; Standard highStärke der Konservierung ab dem ersten Eingabebild.
output_formatstringjpeg, png, webp; Standard pngZurückgegebenes Bilddateiformat.

Praktische Tipps#


– Setzen Sie das wichtigste Quellbild an die erste Stelle, da input_fidelity relativ zur ersten Eingabe definiert ist.

  • Geben Sie genau an, was sich ändern soll und was unverändert bleiben soll.
  • Verwenden Sie nur die für die Aufgabe erforderlichen Referenzbilder. Mehr Eingaben verbessern nicht automatisch das Ergebnis.
  • Verwenden Sie den hohen input_fidelity-Wert, wenn Ähnlichkeit oder Beibehaltung des Layouts wichtig sind, und testen Sie den niedrigen Wert, wenn eine lockerere Neuinterpretation akzeptabel ist.
  • Überprüfen Sie nach komplexen Bearbeitungen Gesichter, Hände, Logos, kleinen Text, Reflexionen und Objektgrenzen.

API-Integration#


Die RunComfy-API akzeptiert die gleichen Felder, die von der Modellschnittstelle verwendet werden: „prompt“, „image_urls“, „image_size“, „background“, „quality“, „input_fidelity“ und „output_format“.


Hinweis: API-Endpunkt für GPT Image 1.5


Offizielle Ressourcen und Bedingungen#


  • OpenAI Ressource: https://openai.com/blog/chatgpt-images-gpt-image-1-5
  • Bilddokumentation: https://platform.openai.com/docs/guides/images/image-generation
  • Bedingungen: Lesen Sie vor der kommerziellen Bereitstellung die aktuellen OpenAI- und RunComfy-Bedingungen, einschließlich der Anforderungen an Eingabedaten und Ausgabenutzung.

Verwandtes Modell#


  • Um ein Bild ohne Referenzen zu generieren, verwenden Sie GPT Image 1.5 Text To Image.

– Auf der Quellseite wird auch verwiesen: Flux 2.

Verwandte Modelle

flux-2/flex/text-to-image

Erzeugen Sie Bilder aus Text und steuern Sie Größe, Prompt-Erweiterung, Guidance, Schritte, Seed und Format.

flux-2/dev/text-to-image

Generieren Sie ein Bild aus einer erforderlichen Prompt mit einer von sechs Voreinstellungen für exakte Größe und einem optionalen Integer-Seed. Der Standard-Seed-Wert -1 wählt einen zufälligen Seed aus.

flux-2/lora

Generieren Sie Bilder aus Text und kombinieren Sie bis zu drei LoRA-Adapter mit separaten Gewichtungen.

nano-banana-2-lite/edit

Schnelle, kostengünstige Prompt-basierte Bildbearbeitung mit fester 1K-Auflösung.

seedream-4-5/edit

Verwandeln Sie Ihre Bilder mit Seedream 4.5 Edit Bildbearbeitung für kohärente, fotorealistische Ergebnisse und präzise Markenkonsistenz.

qwen-edit-2509/lora

Bearbeiten Sie 1–10 Quellbilder anhand eines Pflicht-Prompts und wenden Sie optional bis zu drei LoRA-Einträge an. Wählen Sie aus sechs Ausgabegrößen und stellen Sie Inferenzschritte, Guidance-Skala, 1–4 Ergebnisse, Seed sowie die Ausgabeformate Default, JPEG oder PNG ein.

Häufig gestellte Fragen

Was sind die Hauptfunktionen von GPT Image 1.5 Bild-zu-Bild?

Es folgt eine schriftliche Anweisung, ein bis zehn Referenzbilder zu bearbeiten oder zu kombinieren. Die Seite bietet Steuerelemente für Ausgabegröße, Hintergrund, Qualität, Eingabetreue und JPEG-, PNG- oder WEBP-Lieferung.

Wie unterscheidet sich GPT Image 1.5 von früheren Bildbearbeitungsmodellen?

Dieser Workflow kombiniert die Bearbeitung in natürlicher Sprache mit bis zu zehn Referenzbildern und einer expliziten input_fidelity-Steuerung. Das Seitenschema veröffentlicht keine vergleichenden Geschwindigkeits- oder Qualitätsbenchmarks. Testen Sie daher repräsentative Änderungen anhand aller Alternativen, die Sie in Betracht ziehen.

Welche technischen Grenzen sollten Entwickler kennen?

Eine Anfrage erfordert prompt und einen bis zehn image_urls-Werte. Die Ausgabegröße kann automatisch, 1024x1024, 1536x1024 oder 1024x1536 sein. Das Seitenschema veröffentlicht kein Prompt-Token-Limit und akzeptiert nicht mehr als zehn Referenzbilder.

Welche Größen-, Hintergrund- und Ausgabeformatoptionen sind verfügbar?

image_size unterstützt auto, 1024x1024, 1536x1024 und 1024x1536. Für background stehen auto, transparent und opaque zur Verfügung. output_format akzeptiert jpeg, png und webp.

Wie kann ich vom Testen von GPT Image 1.5 in RunComfy über die API zur Produktion übergehen?

Validieren Sie eine repräsentative Bearbeitung in der Modellschnittstelle RunComfy und senden Sie dann dieselben Felder prompt, image_urls, image_size, background, quality, input_fidelity und output_format an die API. Fügen Sie Authentifizierung, Abfrage, Wiederholungsversuche und Ausgabevalidierung für die Produktion hinzu.

Was macht GPT Image 1.5 gegenüber konkurrierenden Bildbearbeitungsprogrammen vorzuziehen?

Es gibt kein einzelnes Modell, das für jede Bearbeitung am besten geeignet ist, und das Schema dieser Seite legt keine Rangfolge mit der Konkurrenz fest. GPT Image 1.5 ist eine praktische Wahl, wenn Sie eine aufforderungsbasierte Bearbeitung, bis zu zehn Referenzen und direkte Kontrollen für Aufbewahrung, Größe, Hintergrund, Qualität und Format benötigen.

Kann GPT Image 1.5 Text während der Bildbearbeitung beibehalten oder rendern?

Sie können es anweisen, Text beizubehalten oder zu erstellen, wichtige Rechtschreibung, Typografie, Logos und kleine Beschriftungen sollten jedoch sorgfältig überprüft werden. Verwenden Sie eine klare Eingabeaufforderung und einen hohen input_fidelity, wenn die Beibehaltung der ersten Referenz wichtig ist.

Kann GPT Image 1.5 für kommerzielle Bildbearbeitungsprojekte verwendet werden?

Die kommerzielle Nutzung hängt von den aktuellen OpenAI- und RunComfy-Bedingungen sowie von Ihren Rechten an den eingegebenen Bildern ab. Lesen Sie diese Bedingungen und etwaige Datenschutz- oder Markenanforderungen, bevor Sie den Workflow in der Produktion verwenden.

Wie kann ich die visuelle Identität über alle Bearbeitungen hinweg konsistent halten?

Platzieren Sie zuerst die primäre Referenz, setzen Sie input_fidelity auf „hoch“, wenn eine stärkere Erhaltung erforderlich ist, und geben Sie die Attribute an, die unverändert bleiben müssen. Selbst dann sollten Sie Identität, Layout, Beleuchtung und feine Details nach jedem Ergebnis überprüfen, anstatt von perfekter Konsistenz auszugehen.

Wie kann ich die Erzeugungskosten verwalten?

Die aktuellen Preise werden nicht im Inhaltsschema dieser Seite gespeichert. Überprüfen Sie die angezeigten Kosten von RunComfy, wählen Sie die für die Aufgabe geeignete Stufe quality aus, testen Sie mit einer gezielten Eingabeaufforderung und nur den erforderlichen Referenzen und reservieren Sie Läufe mit höherer Qualität für ausgewählte Ausgaben.

Folge uns
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Support
  • Discord
  • E-Mail
  • Systemstatus
  • Partner
Videomodelle
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Alle Modelle anzeigen →
Bildmodelle
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Alle Modelle anzeigen →
Rechtliches
  • Nutzungsbedingungen
  • Datenschutzrichtlinie
  • Cookie-Richtlinie
RunComfy
Urheberrecht 2026 RunComfy. Alle Rechte vorbehalten.

RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.

Beispiele erstellt mit GPT Image 1.5

Hyper-realistic winter portrait of a woman in a snow-covered fur-lined hood.
Silhouetted fisherman on a bridge at sunset near a mosque skyline, reflecting soft golden tones, inspired by GPT Image 1.5.
Overhead view of a vintage typewriter, journal, pencil, and coffee cup floating on fabric in a pool, crafted using GPT Image 1.5.
Two men wearing Santa hats sharing Coca-Cola in a festive setting, created using GPT Image 1.5.
Golden retriever, tabby cat, and pet rat snuggled on a couch watching TV, depicted using GPT Image 1.5 Image model.
Man reading a newspaper featuring a comparison between a humanoid robot and a banana with a computer chip, highlighting GPT Image 1.5 model.