Kombinieren oder bearbeiten Sie anhand eines Pflicht-Prompts 1 bis 10 Quellbilder. Einstellbar sind sechs Ausgabegrößen, Inferenzschritte, Guidance-Skala, 1 bis 4 Ergebnisse, Seed sowie JPEG- oder PNG-Ausgabe.
| Parameter | Type | Default/Range | Beschreibung |
|---|---|---|---|
| image_url | string | Required | URL des Eingabebildes. |
| prompt | string | Optional | Anleitung zum Ebenenaufbau und Bildinhalt. |
| negative_prompt | string | Optional | Auszuschließende Elemente. |
| num_layers | integer | Default: 4; Range: 1-10 | Anzahl der zu generierenden RGBA-Ebenen. |
| num_inference_steps | integer | Default: 28; Range: 1-50 | Anzahl der Inferenzschritte. |
| guidance_scale | float | Default: 5; Range: 1-20 | Wie genau folgt das Ergebnis prompt? |
| seed | integer | Default: 0 | Konstanter seed für reproduzierbare Ergebnisse. |
| output_format | string | Options: png, webp; Default: png | Ausgabebildformat; png wird empfohlen, wenn die Transparenz erhalten bleiben muss. |
Die RunComfy-API verwendet dieselben Felder wie die Browseroberfläche. image_url ist erforderlich; prompt und negative_prompt sind optionale Steuerelemente. Die Antwort enthält die generierten Layer-Assets zur Verwendung in einem Editor oder einer automatisierten Pipeline.
API-Endpunkt für Qwen Image Layered
Für gezielte Bearbeitungen in einem flachen Bild versuchen Sie es mit Qwen-Image-Edit-2509.
Kombinieren oder bearbeiten Sie anhand eines Pflicht-Prompts 1 bis 10 Quellbilder. Einstellbar sind sechs Ausgabegrößen, Inferenzschritte, Guidance-Skala, 1 bis 4 Ergebnisse, Seed sowie JPEG- oder PNG-Ausgabe.
Bearbeiten Sie ein erforderliches Bild anhand einer erforderlichen Textanweisung – mit Prompt-Erweiterung, zwei Ausgabeauflösungen, Seed und Formatauswahl.
Flux 2 Turbo Text to Image erzeugt detailreiche Bilder aus Text-Prompts mit steuerbarer Prompt-Treue, reproduzierbaren Seeds und festen Formatvorlagen.
Bearbeiten Sie ein erforderliches Referenzbild über eine erforderliche Eingabeaufforderung. Anfrage 1–4 führt zu PNG, JPEG oder WebP und gibt optional Medien als Daten-URI mit `sync_mode` zurück.
Erstellen Sie raffinierte visuelle Darstellungen aus Text mit präzisen Details und flexibler Stilkontrolle für Design-Workflows.
Erzeugen Sie mit Imagen 4 Ultra ein Bild aus einem Prompt und stellen Sie negativen Prompt, Seitenverhältnis und Seed ein.
Es zerlegt ein Eingabebild in mehrere semantisch getrennte RGBA-Ebenen. Jede Ebene behält ihre Transparenz und kann unabhängig verschoben, neu eingefärbt, bearbeitet oder zusammengesetzt werden.
Das Modell ist unter Apache-2.0 veröffentlicht, was die kommerzielle Nutzung gemäß den Lizenzbedingungen erlaubt. Sie müssen weiterhin über die Rechte am eingegebenen Bild verfügen und jegliches geistige Eigentum Dritter am Inhalt respektieren.
num_layers reicht von 1 bis 10, num_inference_steps von 1 bis 50 und guidance_scale von 1 bis 20. Der Endpunkt stellt keine Auflösungseinstellung oder ein prompt-Token-Limit bereit.
Im Schema dieses Endpunkts werden keine derartigen Eingaben angezeigt. Es erfordert einen image_url und akzeptiert optional prompt und negative_prompt, um die Zerlegung zu steuern.
Testen Sie die Einstellungen in der Browseroberfläche RunComfy und verwenden Sie dann den API-Endpunkt RunComfy des Modells mit denselben Eingabefeldern. image_url ist erforderlich; Die anderen freigelegten Steuerelemente können nach Bedarf hinzugefügt werden.
Die veröffentlichte Modellbeschreibung identifiziert ein VLD-MMDiT-Backbone mit Layer3D RoPE-Positionseinbettungen, das darauf ausgelegt ist, den Kontext über Ebenen hinweg zu teilen und gleichzeitig semantische Elemente getrennt zu halten.
Sein RGBA-VAE repräsentiert RGB- und RGBA-Daten in einem gemeinsam genutzten latenten Raum. Dies trägt dazu bei, konsistente Alpha-Informationen für jede semantische Komponente zu erzeugen, sodass die Ebenen nachträglich bearbeitet oder zusammengesetzt werden können.
Es kann texthaltige Bereiche in bearbeitbare Ebenen unterteilen, die genaue Texttreue kann jedoch je nach Eingabe und Einstellungen variieren. Überprüfen Sie wichtige Typografien, bevor Sie die Ebenen in der Produktion verwenden.
Zu den typischen Anwendungen gehören Objektisolierung, Anpassung von Markenwerten, Extraktion von UI-Komponenten, Hintergrundersetzung, Layout-Prototyping, Animationsvorbereitung und VFX-Compositing.
Qwen Image Edit ändert ausgewählte Bereiche eines flachen Bildes. Qwen Image Layered zerlegt stattdessen ein Bild in mehrere RGBA-Ebenen, was sich besser für die wiederholte Bearbeitung und Zusammenstellung auf Ebenenebene eignet.
RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.





