logo
RunComfy
  • ComfyUI
  • TrainerNeu
  • Modelle
  • API
  • Preise
discord logo
MODELLE
Erkunden
Alle Modelle
BIBLIOTHEK
Generierungen
MODELL-APIS
API-Dokumentation
API-Schlüssel
KONTO
Nutzung

Z Image Turbo ControlNet: Strukturgeführte Bild-zu-Bild-Generierung mit LoRAs | RunComfy

tongyi-mai/z-image/turbo/controlnet/lora

Leitfadengenerierung mit einem Eingabebild, vier Vorverarbeitungsmodi, 0–1 Steuerzeitpunkt, bis zu drei LoRAs und 1–8 Inferenzschritten.

URL des Eingabebildes, das für die ControlNet-basierte Generierung verwendet wird.
LoRA #1
URL, HuggingFace-Repo-ID (Eigentümer/Repo) zu Lora-Gewichten.
Maßstab des LoRA-Modells.
Liste der anzuwendenden LoRAs (maximal 3).
Steuert, wie stark sich die ControlNet-Bedingungen auf die Ausgabe auswirken.
Gibt den Startpunkt der ControlNet-Konditionierung während der Generierung an.
Gibt den Endpunkt der ControlNet-Konditionierung während der Generierung an.
Definiert, welche Vorverarbeitung (falls vorhanden) auf das ControlNet-Eingabebild angewendet wird.
Gibt die Anzahl der Inferenzschritte während der Generierung an.
Ermöglicht die automatische Prompt-Erweiterung zur Verbesserung der Ergebnisse; erhöht die Kosten um 0,0025 Credits pro Anfrage.
Gibt das Ausgabebildformat an.
Idle
The rate is $0.01 per image.

Einführung in Z Image Turbo ControlNet

Z Image Turbo ControlNet verwendet ein Eingabebild als Orientierungshilfe für die Struktur, während eine Textaufforderung das beabsichtigte Ergebnis beschreibt. Wählen Sie die Vorverarbeitung none, canny, depth oder pose. Passen Sie die Kontrollstärke sowie deren Start- und Endpunkte an. und wenden Sie bis zu drei LoRAs an. Die Seite verfügt außerdem über sieben Bildgrößenoptionen, 1–8 Inferenzschritte, Seed, Prompt-Erweiterung und JPEG-, PNG- oder WebP-Ausgabe.
Ideal für: Kantengeführtes Redesign | Depth-bewusste Komposition | Pose-geführte Charaktervariationen

Z Image Turbo ControlNet Auf X: Einblicke und Updates

Modellübersicht#


  • Aufgabe: ControlNet-geführte Bild-zu-Bild-Generierung
  • Zusammenfassung: Z Image Turbo ControlNet kombiniert einen Prompt mit einem Steuerbild. Die Vorverarbeitung bestimmt, welches Struktursignal extrahiert wird, die Steuerungseinstellungen bestimmen, wann und wie stark es angewendet wird, und optionale LoRAs fügen Modell- oder Stileinflüsse hinzu.

Eingabeparameter#


ParameterTypStandard/BereichBeschreibung
promptstringErforderlichBeschreibung des zu generierenden Bildes.
image_urlstring (image_uri)ErforderlichURL des Eingabebilds ControlNet.
lorasarray0–3 Einträge; Erforderlich; ein StandardeintragAnzuwendende LoRA-Einträge. Jeder Eintrag enthält path und scale.
image_sizestringsquare_hd, square, portrait_4_3, portrait_16_9, landscape_4_3, landscape_16_9, auto; Standard autoVoreingestellte Ausgabegröße.
control_scalefloat0–1; Standard 0.9Stärke der ControlNet-Konditionierung.
control_startfloat0–1; Standard 0Punkt in der Generation, an dem die Kontrolle beginnt.
control_endfloat0–1; Standard 0.4Punkt in der Generation, an dem die Kontrolle endet.
preprocessstringnone, canny, depth, pose; Standard noneAuf das Kontrollbild angewendete Vorverarbeitung.
num_inference_stepsinteger1–8; Standard 8Anzahl der Inferenzschritte.
seedintegerStandard 0Seed, der verwendet wird, um ein Ergebnis zu variieren oder zu reproduzieren.
enable_prompt_expansionbooleanStandard falseErweitert den Prompt automatisch, wenn die Funktion aktiviert ist.
output_formatstringjpeg, png, webp; Standard pngZurückgegebenes Bilddateiformat.

Jeder LoRA-Eintrag enthält path und scale; die LoRA-Skala akzeptiert 0–4 und ist standardmäßig 1.


Praktische Tipps#


  • Wählen Sie den Vorverarbeitungsmodus aus, der der Struktur entspricht, die Sie beibehalten müssen: canny für Kanten, depth für räumliches Layout, pose für Körpermarkierungen oder none, wenn das bereitgestellte Kontrollbild bereits vorbereitet ist.
  • Beginnen Sie mit den Standardsteuerungseinstellungen und ändern Sie dann jeweils eine von control_scale, control_start oder control_end.
  • Halten Sie die Werte für den Kontrollzeitraum zwischen 0 und 1 und testen Sie die Interaktion zwischen Start- und Endpunkt.
  • Fügen Sie nur die LoRAs hinzu, die für das gewünschte Ergebnis benötigt werden, und stimmen Sie jede Skala sorgfältig ab.
  • Überprüfen Sie vor der Lieferung Struktur, Zuschnitt, Gesichter, Hände, Text und Stilkonsistenz.

Verwandte Modelle#


  • Verwenden Sie Z Image Turbo LoRA, wenn eine Strukturkontrolle nicht erforderlich ist.
  • Verwenden Sie Z Image Turbo Text to Image für die Generierung ohne Kontrollbild.

Verwandte Modelle

seedream-5/lite/text-to-image

Seedream 5.0 Lite Text-zu-Bild: Prompt-zu-Visual-Engine mit präziser Layout- und Typografie-Kontrolle

stepx-edit2

Bearbeiten Sie ein Quellbild per Textanweisung – mit optionalem negativem Prompt, Seed, Denk- und Reflexionsmodus sowie JPEG- oder PNG-Ausgabe.

z-image/turbo/text-to-image/lora

Erstellen Sie Bilder aus Text mit bis zu drei LoRA-Adaptern und einstellbaren Abmessungen, Gewichten und Seed.

seedream-4-5/text-to-image

Erzeugen Sie ein Bild ausschließlich aus einem Text-Prompt und wählen Sie zwischen 2K, 4K und neun festen Größen.

gemini-3-pro-image-preview/text-to-image

Erzeugen Sie anhand eines Pflicht-Prompts 1 bis 4 Bilder. Zur Auswahl stehen 10 Seitenverhältnisse, 1K-, 2K- oder 4K-Auflösung, drei Dateiformate und eine optionale synchrone Rückgabe.

flux-2/dev/edit

Bearbeiten Sie bis zu drei Quellbilder und steuern Sie Guidance-Stärke, Inferenzschritte, Bildanzahl, Prompt-Erweiterung, Größe, Seed und Format.

Häufig gestellte Fragen

Können Z Image Turbo ControlNet-Ergebnisse kommerziell genutzt werden?

Die kommerzielle Nutzung hängt von den aktuellen Modell-, LoRA- und RunComfy-Bedingungen sowie von Ihren Rechten am Eingabebild, am Prompt und am resultierenden Asset ab. Überprüfen Sie vor der produktiven Nutzung alle geltenden Lizenzen.

Welche Parameter steuern die Struktur auf dieser Seite?

Wählen Sie die Vorverarbeitung aus none, canny, depth oder pose. control_scale, control_start und control_end akzeptieren jeweils Werte von 0 bis 1 und steuern die Stärke und den Zeitpunkt der Konditionierung.

Wie viele Inferenzschritte und Ausgabeformate stehen zur Verfügung?

num_inference_steps akzeptiert 1 bis 8 und ist standardmäßig auf 8 eingestellt. output_format akzeptiert jpeg, png oder webp und ist standardmäßig auf png eingestellt.

Wie kann ich das Ergebnis mit LoRAs anpassen?

loras akzeptiert höchstens drei Einträge. Jeder Eintrag bietet einen Pfad und eine Skala von 0 bis 4, mit einer Standardskala von 1. Verwenden Sie nur LoRAs, deren Lizenzen und Verhalten Sie überprüft haben.

Wie viel kostet dieser Workflow?

Preise und Werbeaktionen werden in diesem Inhaltsschema nicht gespeichert und können sich ändern. Überprüfen Sie die von RunComfy angezeigten aktuellen Kreditkosten, bevor Sie eine Anfrage senden.

Was sollte ich angeben, wenn ich um Unterstützung bitte?

Notieren Sie die Prompt, den Vorverarbeitungsmodus, die Steuerungseinstellungen, LoRA-Pfade und -Skalen, die Bildgrößenvoreinstellung, die Inferenzschritte, den Seed und das Ausgabeformat. Entfernen Sie private Eingabe-URLs oder Anmeldeinformationen, bevor Sie Diagnosedetails weitergeben.

Folge uns
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Support
  • Discord
  • E-Mail
  • Systemstatus
  • Partner
Videomodelle
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Alle Modelle anzeigen →
Bildmodelle
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Alle Modelle anzeigen →
Rechtliches
  • Nutzungsbedingungen
  • Datenschutzrichtlinie
  • Cookie-Richtlinie
RunComfy
Urheberrecht 2026 RunComfy. Alle Rechte vorbehalten.

RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.