logo
RunComfy
  • ComfyUI
  • TrainerNeu
  • Modelle
  • API
  • Preise
discord logo
MODELLE
Erkunden
Alle Modelle
BIBLIOTHEK
Generierungen
MODELL-APIS
API-Dokumentation
API-Schlüssel
KONTO
Nutzung

Wan 2.6 Text to Image: Referenzgestützte Bildgenerierung aus Prompts | RunComfy

wan-ai/wan-2-6/text-to-image

Erzeugen Sie hochwertige, referenzgestützte Bilder aus Textprompts – mit präziser Kontrolle über Stil und Motividentität für Markenvisuals, Anzeigen und E-Commerce-Produktfotos.

Der Prompt muss kürzer als 2.000 Zeichen sein.
Optionales Referenzbild. Unterstützte Formate: JPEG, JPG, PNG (ohne Alphakanal), BMP und WEBP. Kantenlänge: 384–5.000 px. Maximale Dateigröße: 10 MB.
Beschreiben Sie Inhalte, die im erzeugten Bild nicht erscheinen sollen.
Maximale Anzahl der zu erzeugenden Bilder. Die tatsächliche Anzahl bestimmt das Modell; sie kann unter dem eingestellten Wert liegen. Bei einem Wert von 5 können je nach Inhalt beispielsweise nur 3 Bilder entstehen.
Idle
The rate is $0.017 per image.

Einführung in Wan 2.6 Text to Image

Wan AI Wan 2.6 Text to Image verwandelt Prompts für $0.015 pro Bild in produktionsreife Visuals. Eine optionale Referenz hilft dabei, Stil, Motividentität und Markenmerkmale gezielt zu steuern. So lassen sich aufwendige Stock-Suchen, Maskierungen und manuelle Retuschen durch einen konsistenten, referenzbasierten Kreativprozess ersetzen. Das Modell richtet sich an Marketingverantwortliche, Creative Directors und E-Commerce-Teams. Auf RunComfy steht Wan 2.6 Text to Image sowohl im Browser als auch per HTTP-API bereit – Hosting und Skalierung übernimmt RunComfy.
Ideal für: Conversion-starke Werbemittel | Produkt-Hero-Images | Storyboard-Keyframes

Wan 2.6 Text to Image: Modellübersicht#


  • Anbieter: Alibaba Cloud
  • Aufgabe: text-to-image
  • Unterstützte Bildgrößen: 1024×1024, 800×1200, 1200×800, 960×1280, 1280×960, 720×1280, 1280×720 und 1344×576 px
  • Kurzfassung: Wan 2.6 Text to Image erzeugt aus natürlichsprachlichen Prompts hochwertige Bilder und kann ein optionales Referenzbild für Stil, Motividentität oder Bearbeitungen einbeziehen. Im Mittelpunkt stehen eine genaue Prompt-Umsetzung, realistische Texturen und stabile Kompositionen.

Wichtigste Funktionen von Wan 2.6 Text to Image#


Referenzgestützte Identitäts- und Stilkontrolle mit Wan 2.6 Text to Image#

  • Ein optionales Bild dient als visuelle Referenz, während der Prompt die gewünschte Gestaltung beschreibt.
  • Charakter- und Markenelemente lassen sich über mehrere Generierungen hinweg konsistenter halten.

Detailreiche, promptgetreue Darstellung mit Wan 2.6 Text to Image#

  • Verarbeitet detaillierte Vorgaben zu Motiv, Stil, Licht, Stimmung und Bildaufbau auf Englisch oder Chinesisch.
  • Liefert nachvollziehbare Szenenaufteilungen und realistische Texturen für E-Commerce, Marketing und redaktionelle Inhalte.

Text- und Bild-Workflows mit Wan 2.6 Text to Image#

  • Kombiniert Text mit einem Referenzbild für gezielte Variationen und Überarbeitungen.
  • Negative Prompts helfen dabei, unerwünschte Objekte, Farben oder Artefakte auszuschließen.

Eingabeparameter für Wan 2.6 Text to Image#


Prompts#

ParameterTypStandard/GrenzenBeschreibung
promptstringWeniger als 2.000 ZeichenHauptbeschreibung des gewünschten Bildes. Formulieren Sie Motiv, Stil, Licht, Stimmung und Komposition möglichst konkret.
negative_promptstringMax. 500 ZeichenUnerwünschte Merkmale oder Inhalte, die vermieden werden sollen.

Referenz#

ParameterTypStandard/GrenzenBeschreibung
image_urlimage_uriOptional; JPEG/JPG/PNG ohne Alpha/BMP/WEBP; 384–5.000 px je Seite; max. 10 MBReferenzbild für Stil, Identität oder Bearbeitungen.

Ausgabe und Reproduzierbarkeit#

ParameterTypStandard/GrenzenBeschreibung
image_sizestringStandard: 1024*1024 (1:1); 8 feste GrößenWählen Sie 10241024 (1:1), 8001200 (2:3), 1200800 (3:2), 9601280 (3:4), 1280960 (4:3), 7201280 (9:16), 1280720 (16:9) oder 1344576 (21:9).
max_imagesintegerStandard: 1; Bereich: 1–5Obergrenze der Bildanzahl; das Modell kann weniger Bilder ausgeben.
seedintegerStandard: 0; Bereich: 0–2147483647Ein fester Seed unterstützt reproduzierbare Ergebnisse.

Vergleich mit anderen Modellen#


  • Gegenüber Flux 2: Wan 2.6 Text to Image verbindet Textgenerierung und Referenzsteuerung in einem Workflow. Es eignet sich besonders, wenn Motividentität und Bearbeitbarkeit wichtig sind. Flux 2 Dev ist derzeit auf RunComfy kostenlos.
  • Gegenüber Z-Image-Turbo: Wan 2.6 Text to Image priorisiert Referenztreue und logische Komposition bei komplexen Prompts statt maximaler Geschwindigkeit.
  • Gegenüber Nano Banana Pro: Wan 2.6 Text to Image kombiniert Referenzsteuerung mit stabilen Überarbeitungen und eignet sich für identitätsbasierte Kampagnen.
  • Idealer Einsatz: Markenvisuals, Anzeigen und E-Commerce-Bilder, bei denen Stil, Motividentität und wiederholbare Bearbeitungsabläufe entscheidend sind.

API-Integration#


Über die RunComfy-API lässt sich Wan 2.6 Text to Image mit normalen HTTP-Anfragen einbinden. Übermitteln Sie Prompt, optionales Referenzbild und Bildgröße, um den Ablauf in CI/CD- oder Kreativ-Pipelines zu automatisieren.


Hinweis: API-Endpunkt für Wan 2.6 Text to Image


Offizielle Ressourcen und Lizenz#


  • Alibaba Cloud: Wan 2.6 Series
  • Alibaba Cloud Model Studio: Modelle
  • Wan: Offizielle Website
  • Lizenz: Proprietäres, über Alibaba Cloud Model Studio bereitgestelltes Modell. Für die kommerzielle Nutzung gelten die Bedingungen von Alibaba Cloud; je nach Region und Bereitstellung kann eine gesonderte Vereinbarung nötig sein. Kostenlose Nutzer erhalten keine kommerzielle Lizenz.

Verwandte Funktionen#


Für Bewegung und Storytelling verwenden Sie Wan 2.6 Text to Video: https://www.runcomfy.com/models/wan-ai/wan-2-6/text-to-video


Zum Animieren eines vorhandenen Bildes verwenden Sie Wan 2.6 Image to Video: https://www.runcomfy.com/models/wan-ai/wan-2-6/image-to-video


Verwandte Modelle

wan-2.7/pro/text-to-image

WAN 2.7 Pro Text-to-Image erzeugt besonders detailreiche Standbilder für Druck und Großformat. Die Bedienung entspricht der Standardversion: zweisprachige Prompts und bis zu fünf Bilder pro Durchlauf.

wan-2-5/text-to-image

Generieren Sie ein Bild aus einer erforderlichen Eingabeaufforderung mit weniger als 2000 Zeichen. Fügen Sie optional eine negative Eingabeaufforderung hinzu und wählen Sie aus 13 Ausgabegrößen.

grok-2/image

Erzeugen Sie aus einem Text-Prompt ein bis zehn Bilder pro Anfrage.

nano-banana-2-lite/text-to-image

Schnelle, kostengünstige text-to-image-Generierung mit fester 1K-Auflösung.

flux-1-schnell/text-to-image

Schnelle Text-zu-Bild-KI mit detailreicher Ausgabe in wenigen Schritten

qwen-edit-2509/lora/multiple-angles

Ändern Sie anhand eines Pflicht-Prompts den Kamerawinkel eines Quellbilds oder bearbeiten Sie es anderweitig. Einstellbar sind sechs Ausgabegrößen, Inferenzschritte, Guidance-Skala, 1 bis 4 Ergebnisse sowie JPEG- oder PNG-Ausgabe.

Häufig gestellte Fragen

Welche Hauptfunktionen bietet Wan 2.6 Text to Image?

Wan 2.6 Text to Image erzeugt hochwertige Standbilder aus Textprompts. Optional können Sie ein Referenzbild verwenden, um Stil, Motividentität oder eine gewünschte Bearbeitung genauer zu steuern. Der Schwerpunkt liegt auf Prompttreue, realistischen Texturen und stabilen Kompositionen.

Wie unterscheidet sich Wan 2.6 Text to Image von Flux 2 oder Nano Banana Pro?

Wan 2.6 Text to Image verbindet Text-zu-Bild-Generierung und optionale Referenzsteuerung in einem Workflow. Es eignet sich besonders für Projekte, in denen visuelle Identität, Markenmerkmale und gezielte Überarbeitungen wichtiger sind als eine reine Einzelbildgenerierung ohne Referenz.

Welche Auflösungen und Seitenverhältnisse unterstützt Wan 2.6 Text to Image?

Zur Auswahl stehen 1024×1024 (1:1), 800×1200 (2:3), 1200×800 (3:2), 960×1280 (3:4), 1280×960 (4:3), 720×1280 (9:16), 1280×720 (16:9) und 1344×576 (21:9). Andere oder frei definierte Größen bietet diese Oberfläche nicht an.

Welche Eingabegrenzen gelten für Wan 2.6 Text to Image?

Der Prompt muss kürzer als 2.000 Zeichen sein, der negative Prompt darf höchstens 500 Zeichen umfassen. Das optionale Referenzbild muss JPEG, JPG, PNG ohne Alphakanal, BMP oder WEBP sein, 384 bis 5.000 Pixel je Seite messen und darf maximal 10 MB groß sein.

Wie wechsle ich vom Test in RunComfy zur produktiven API-Nutzung?

Nach dem Test im RunComfy-Modellinterface können Sie denselben Ablauf über den Wan 2.6 Text to Image API-Endpunkt mit Ihrem API-Schlüssel aufrufen. Übermitteln Sie Prompt, optionales Referenzbild und Bildgröße per HTTP. Auf dieser Seite ist der Preis mit $0.015 pro Bild angegeben; stellen Sie vor dem Aufruf sicher, dass Ihr Konto über Guthaben verfügt.

Wie unterstützt Wan 2.6 Text to Image eine konsistente visuelle Identität?

Das optionale Referenzbild gibt Motivmerkmale und Stil vor, während der Prompt die gewünschte Szene beschreibt. Klare, unveränderte Angaben und dieselbe Referenz verbessern die Konsistenz; eine vollkommen identische Ausgabe bei jeder Generierung ist jedoch nicht garantiert.

Erzeugt Wan 2.6 Text to Image Audio oder Video?

Nein. Dieses Modell erzeugt ausschließlich Standbilder. Für Videos verwenden Sie Wan 2.6 Text to Video oder Wan 2.6 Image to Video; Audio- und Lippen-Synchronisation gehören nicht zu den Funktionen dieses Text-zu-Bild-Endpunkts.

Dürfen Ausgaben von Wan 2.6 Text to Image kommerziell genutzt werden?

Das Modell wird unter den Bedingungen von Alibaba Cloud Model Studio bereitgestellt. Die kommerzielle Nutzung hängt von diesen Bedingungen, Ihrer Region und Ihrem Vertrag ab; kostenlose Nutzer erhalten laut Modellseite keine kommerzielle Lizenz. Prüfen Sie vor einer Veröffentlichung stets die aktuellen Lizenzbedingungen.

Kann Wan 2.6 Text to Image mehrere Bilder mit konsistentem Ergebnis erzeugen?

Mit max_images lässt sich eine Obergrenze von 1 bis 5 Bildern setzen, wobei das Modell auch weniger Bilder zurückgeben kann. Ein fester seed im Bereich 0 bis 2147483647 erleichtert die Reproduktion, garantiert aber keine pixelidentische Serie.

Eignet sich Wan 2.6 Text to Image für mobile und soziale Formate?

Ja. Für Hochformat-Inhalte stehen 720×1280 (9:16), 800×1200 (2:3) und 960×1280 (3:4) bereit. Für quadratische oder breite Assets können Sie 1:1, 4:3, 3:2, 16:9 oder 21:9 wählen.

Folge uns
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Support
  • Discord
  • E-Mail
  • Systemstatus
  • Partner
Videomodelle
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Alle Modelle anzeigen →
Bildmodelle
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Alle Modelle anzeigen →
Rechtliches
  • Nutzungsbedingungen
  • Datenschutzrichtlinie
  • Cookie-Richtlinie
RunComfy
Urheberrecht 2026 RunComfy. Alle Rechte vorbehalten.

RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.

Beispiele für Wan 2.6 Text to Image