Retouche guidée par références avec mise en page précise, séparation des calques et texte multilingue
Ce modèle compact de distillation peut à la fois créer une nouvelle image à partir d'un texte et réviser des photos que vous possédez déjà. Un ensemble de poids Qwen Image 2.1 couvre la génération d'images à partir de texte et d'images à partir d'images, à 1K ou 2K, avec une transparence native optionnelle.
La génération uniquement par invite ne nécessite aucun téléchargement. L’édition ajoute de une à dix images de référence plus une instruction. Cette page exécute le flux de travail de référence Qwen Image 2.1 ; une page sœur exécute la génération uniquement par invite.
Des tâches plus larges fonctionnent également avec Qwen Image 2.1 : transformer un selfie en panorama, transformer une photo de produit en infographie, ou construire un storyboard à partir d'une fiche de personnage en trois vues.
Sur cette page, Qwen Image 2.1 exécute image à image. Texte à image utilise la même résolution, le même rapport, le même arrière-plan, le même format, la même réécriture de prompt et les mêmes choix de graine, sans images de référence ni masque.
| Paramètre | Obligatoire | Type | Défaut | Plage / Options | Description |
|---|---|---|---|---|---|
image_urls* | Oui (*) | Tableau | Image exemple | 1–10 images | Images de référence dans l'ordre des instructions. JPEG, PNG ou WebP; chaque fichier jusqu'à 30 Mo et 25 MP. Limitez à quatre ou moins lorsque l'identité doit rester nette. |
prompt* | Oui (*) | Chaîne | Instruction exemple | Jusqu'à 5 000 caractères | Décrivez le nouveau plan fixe ou la modification. Citez tout texte présent sur l'image. Avec un masque, décrivez ce qui doit apparaître dans la zone blanche. |
mask_url | Non | Chaîne (image) | — | Optionnel | Masque d'édition locale en noir et blanc. Le blanc modifie, le noir reste. Nécessite exactement une référence. Le rapport d'aspect et la réécriture de l'instruction sont ignorés. Ne peut pas être utilisé avec un fond transparent. |
aspect_ratio | Non | Chaîne | auto | auto, 1:1, 4:3, 3:4, 3:2, 2:3, 16:9, 9:16, 21:9, 9:21 | auto se cale sur la première référence. Ignoré en mode masque. Par défaut, le texte-à-image est 1:1. |
resolution | Non | Chaîne | 1K | 1K, 2K | 1K est plus rapide ; 2K a environ quatre fois plus de pixels et prend plus de temps, surtout avec des références. |
background | Non | Chaîne | opaque | opaque, transparent | transparent crée un vrai canal alpha pour de nouvelles images fixes ou découpées. Décrivez uniquement le sujet. Ne peut pas être utilisé avec JPEG. |
output_format | Non | Chaîne | png | png, webp, jpeg | PNG et WebP peuvent contenir de l'alpha. JPEG ne peut pas. |
enhance_prompt | Non | Booléen | true | true, false | Réécrit un court prompt avant la génération ou l'édition. Désactivez-le lorsqu'il est déjà exact. Ignoré en mode masque. |
seed | Non | Entier | -1 | -1 ou 0–2147483647 | Fixer une graine pour reproduire un résultat ; utiliser -1 pour une nouvelle variation. |
Sur cette page image-à-image, Qwen Image 2.1 est $0.029 par image 1K et $0.119 par image 2K. Text-to-image est $0.020 par image 1K et $0.079 par image 2K sur sa propre page. Les références supplémentaires n'ajoutent pas de supplément indiqué. Pour un lot, multipliez le tarif du niveau sélectionné par le nombre de résultats.
Qwen Image 2.1 accepte des invites mixtes en chinois et en anglais. Les noms concrets et courts sont meilleurs que de longues planches d'ambiance.
Si Qwen Image 2.1 n'est pas le bon point de départ, comparez ces modèles sur RunComfy :
Retouche guidée par références avec mise en page précise, séparation des calques et texte multilingue
Modifiez 1 à 10 images sources à partir d’un prompt obligatoire et appliquez, si nécessaire, jusqu’à trois entrées LoRA. Choisissez parmi six tailles de sortie et réglez les étapes d’inférence, le guidage, 1 à 4 résultats, la graine ainsi qu’une sortie Default, JPEG ou PNG.
Modifiez une image requise à partir d'une instruction textuelle requise avec FLUX Kontext Pro, une graine et neuf options de rapport hauteur/largeur.
Retouchez les détails de la peau dans une seule image et réglez taille, étapes, guidage, variantes, format et seed.
Créez des visuels 4K précis et expressifs grâce à l'édition IA avancée.
Retouchez ou transformez jusqu’à 20 images de référence avec un prompt, puis choisissez le nombre, le format, le ratio et la résolution.
Qwen Image 2.1 révise des photos à partir d'instructions écrites tout en conservant l'identité, la forme du produit et la mise en page. Les travaux typiques incluent les échanges d'arrière-plan, l'essayage virtuel, les composites de groupe, la retouche locale et les découpes de produits en transparence.
Vous pouvez télécharger de une à dix images de référence. Qwen Image 2.1 les lit dans l'ordre du tableau, donc « la première image » et « la deuxième image » dans l'invite correspondent à cette liste. Gardez le nombre à quatre ou moins lorsque les visages ou les logos doivent rester nets.
Oui. Réglez l'arrière-plan sur transparent afin que Qwen Image 2.1 écrive un vrai canal alpha, ou demandez-lui de détacher un sujet d'une photo RGB normale sur un calque transparent. Utilisez PNG ou WebP; JPEG ne peut pas transporter l'alpha, et un masque ne peut pas être combiné avec un arrière-plan transparent.
Qwen Image 2.1 peut suivre des cercles, des marques peintes ou un masque noir et blanc séparé (le blanc change, le noir reste). Le mode masque nécessite exactement une référence, suit le ratio de cette image et ignore le ratio et la réécriture du prompt. Décrivez ce qui devrait apparaître dans la zone blanche.
Qwen Image 2.1 offre une sortie 1K ou 2K et des ratios d'aspect incluant auto, 1:1, 4:3, 3:4, 3:2, 2:3, 16:9, 9:16, 21:9 et 9:21. auto s'ajuste à la première référence. Vérifiez le panneau du paramètre RunComfy actuel pour les options exactes.
Oui. Les mêmes poids Qwen Image 2.1 gèrent le texte-à-image et l'image-à-image. Cette page est le flux de travail Modifier / référence ; une page séparée texte-à-image génère à partir d'un prompt sans télécharger de photos.
Oui. Prototypiez une modification dans l'interface utilisateur du modèle RunComfy, puis appelez le même modèle Qwen Image 2.1 via le RunComfy HTTP API avec des paramètres identiques. Vous n'avez pas besoin d'héberger ou de mettre à l'échelle le modèle vous-même.
Les générations consomment des USD ou des crédits. Qwen Image 2.1 est facturé $0.029 par image générée 1K et $0.119 par image générée 2K. Les références supplémentaires n'ajoutent pas de surcharge indiquée sur cette page ; les nouveaux utilisateurs reçoivent généralement un montant d'essai gratuit pour tester.
RunComfy est la première ComfyUI plateforme, offrant des ComfyUI en ligne environnement et services, ainsi que des workflows ComfyUI proposant des visuels époustouflants. RunComfy propose également AI Models, permettant aux artistes d'utiliser les derniers outils d'IA pour créer des œuvres d'art incroyables.





