Génération et retouche d’images avec maîtrise de la mise en page et des calques
| Paramètre | Type | Valeur par défaut/plage | Description |
|---|---|---|---|
| prompt | string | "" | Instruction en langage naturel décrivant la retouche. Précisez clairement ce qui doit changer et ce qui doit rester intact. |
| negative_prompt | string | "" | Éléments à éviter dans le résultat, par exemple « sans flou » ou « sans filigrane ». |
| Paramètre | Type | Valeur par défaut/plage | Description |
|---|---|---|---|
| image_urls | array (image URIs) | [] | Jusqu’à 10 images d’entrée. La première sert de base à modifier ; les suivantes guident le style ou la composition. |
| Paramètre | Type | Valeur par défaut/plage | Description |
|---|---|---|---|
| image_size | string | square; presets: square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3, landscape_16_9 | Sélectionnez l’un des rapports d’aspect prédéfinis. |
| num_inference_steps | integer | 28 | Nombre d’étapes de diffusion. Une valeur plus élevée peut améliorer les détails ; une valeur plus faible accélère la génération. |
| guidance_scale | float | 4.5 | Intensité avec laquelle le résultat suit le prompt. Une valeur élevée respecte plus strictement l’instruction, mais peut réduire la liberté créative. |
| output_format | string | png; options: jpeg, png, webp | Format de l’image de sortie. Choisissez-le selon les besoins des étapes suivantes. |
Les développeurs peuvent utiliser Qwen Image Edit 2511 dans l’API RunComfy au moyen de requêtes HTTP standard. Envoyez les images de base avec prompt et negative_prompt, puis ajustez num_inference_steps, guidance_scale, seed et output_format pour obtenir des retouches cohérentes et détaillées. L’automatisation REST permet de l’intégrer directement aux pipelines de production.
Remarque : endpoint API de Qwen Image Edit 2511
Génération et retouche d’images avec maîtrise de la mise en page et des calques
Flux 2 Flash Edit modifie jusqu’à quatre images de référence à partir d’instructions claires, avec un contrôle précis du format et de la sortie.
Générez des visuels précis et réalistes à partir de texte en un instant
Appliquez des modifications guidées par prompt dans une scène et réglez taille, étapes, guidage, variantes, format et seed.
Créez des visuels de marque avec texte et logos intégrés précis.
Modifiez de 1 à 14 images de référence par instruction textuelle et paramétrez jusqu’à 15 sorties.
Qwen Image Edit 2511 est un modèle d’édition d’images doté de 20 milliards de paramètres, axé sur la cohérence et la précision géométrique. Il préserve mieux l’identité d’une ou de plusieurs personnes, améliore la fidélité du texte modifié et intègre directement des styles LoRA communautaires au modèle de base. Il se distingue ainsi des versions antérieures de Qwen, comme 2509.
La résolution de sortie maximale prise en charge est d’environ 4096×4096 pixels par retouche, avec jusqu’à trois images de référence. Le prompt est limité à environ 1 024 tokens. Au-delà de ces limites, les appels API peuvent être tronqués ou faire l’objet d’un redimensionnement automatique.
Oui. Une tâche d’édition peut utiliser jusqu’à trois images sources pour combiner ou transformer des sujets et des produits. Le modèle fusionne les détails au moyen d’un conditionnement proche de ControlNet et d’adaptateurs parallèles, ce qui améliore la cohérence entre les références.
Commencez par prototyper Qwen Image Edit 2511 dans l’interface web de la page du modèle RunComfy. Générez ensuite une clé d’accès depuis le tableau de bord de votre compte pour automatiser via l’API le même prompt et les mêmes paramètres de contrôle. La section « Intégration API » de la documentation RunComfy détaille le passage à l’échelle en production.
Qwen Image Edit 2511 maintient mieux la structure, notamment pour le design industriel, les produits et les retouches riches en texte. Seedream 4.5 excelle dans l’agrandissement artistique et la stylisation ; Qwen Image Edit 2511 préserve plus sûrement le texte, la géométrie et l’identité au fil de plusieurs modifications.
Nano Banana Pro peut être légèrement meilleur pour un éclairage extrêmement photoréaliste et de petites modifications décrites par un prompt court. Qwen Image Edit 2511 réduit toutefois l’écart grâce à une dérive moindre et une meilleure cohérence entre plusieurs personnes. Il est particulièrement performant pour les transformations structurelles et les travaux exigeant une typographie fidèle.
L’accès est soumis aux conditions des modèles hébergés de RunComfy. Avant toute exploitation commerciale des images produites, les développeurs doivent également consulter la licence d’origine d’Alibaba ou de Tongyi-Lab, notamment les règles d’attribution et celles concernant les œuvres dérivées.
L’éditeur préserve la géométrie de la scène tout en permettant d’insérer des objets, de remplacer l’arrière-plan ou d’harmoniser l’éclairage. Il convient donc au commerce électronique, aux itérations de design et aux campagnes qui nécessitent une identité visuelle cohérente.
Son pipeline à double encodage aligne directement les embeddings sémantiques sur les caractéristiques visuelles du VAE. Les visages ou éléments de marque varient ainsi moins entre les passages d’édition, et le sujet reste plus fidèle que dans les variantes Qwen précédentes.
Lorsqu’il modifie ou remplace du texte, le modèle cherche à conserver la police, la taille et le style d’origine. Il obtient ainsi un alignement typographique très précis, particulièrement utile aux équipes UI/UX et de design graphique.
RunComfy est la première ComfyUI plateforme, offrant des ComfyUI en ligne environnement et services, ainsi que des workflows ComfyUI proposant des visuels époustouflants. RunComfy propose également AI Models, permettant aux artistes d'utiliser les derniers outils d'IA pour créer des œuvres d'art incroyables.






