Edite uma imagem obrigatória com uma instrução de texto obrigatória, expansão de prompt, duas resoluções, semente e formatos de saída.
| Parâmetro | Tipo | Padrão/faixa | Descrição |
|---|---|---|---|
| prompt | string | "" | Instrução em linguagem natural que descreve a edição. Informe claramente o que deve mudar e o que deve ser preservado. |
| negative_prompt | string | "" | Elementos que devem ser evitados no resultado, por exemplo, “sem desfoque” ou “sem marca-d’água”. |
| Parâmetro | Tipo | Padrão/faixa | Descrição |
|---|---|---|---|
| image_urls | array (image URIs) | [] | Até 10 imagens de entrada. A primeira é a base a ser editada; as demais orientam o estilo ou a composição. |
| Parâmetro | Tipo | Padrão/faixa | Descrição |
|---|---|---|---|
| image_size | string | square; presets: square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3, landscape_16_9 | Selecione uma das proporções de imagem predefinidas. |
| num_inference_steps | integer | 28 | Número de etapas de difusão. Um valor maior pode melhorar os detalhes; um valor menor acelera a geração. |
| guidance_scale | float | 4.5 | Intensidade com que o resultado segue o prompt. Valores altos obedecem à instrução com mais rigor, mas podem reduzir a liberdade criativa. |
| output_format | string | png; options: jpeg, png, webp | Formato da imagem de saída. Escolha de acordo com as etapas seguintes do fluxo de trabalho. |
Desenvolvedores podem usar Qwen Image Edit 2511 na RunComfy API por meio de solicitações HTTP padrão. Envie as imagens-base com prompt e negative_prompt e ajuste num_inference_steps, guidance_scale, seed e output_format para obter edições consistentes e detalhadas. A automação baseada em REST permite incorporar o modelo a fluxos de produção.
Observação: endpoint da API do Qwen Image Edit 2511
Edite uma imagem obrigatória com uma instrução de texto obrigatória, expansão de prompt, duas resoluções, semente e formatos de saída.
Edição orientada por referências com controle de layout, separação em camadas e texto multilíngue
Edição de imagem GPT Image 2 da OpenAI: edições de imagem para imagem com controle de texto preciso e pintura de entrada e saída
Modelo avançado para gerar imagens com controle preciso e edição ágil.
Gere imagens a partir de texto e combine até três adaptadores LoRA com pesos independentes.
Gere de 1 a 4 imagens a partir de um prompt obrigatório, com 10 proporções, resolução 1K, 2K ou 4K, três formatos de arquivo e retorno síncrono opcional.
Qwen Image Edit 2511 é um modelo de edição de imagens com 20 bilhões de parâmetros, voltado para consistência e precisão geométrica. Ele preserva melhor a identidade de uma ou várias pessoas, aumenta a fidelidade na edição de texto e integra estilos LoRA da comunidade diretamente ao modelo-base. Esses avanços o diferenciam de versões anteriores do Qwen, como a 2509.
A resolução máxima de saída é de aproximadamente 4096×4096 pixels por edição, com até três imagens de referência. O prompt é limitado a cerca de 1.024 tokens. Chamadas de API acima desses limites podem ser truncadas ou redimensionadas automaticamente.
Sim. Uma tarefa de edição pode usar até três imagens de origem para combinar ou transformar pessoas e produtos. O modelo reúne os detalhes com condicionamento semelhante ao ControlNet e adaptadores paralelos, melhorando a consistência entre todas as referências.
Primeiro, crie um protótipo com Qwen Image Edit 2511 na interface web da página do modelo RunComfy. Depois, gere uma chave de acesso no painel da sua conta e automatize pela API o mesmo prompt e os mesmos parâmetros de controle. A seção “Integração de API” da documentação do RunComfy explica como dimensionar o fluxo para produção.
Qwen Image Edit 2511 mantém a estrutura mais estável, especialmente em design industrial, produtos e edições com muito texto. Seedream 4.5 se destaca em ampliações artísticas e estilização; Qwen Image Edit 2511 preserva melhor texto, geometria e identidade ao longo de várias edições.
Nano Banana Pro pode ter pequena vantagem em iluminação extremamente fotorrealista e mudanças discretas descritas por prompts curtos. Qwen Image Edit 2511 reduz essa diferença com menor desvio e melhor consistência entre várias pessoas. Ele se destaca especialmente em transformações estruturais e trabalhos que exigem fidelidade tipográfica.
O acesso está sujeito aos termos de modelos hospedados do RunComfy. Antes de usar comercialmente as imagens produzidas, os desenvolvedores também devem consultar a licença original da Alibaba ou Tongyi-Lab, especialmente as regras de atribuição e obras derivadas.
O editor preserva a geometria da cena e permite inserir objetos, substituir o fundo ou tornar a iluminação mais consistente. Por isso, é útil para comércio eletrônico, iterações de design e campanhas que precisam manter uma identidade visual uniforme.
Seu pipeline de codificação dupla alinha diretamente os embeddings semânticos aos recursos visuais do VAE. Assim, rostos e elementos de marca variam menos entre as etapas de edição, e o sujeito permanece mais fiel do que nas variantes anteriores do Qwen.
Ao editar ou substituir texto, o modelo procura preservar a fonte, o tamanho e o estilo originais. Dessa forma, obtém um alinhamento tipográfico muito preciso, especialmente útil para equipes de UI/UX e design gráfico.
RunComfy é a principal ComfyUI plataforma, oferecendo ComfyUI online ambiente e serviços, juntamente com fluxos de trabalho do ComfyUI apresentando visuais impressionantes. RunComfy também oferece AI Models, permitindo que artistas utilizem as mais recentes ferramentas de AI para criar arte incrível.






