Edição de imagem GPT Image 2 da OpenAI: edições de imagem para imagem com controle de texto preciso e pintura de entrada e saída
FLUX 3 é o próximo modelo unificado da Black Forest Labs, criado para aprender com imagens, vídeo e áudio dentro de uma única arquitetura. Esta página se concentra na geração de imagens e antecipa como será usar FLUX 3 Image no trabalho diário.
Observação: FLUX 3 Image estará disponível em breve. Esta página apresenta uma prévia da experiência enquanto a Black Forest Labs finaliza o modelo público e a API.
O principal avanço desta versão é um conjunto mais robusto de recursos essenciais, e FLUX 3 Image coloca cinco deles em evidência:
Imagens de referência podem orientar qualquer um desses recursos, definindo identidade, composição e direção visual para manter os resultados alinhados à marca.
Estas recomendações ajudam a obter resultados previsíveis durante a prévia do FLUX 3 Image:
A comparação mais justa do FLUX 3 Image considera a qualidade do resultado e os recursos oferecidos. A Black Forest Labs afirma que FLUX 3 já representa um salto significativo em relação às versões anteriores do FLUX nas duas áreas que mais influenciam resultados reais: seguir prompts complexos e renderizar com precisão textos multilíngues dentro da imagem. O modelo também consegue gerar e editar imagens em uma ampla variedade de estilos, proporções e resoluções. Como ainda está em acesso antecipado, as observações abaixo confrontam os recursos anunciados com aquilo que cada modelo comprovadamente faz hoje.
A Black Forest Labs está lançando FLUX 3 AI como uma única base multimodal com várias edições, cada uma disponibilizada em etapas após seu próprio período de acesso antecipado. Segundo o plano oficial de lançamento:
A Black Forest Labs confirmou que pretende disponibilizar pesos abertos. Quando a base FLUX 3 Dev estiver disponível, o próximo passo natural será um fluxo de trabalho comunitário com FLUX 3 LoRA, incluindo o fine-tuning de FLUX 3 dev LoRA para estilos personalizados, personagens e identidades de marca, repetindo o amplo ecossistema de LoRA criado em torno das versões anteriores do FLUX.
Para a maioria das equipes de produção, FLUX 3 Image cobrirá a geração diária, enquanto FLUX 3 Dev e FLUX 3 dev LoRA abrirão caminho para personalização com hospedagem própria.
Em resumo, FLUX 3 Image estará disponível em breve no RunComfy: uma única base multimodal que transforma prompts e referências visuais em imagens de alta fidelidade, com tipografia legível e controle preciso do layout.
Edição de imagem GPT Image 2 da OpenAI: edições de imagem para imagem com controle de texto preciso e pintura de entrada e saída
Edite uma imagem de origem com um prompt obrigatório, máscara opcional, 2 a 50 etapas de inferência, resolução 480p ou 720p, controle da semente e três formatos de saída.
Gere com o FLUX1.1 Pro imagens detalhadas, bem compostas e fiéis ao prompt.
Gere de uma a dez imagens por solicitação a partir de um prompt de texto.
Geração de imagens rápida e fiel ao texto para uso criativo e pro
WAN 2.7 texto para imagem: compreensão precisa de prompts, tamanhos flexíveis e até cinco imagens por solicitação
FLUX 3 Image estará disponível em breve. Esta prévia permite conhecer a experiência do FLUX 3 Image enquanto a Black Forest Labs finaliza o modelo multimodal unificado e sua API. Até que a infraestrutura do FLUX 3 seja ativada, os campos de entrada e os limites exibidos refletem o modelo que atualmente alimenta esta prévia.
FLUX 3 Image foi criado para transformar prompts detalhados e referências visuais em imagens de alta fidelidade, com texto legível dentro da imagem e controle do layout. Ele atende trabalhos de design, marketing e produto, como imagens de campanha, mockups de embalagens e interfaces, nos quais a consistência da marca é essencial.
FLUX 3 Image é apresentado como o próximo passo da linha FLUX atual. Em uma única base multimodal, ele amplia a fidelidade aos prompts, a consistência orientada por referências, a edição de imagens integrada e a precisão de textos em vários idiomas. Os ganhos exatos dependem do conteúdo; quando o modelo for lançado, compare os resultados usando o mesmo prompt.
A orientação por referências é parte central do FLUX 3 Image e permite fixar identidade, paleta de cores e direção visual em uma série de imagens. No modelo que atualmente alimenta esta prévia, os resultados são controlados principalmente por um prompt detalhado, uma predefinição de tamanho da imagem e uma semente. Controles de referência mais completos chegarão com o lançamento do FLUX 3 Image.
Sim. A tipografia de alta precisão é um dos principais objetivos do FLUX 3 Image, o que favorece mockups, cartazes e embalagens, inclusive com textos em mais de um idioma. Para obter resultados mais limpos, mantenha o texto na imagem curto e coloque-o entre aspas no prompt. A legibilidade ainda depende da clareza do prompt e do modelo que atualmente alimenta esta prévia.
Sim. A edição de imagens é uma das principais evoluções: FLUX 3 Image tanto sintetiza novas imagens quanto edita imagens existentes no mesmo modelo, permitindo mudar o estilo, ajustar ou ampliar uma imagem por meio de um prompt. No modelo que atualmente alimenta esta prévia, a geração é feita principalmente a partir de texto; os controles de edição completos chegarão com o lançamento do FLUX 3 Image.
A compreensão de prompts complexos é um dos maiores avanços anunciados. Segundo a Black Forest Labs, FLUX 3 mantém instruções longas e em várias camadas com muito mais fidelidade que as versões anteriores do FLUX, fazendo com que mais detalhes apareçam no resultado final. Um único FLUX 3 Image também abrange muitos estilos, proporções e resoluções, desde fotografias de produto fotorrealistas até ilustrações.
No modelo que atualmente alimenta esta prévia, apenas prompt é obrigatório. Você também pode escolher uma predefinição de tamanho (square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3 ou landscape_16_9, com 256–1536 px de cada lado) e definir seed; o valor -1 escolhe uma nova semente a cada execução. Consulte o painel de parâmetros atual, pois as opções serão alteradas quando FLUX 3 Image for lançado.
FLUX 3 AI foi planejado como uma única base com várias edições. Além do FLUX 3 Image hospedado, a Black Forest Labs anunciou FLUX 3 Video, FLUX 3 Action (o projeto de robótica FLUX-mimic) e FLUX 3 Dev, uma base multimodal de pesos abertos. A Black Forest Labs confirmou que pretende disponibilizar pesos abertos. Quando a base FLUX 3 Dev for lançada, espera-se um fluxo de trabalho comunitário com FLUX 3 LoRA, incluindo treinamento de FLUX 3 dev LoRA para estilos personalizados, personagens e identidades de marca.
Crie o protótipo na interface de modelos do RunComfy e depois chame o mesmo template pela API RunComfy usando campos de entrada idênticos (prompt, image_size e seed). Primeiro valide o prompt e a predefinição de tamanho na interface; depois use a chave da API e os créditos da sua conta para automatizar as tarefas.
As gerações consomem créditos de acordo com o modelo que atualmente alimenta esta prévia: Flux 2 Dev, a $0.012 por imagem. Novos usuários normalmente começam com um saldo de avaliação gratuito. Consulte o preço exibido nesta página, que será atualizado quando FLUX 3 Image for lançado.
RunComfy é a principal ComfyUI plataforma, oferecendo ComfyUI online ambiente e serviços, juntamente com fluxos de trabalho do ComfyUI apresentando visuais impressionantes. RunComfy também oferece AI Models, permitindo que artistas utilizem as mais recentes ferramentas de AI para criar arte incrível.





