WAN 2.7 texto a imagen: gran comprensión de prompts, tamaños flexibles y hasta cinco imágenes por solicitud
FLUX 3 es el próximo modelo unificado de Black Forest Labs, diseñado para aprender de imágenes, vídeo y audio dentro de una sola arquitectura. Esta página se centra en su vertiente visual y anticipa cómo será trabajar día a día con FLUX 3 Image.
Nota: FLUX 3 Image llegará próximamente. Esta página ofrece una vista previa de la experiencia mientras Black Forest Labs termina el modelo público y la API.
Esta versión refuerza un conjunto de capacidades esenciales, y FLUX 3 Image pone cinco de ellas en primer plano:
Las imágenes de referencia pueden guiar cualquiera de estas tareas y fijar la identidad, la composición y la dirección visual para que los resultados se mantengan fieles a la marca.
Estas recomendaciones te ayudarán a obtener resultados más previsibles durante la fase de vista previa de FLUX 3 Image:
La comparación más justa de FLUX 3 Image se basa en la calidad de salida y sus capacidades. Black Forest Labs afirma que FLUX 3 ya supone un avance notable frente a versiones anteriores en los dos aspectos que más determinan los resultados reales: seguir prompts complejos y representar texto multilingüe con precisión dentro de la imagen. También puede generar y editar una amplia gama de estilos, relaciones de aspecto y resoluciones. El modelo sigue en acceso anticipado, por lo que las siguientes notas contrastan esas capacidades anunciadas con lo que cada alternativa demuestra hoy.
Black Forest Labs está desplegando FLUX 3 AI como una base multimodal única con varias ediciones, cada una publicada por fases tras su propio periodo de acceso anticipado. Según el plan oficial:
Black Forest Labs ha confirmado que prevé publicar pesos abiertos. Cuando esté disponible la base FLUX 3 Dev, el siguiente paso natural será un flujo comunitario de FLUX 3 LoRA, incluido el ajuste fino de FLUX 3 dev LoRA para estilos, personajes y apariencias de marca personalizados, siguiendo el amplio ecosistema LoRA que surgió alrededor de versiones anteriores de FLUX.
Para la mayoría de equipos de producción, FLUX 3 Image cubrirá la generación cotidiana, mientras que FLUX 3 Dev y FLUX 3 dev LoRA abrirán la puerta a personalizaciones alojadas por el propio equipo.
En resumen, FLUX 3 Image llegará próximamente a RunComfy: una base multimodal que convierte prompts e imágenes de referencia en resultados de alta fidelidad con tipografía legible y un control preciso de la composición.
WAN 2.7 texto a imagen: gran comprensión de prompts, tamaños flexibles y hasta cinco imágenes por solicitud
Cree una edición de la escena siguiente a partir de un prompt obligatorio y exactamente una imagen de origen. Elija entre seis tamaños de salida y configure entre 2 y 50 pasos de inferencia, una escala de guía de 0 a 20 (valor predeterminado: 6), de 1 a 4 resultados, la semilla y salida JPEG o PNG.
Genera imágenes precisas y creativas a partir de texto con IA avanzada.
Edite hasta tres imágenes de origen y ajuste la intensidad del prompt, los pasos de inferencia, la cantidad, la expansión del prompt, el tamaño, la semilla y el formato.
Crea imágenes realistas a partir de prompts, con tipografía precisa en chino e inglés y composiciones equilibradas.
Imágenes detalladas y texto preciso para creadores visuales
FLUX 3 Image llegará próximamente. Esta vista previa permite explorar la experiencia mientras Black Forest Labs termina el modelo multimodal unificado y su API. Hasta que se active el backend de FLUX 3, los campos de entrada y los límites visibles corresponden al modelo que actualmente impulsa esta demostración.
FLUX 3 Image está diseñado para convertir prompts detallados e imágenes de referencia en resultados de alta fidelidad con texto legible y control de la composición. Está pensado para trabajos de diseño, marketing y producto, como imágenes de campaña, maquetas de envases e interfaces en los que importa la coherencia de marca.
FLUX 3 Image se presenta como el siguiente paso de la línea FLUX actual. Reúne en una sola base multimodal una mayor fidelidad al prompt, coherencia guiada por referencias, edición de imagen integrada y texto multilingüe de alta precisión. Las mejoras exactas dependen de tu contenido; cuando se publique, compara resultados usando el mismo prompt.
La guía mediante referencias es un elemento central de FLUX 3 Image y permite fijar la identidad, la paleta y el aspecto en toda una serie de imágenes. En el modelo que actualmente impulsa esta demostración, el resultado se controla principalmente con un prompt detallado, un tamaño de imagen predefinido y una semilla. Las funciones de referencia más completas llegarán con el lanzamiento de FLUX 3 Image.
Sí. La tipografía de alta precisión es uno de los objetivos principales de FLUX 3 Image y resulta útil para maquetas, carteles y envases, incluido texto en varios idiomas. Mantén breves las palabras que deban aparecer y ponlas entre comillas en el prompt para obtener resultados más limpios. La legibilidad seguirá dependiendo de la claridad del prompt y del modelo que actualmente impulsa esta demostración.
Sí. La edición es una de sus mejoras principales: FLUX 3 Image genera imágenes nuevas y modifica las que ya tienes dentro del mismo modelo, por lo que puedes cambiar el estilo, ajustar o ampliar una imagen mediante un prompt. En el modelo que actualmente impulsa esta demostración, la generación se realiza sobre todo a partir de texto; los controles de edición más completos llegarán con FLUX 3 Image.
La comprensión de prompts complejos es una de las mejoras más destacadas. Según Black Forest Labs, FLUX 3 conserva instrucciones largas y con varias capas de forma mucho más fiable que versiones anteriores, por lo que más detalles llegan al resultado final. FLUX 3 Image también abarca una amplia variedad de estilos, relaciones de aspecto y resoluciones con un único modelo, desde fotografías de producto fotorrealistas hasta ilustraciones.
En el modelo que actualmente impulsa esta demostración, solo es obligatorio el prompt. También puedes elegir un tamaño de imagen predefinido (square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3 o landscape_16_9; entre 256 y 1536 px por lado) y configurar una semilla; el valor -1 selecciona una nueva en cada ejecución. Consulta el panel de parámetros, ya que las opciones cambiarán cuando FLUX 3 Image esté disponible.
FLUX 3 AI se ha planteado como una sola base con varias ediciones. Junto al FLUX 3 Image alojado, Black Forest Labs ha anunciado FLUX 3 Video, FLUX 3 Action (el proyecto de robótica FLUX-mimic) y FLUX 3 Dev, una base multimodal de pesos abiertos. Black Forest Labs ha confirmado que prevé publicar pesos abiertos; cuando llegue FLUX 3 Dev, cabe esperar un flujo comunitario de FLUX 3 LoRA, incluido el entrenamiento de FLUX 3 dev LoRA para estilos, personajes y apariencias de marca personalizados.
Crea un prototipo en la interfaz de modelos de RunComfy y después llama a la misma plantilla desde la API de RunComfy con idénticos campos Input (prompt, image_size, seed). Valida primero el prompt y el tamaño predefinido en la interfaz y utiliza después la clave de API y los créditos de tu cuenta para automatizar tareas.
Las generaciones consumen créditos según el modelo que actualmente impulsa esta demostración: Flux 2 Dev cuesta $0.012 por imagen. Los usuarios nuevos suelen empezar con un saldo de prueba gratuito. Consulta el precio mostrado en esta página, que se actualizará cuando se lance FLUX 3 Image.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.





