FLUX-2, el nuevo modelo de generación de imágenes, ya está disponible en Diffusers
Black Forest Labs lanza FLUX-2, una familia de modelos de IA que crea imágenes más rápidas y con mejor calidad que su predecesor, y que ya puede usarse desde la popular librería Diffusers de Hugging Face.

Black Forest Labs (la empresa fundada por varios de los creadores originales de Stable Diffusion, uno de los primeros generadores de imágenes por IA de código abierto) acaba de lanzar FLUX-2, una nueva familia de modelos que promete generar imágenes con mejor calidad y en menos tiempo que FLUX.1, su versión anterior. Según informó Hugging Face en su blog oficial, estos modelos ya están integrados en Diffusers (una librería de código abierto muy popular entre desarrolladores que facilita el uso de modelos generativos sin tener que escribir todo el código desde cero).
La familia FLUX-2 incluye tres variantes: FLUX-2-dev, pensada para desarrolladores que quieren experimentar sin coste; FLUX-2-schnell (que en alemán significa 'rápido'), optimizada para generar imágenes en pocos pasos de procesamiento; y FLUX-2-pro, la versión comercial de mayor calidad que requiere pago por uso. Las tres comparten una arquitectura técnica similar, pero difieren en licencia, velocidad y nivel de detalle final. La versión schnell, por ejemplo, puede producir una imagen de alta resolución en solo dos segundos si se ejecuta en una GPU moderna (el tipo de procesador especializado que acelera los cálculos de IA), lo que la convierte en una de las opciones más rápidas del mercado actual.
Una de las novedades destacadas es que FLUX-2 maneja mejor el texto dentro de las imágenes: si le pides que escriba una palabra o frase en un cartel, un letrero o una camiseta, ahora lo hace con menos errores ortográficos y mejor legibilidad. También mejora en la generación de manos y rostros humanos, dos de los puntos débiles históricos de este tipo de modelos. Además, FLUX-2 incorpora de serie una función llamada 'inpainting' (que permite modificar solo una parte de una imagen existente sin regenerarla completa) y 'outpainting' (extender una imagen más allá de sus bordes originales), sin necesidad de entrenar un modelo aparte para esas tareas.
Desde el punto de vista técnico, FLUX-2 introduce una arquitectura híbrida que combina bloques de tipo Transformer (el mismo enfoque que usan los modelos de lenguaje como ChatGPT) con técnicas de difusión (el proceso matemático que convierte ruido aleatorio en una imagen coherente). Esta combinación, según Black Forest Labs, permite generar imágenes más coherentes y detalladas sin aumentar el tamaño del modelo ni el consumo de memoria. Los tres modelos de la familia están disponibles para descarga en Hugging Face, con distintas licencias: la versión dev permite uso no comercial, la schnell tiene una licencia Apache 2.0 (código abierto completo) y la pro requiere una suscripción de pago a través de la API oficial.
Para quienes quieran probarlo sin instalaciones complicadas, Hugging Face ofrece 'Spaces' (entornos de demostración interactivos que funcionan directamente en el navegador) donde es posible generar imágenes con FLUX-2-schnell escribiendo simplemente una descripción en lenguaje natural. También publicaron una guía técnica completa en su blog, con ejemplos de código en Python y explicaciones paso a paso sobre cómo integrar estos modelos en proyectos propios, ajustar parámetros avanzados o ejecutarlos en GPUs de distintas marcas, incluidas las más asequibles para aficionados.


