Primeros pasos con Flux: modelos, versiones y cómo usarlos

Flux es el modelo de generación de imágenes que cambió lo que la industria espera en cuanto a realismo, precisión del texto y fidelidad al prompt. Este artículo desglosa cada versión de Flux, lo que hace bien cada una, cómo se comparan y cómo empezar hoy mismo a crear imágenes con ellas en PicassoIA. No se necesita experiencia previa.

Primeros pasos con Flux: modelos, versiones y cómo usarlos
Cristian Da Conceicao
Fundador de Picasso IA

Flux es el modelo de generación de imágenes más comentado de los últimos dos años, y con razón. A diferencia de los modelos que producen imágenes con un evidente "aspecto de IA", Flux genera imágenes que fotógrafos, diseñadores y creadores de contenido confunden con frecuencia con fotografías reales. Si has estado siguiendo la generación de imágenes con IA desde la barrera y te preguntas por dónde empezar de verdad, este es el modelo que merece tu atención.

Qué es Flux realmente

Flux es un modelo de generación de imágenes de pesos abiertos creado por Black Forest Labs, un equipo fundado por antiguos investigadores de Stability AI. Lanzado en agosto de 2024, estableció de inmediato un nuevo estándar de calidad en texto a imagen, sobre todo en los ámbitos donde los modelos anteriores tenían dificultades: la representación precisa del texto, la anatomía humana realista y la adherencia fiel a prompts complejos.

La arquitectura central usa un enfoque de transformador de difusión (DiT), una evolución importante frente a la estructura U-Net de modelos anteriores como Stable Diffusion. Este diseño da a Flux su capacidad característica de mantener la coherencia estructural en toda la imagen, algo que antes requería herramientas adicionales como ControlNet.

Por qué destaca

Lo que hace diferente a Flux no es solo su calidad visual bruta. Tres aspectos definen su reputación:

  • Fidelidad al prompt: Flux sigue prompts complejos con múltiples condiciones con una precisión inusual. Escribe "una bicicleta roja apoyada contra una pared azul con un gato durmiendo en el asiento bajo una luz suave de la tarde" y Flux representará todos esos detalles correctamente.
  • Representación del texto: los modelos anteriores solían distorsionar el texto dentro de las imágenes. Flux maneja de forma fiable cadenas de texto cortas y medianas, lo que importa muchísimo para gráficos de redes sociales, maquetas y narrativa visual.
  • Anatomía humana: las manos, los dedos y las proporciones faciales han sido históricamente el punto débil de los modelos de imagen con IA. Flux produce resultados anatómicamente plausibles con una frecuencia que simplemente supera a sus predecesores.

El equipo detrás

Black Forest Labs fue fundada en 2024 por Robin Rombach, Andreas Blattmann y otros colegas que construyeron la arquitectura original de Stable Diffusion. Ese pedigrí explica mucho de la calidad de Flux. No son recién llegados: diseñaron la canalización fundamental que la mayoría de los modelos de imagen siguen usando hoy, y Flux refleja años de investigación acumulada aplicada a una arquitectura completamente nueva.

Espacio de trabajo de generación de imágenes de Flux AI con resultados fotorrealistas

La familia de modelos Flux

Black Forest Labs lanzó Flux en varios niveles. Elegir el adecuado depende de lo que estés creando y de cuánto control necesites.

Schnell, Dev y Pro comparados

ModeloVelocidadCalidadIdeal para
Flux SchnellMuy rápidaBuenaPrototipos rápidos, generación en lote
Flux DevModeradaExcelenteProyectos creativos, escenas detalladas
Flux ProMás lentaLa mejorResultados finales, uso profesional

Flux Schnell es la versión optimizada para la velocidad. Genera imágenes en unos 1 a 4 pasos, lo que la hace adecuada para iterar rápido cuando necesitas probar decenas de variaciones de un prompt. La calidad está claramente por debajo de los otros niveles, aunque sigue muy por encima de la mayoría de los modelos rápidos de la competencia.

Flux Dev se sitúa en un punto intermedio y es posiblemente la versión más popular entre aficionados y profesionales por igual. Equilibra la velocidad de generación con una calidad de salida excelente, y sus pesos abiertos han hecho que la comunidad construya un enorme ecosistema de ajustes finos LoRA a su alrededor.

Flux Pro es el modelo insignia. Pesos cerrados, acceso solo por API y las salidas de mayor calidad de la familia. Cuando necesites una imagen final para una campaña, una página de producto o una pieza editorial, esta es la versión que debes usar.

Flux 1.1 Pro Ultra para el máximo detalle

Flux 1.1 Pro Ultra es una versión mejorada de Flux Pro con soporte nativo para salidas de 4 megapíxeles. A 4 MP, los detalles que normalmente se suavizarían en tamaños grandes se mantienen nítidos: el tejido de las telas, elementos arquitectónicos lejanos, mechones de pelo individuales en planos medios.

💡 Cuándo usar Ultra: si produces imágenes para impresión, formatos de gran tamaño o cualquier caso en el que la imagen se vaya a ver en alta resolución, el nivel Ultra merece el costo de inferencia adicional.

Vista cenital de fotografías impresas con IA esparcidas sobre un escritorio de diseño

Flux 2: la siguiente generación

Flux 2 Pro y Flux 2 Dev continúan la línea con capacidades mejoradas de imagen a imagen junto con la generación de texto a imagen. Puedes proporcionar una foto de referencia y un prompt de texto, y Flux 2 sintetiza ambas entradas en un resultado coherente. Esto abre flujos de trabajo completamente nuevos para la fotografía de producto, la coherencia de personajes y la adaptación de escenas.

Flux 2 Max lleva la resolución de salida aún más lejos, produciendo imágenes de 4 MP con la libertad creativa adicional de la arquitectura Flux 2. Para trabajos comerciales en los que la entrada de imagen a imagen forma parte del encargo, esta es actualmente la versión más alta de la gama.

Qué hace tan buenas las imágenes de Flux

La brecha de calidad entre Flux y los modelos anteriores es real, pero entender por qué existe te ayuda a usarlo mejor.

Una representación del texto que de verdad funciona

Durante años se consideró casi imposible que los modelos de difusión representaran texto legible dentro de las imágenes. Flux cambió esto mediante una combinación de cambios en la arquitectura y entrenamiento con un conjunto de datos con descripciones más ricas. Las frases cortas, las palabras sueltas e incluso las oraciones sencillas colocadas en letreros, escaparates o envases de productos salen correctamente en Flux con una frecuencia que lo hace realmente útil para trabajos de maquetación.

La implicación práctica: puedes escribir prompts como a coffee shop window with "OPEN" painted in white letters y obtener exactamente eso. Ya no estás limitado a tratar el texto de la imagen como ruido decorativo.

Adherencia al prompt a nivel de detalle

La mayoría de los modelos de imagen tratan los prompts largos como distribuciones de probabilidad, favoreciendo la interpretación más probable estadísticamente. Flux mantiene más condiciones a la vez. Un prompt que especifique tres fuentes de luz distintas, una textura de tela concreta y una expresión emocional determinada en un sujeto producirá una imagen en la que los tres elementos están realmente presentes en lugar de diluidos en un promedio.

Esto no significa que más largo sea siempre mejor. Flux sigue beneficiándose de prompts precisos y estructurados. La diferencia es que el techo de complejidad es mucho más alto.

Mujer frente a un monitor con asombro concentrado ante resultados de imágenes fotorrealistas generadas con IA

Cómo usar Flux en PicassoIA

PicassoIA te da acceso a todos los modelos Flux a través de una interfaz sencilla, sin claves de API ni configuración local. Así pasas de cero a tu primera imagen.

Paso 1: elige tu modelo

Ve a Flux Dev si estás empezando. Ofrece la mejor relación entre calidad y velocidad y tolera bien la experimentación con prompts. Si necesitas velocidad para iterar, cambia a Flux Schnell. Para resultados finales, usa Flux Pro o Flux 1.1 Pro Ultra.

Paso 2: escribe un prompt estructurado

Los prompts de Flux funcionan mejor cuando siguen una estructura clara:

  1. Sujeto y acción: ¿qué hay en la imagen y qué está haciendo?
  2. Entorno: ¿dónde está? ¿Cómo es el escenario?
  3. Iluminación: dirección, calidad y color de la luz.
  4. Cámara y lente: distancia focal, apertura, ángulo de toma.
  5. Estilo y ambiente: la sensación general que debe transmitir la imagen.

Un prompt mediocre: a woman in a garden

Un prompt sólido: a woman in her 30s sitting on a wooden bench in an overgrown English cottage garden, dappled morning light filtering through apple tree branches overhead, 85mm f/1.8 portrait lens, warm golden tones, natural expression, film grain

El segundo prompt da a Flux todas las condiciones que necesita para tomar decisiones reales. El primero deja todo al azar.

Paso 3: ajusta los parámetros

PicassoIA expone los parámetros que más importan:

  • Relación de aspecto: 16:9 para paisaje, 9:16 para contenido vertical en redes sociales, 1:1 para formatos cuadrados.
  • Pasos (Flux Dev): más pasos (28 a 50) mejoran la coherencia y el detalle. Menos pasos (10 a 20) son más rápidos pero más suaves.
  • Guidance scale: controla lo estrictamente que el modelo sigue tu prompt. Valores entre 3.5 y 7 funcionan bien en la mayoría de los casos.
  • Semilla: fija una semilla para reproducir resultados o iterar sobre una composición que te guste.

💡 Consejo profesional: empieza con un guidance scale cercano a 3.5 y auméntalo poco a poco si el modelo no captura detalles concretos de tu prompt. Pasar de 7 suele introducir sobresaturación y rigidez.

Comparación lado a lado de diferencias de calidad de imagen con IA en un monitor de escritorio

Flux para la edición de imágenes

La familia Flux va mucho más allá de la generación de texto a imagen. Varios modelos están diseñados específicamente para editar fotografías existentes.

Editar sin perder el original

Flux Kontext Pro y Flux Kontext Max son modelos de edición basados en instrucciones. Proporcionas una imagen existente y una instrucción de texto, y el modelo cambia solo lo que especifiques mientras conserva todo lo demás. ¿Quieres cambiar el color de una camisa, añadir un objeto a una escena o cambiar la iluminación de un retrato? Estos modelos lo resuelven con una precisión que los flujos de trabajo tradicionales de inpainting no pueden igualar.

Flux Kontext Fast ofrece la misma edición basada en instrucciones a una velocidad significativamente mayor, lo que lo hace práctico para flujos de trabajo que requieren varias ediciones iterativas sin largas esperas.

Inpainting y outpainting

Flux Fill Pro y Flux Fill Dev se encargan de las tareas de inpainting y outpainting. El inpainting te permite enmascarar una región de una imagen y reemplazarla por contenido generado que coincida con el contexto circundante. El outpainting extiende el lienzo más allá del encuadre original. Ambas operaciones mantienen la coherencia de iluminación, perspectiva y calidad de textura que hace que las ediciones resulten convincentes.

Mujer navegando por una galería de imágenes con IA en un equipo portátil, en una luminosa sala de estar escandinava

Control de profundidad y estructura

Flux Depth Pro y Flux Canny Pro llevan al ecosistema de Flux una funcionalidad al estilo de ControlNet. Depth Pro usa mapas de profundidad para restringir la estructura 3D durante la generación, asegurando que las relaciones espaciales del resultado coincidan con la referencia. Canny Pro usa detección de bordes para preservar la estructura compositiva mientras cambias el estilo o el contenido. Estas herramientas son esenciales cuando necesitas un resultado coherente en una serie de imágenes relacionadas.

Modelos LoRA de Flux para estilos personalizados

Flux Dev LoRA y Flux Schnell LoRA te permiten aplicar pesos de estilo ajustados sobre los modelos base de Flux. Los archivos LoRA (Low-Rank Adaptation) son pequeñas adiciones a la red neuronal que empujan el modelo hacia un estilo visual, un sujeto o una estética concretos sin reentrenar el modelo completo.

Qué hace LoRA con tu resultado

Un LoRA entrenado con fotografía de moda empuja a Flux hacia ese estilo de iluminación, el encuadre de la postura corporal y la paleta de color, sin que tengas que describirlo en cada prompt. Un LoRA de personaje mantiene un rostro coherente en varias generaciones. El resultado práctico es una reducción drástica de la complejidad del prompt una vez que encuentras un LoRA que encaja con tu dirección creativa.

Entrenar el tuyo propio

P Image Trainer en PicassoIA te permite entrenar pesos LoRA personalizados directamente en el navegador. Sube entre 10 y 20 imágenes de referencia, define una palabra desencadenante y el entrenador ajusta un LoRA de Flux a tu sujeto o estilo concreto. Los pesos resultantes pueden aplicarse después mediante Flux Dev LoRA en todas las generaciones posteriores.

Primer plano extremo de una fotografía impresa con IA sostenida entre los dedos que muestra detalles finos

3 errores comunes con los prompts de Flux

Incluso con un modelo de alta calidad, los errores al escribir prompts producirán siempre resultados decepcionantes.

Sobrecargar con adjetivos abstractos

Frases como "bonito", "impresionante", "increíble" o "espectacular" no transmiten ninguna información visual concreta. Flux no puede representar "bonito" sin saber cómo se ve eso en tu contexto. Sustituye cada adjetivo abstracto por un descriptor visual concreto.

En lugar de: "un retrato bonito de una mujer"

Prueba con: "un retrato de una mujer, luz suave y difusa de una ventana por la izquierda, lente de 85 mm, sonrisa leve, camisa de lino holgada, fondo verde salvia apagado"

El modelo equivocado para la tarea

Usar Flux Schnell para los resultados finales, o Flux Pro para la iteración en lote, es un desajuste de recursos. Ajusta el nivel del modelo a la fase de tu flujo de trabajo. Prototipa con Schnell, refina con Dev y finaliza con Pro.

Ignorar el espacio negativo

Flux respeta las instrucciones de composición. Si quieres que el sujeto ocupe un área concreta del encuadre, dilo. "Sujeto en el tercio izquierdo del encuadre, amplio espacio negativo a la derecha" producirá siempre resultados mejor compuestos que confiar en que el modelo elija un buen recorte.

Dos monitores uno al lado del otro en un despacho en casa mostrando paisajes distintos generados con IA

Flux para variaciones de imagen

Flux Redux Dev y Flux Redux Schnell resuelven un problema concreto de flujo de trabajo: generar variaciones de una imagen existente manteniendo su identidad visual central. Proporcionas una imagen de origen, y Redux genera nuevas versiones con composiciones, paletas de color o iluminación distintas, conservando la identidad del sujeto y el carácter general de la escena.

Esto resulta especialmente valioso en la fotografía de producto, donde necesitas varios ángulos o contextos del mismo objeto sin una sesión de fotos completa. También es útil para la coherencia de personajes en una serie de ilustraciones o publicaciones en redes sociales.

💡 Consejo de Redux: cuanto más cerca esté el guidance scale del valor por defecto, más libertad tendrá Redux para reinterpretar la composición. Los valores más bajos producen variaciones más ajustadas; los más altos, más libres.

Manos de una mujer escribiendo un prompt en una mesa de mármol de una cafetería con una taza de café cerca

Empieza a crear con Flux hoy

Cada modelo de la familia Flux está disponible directamente en PicassoIA, sin instalar software, sin configurar APIs y sin requisitos de hardware. Escribes un prompt y obtienes una imagen. Esa es toda la configuración que existe.

Para un primer experimento, ve a Flux Dev y escribe un prompt que describa algo concreto de tu vida o trabajo. Un producto que vendes, un lugar que conoces, una persona que quieres visualizar. La especificidad de los prompts personales hace que los primeros experimentos sean mucho más gratificantes que los prompts de prueba genéricos.

Cuando estés listo para ir más allá de las imágenes sueltas, Flux Redux Dev te da variaciones a partir de una única imagen de referencia. Flux Kontext Pro te permite editar fotos existentes con una sencilla instrucción de texto. Flux Fill Pro amplía o repara cualquier imagen sin costuras visibles.

El ecosistema completo de Flux en PicassoIA representa el conjunto de herramientas de generación de imágenes más capaz y accesible al público que existe ahora mismo. La única manera de desarrollar una intuición real sobre lo que Flux hace bien es usarlo. Empieza con un prompt hoy, y los resultados te dirán más que cualquier artículo.

Hombre joven de pie frente a un escritorio con expresión segura en una oficina creativa de espacio abierto

Compartir este artículo

Elige tu idioma