Primeiros passos com o Flux: modelos, versões e como usá-los

O Flux é o modelo de geração de imagens que mudou as expectativas do setor em realismo, precisão de texto e fidelidade ao prompt. Este artigo explica cada versão do Flux, o que cada uma faz de melhor, como elas se comparam e como começar a criar imagens com elas hoje mesmo no PicassoIA. Não é preciso nenhuma experiência prévia.

Primeiros passos com o Flux: modelos, versões e como usá-los
Cristian Da Conceicao
Fundador do Picasso IA

O Flux é o modelo de geração de imagens mais comentado dos últimos dois anos, e não por acaso. Diferentemente de modelos que produzem imagens com um "visual de IA" evidente, o Flux gera imagens que fotógrafos, designers e criadores de conteúdo costumam confundir com fotografias reais. Se você tem acompanhado a geração de imagens por IA de fora e se pergunta por onde realmente começar, este é o modelo que vale a sua atenção.

O que é o Flux, de fato

O Flux é um modelo de geração de imagens de pesos abertos criado pela Black Forest Labs, uma equipe fundada por ex-pesquisadores da Stability AI. Lançado em agosto de 2024, ele estabeleceu imediatamente um novo padrão de qualidade para texto para imagem, especialmente em áreas nas quais os modelos anteriores tinham dificuldade: renderização precisa de texto, anatomia humana realista e fidelidade a prompts complexos.

A arquitetura central usa uma abordagem de transformador de difusão (DiT), uma evolução significativa em relação ao backbone U-Net usado em modelos mais antigos, como o Stable Diffusion. Esse design dá ao Flux a capacidade característica de manter a coerência estrutural em toda a imagem, algo que antes exigia ferramentas adicionais como o ControlNet.

Por que ele se destaca

O que torna o Flux diferente não é apenas a qualidade visual bruta. Três coisas definem sua reputação:

  • Fidelidade ao prompt: o Flux segue prompts complexos, com várias condições, com uma precisão incomum. Escreva "uma bicicleta vermelha encostada em uma parede azul, com um gato dormindo no banco, sob a luz suave do fim da tarde" e o Flux renderizará todos esses detalhes corretamente.
  • Renderização de texto: modelos anteriores costumavam embaralhar o texto dentro das imagens. O Flux lida de forma confiável com sequências de texto curtas e médias, o que importa muito para artes de redes sociais, mockups e narrativas visuais.
  • Anatomia humana: mãos, dedos e proporções faciais historicamente foram o calcanhar de Aquiles dos modelos de imagem por IA. O Flux produz resultados anatomicamente plausíveis em uma proporção simplesmente melhor que a dos antecessores.

A equipe por trás dele

A Black Forest Labs foi fundada em 2024 por Robin Rombach, Andreas Blattmann e colegas que construíram a arquitetura original do Stable Diffusion. Esse histórico explica muito sobre a qualidade do Flux. Não são recém-chegados: eles projetaram o pipeline fundamental que a maioria dos modelos de imagem ainda usa hoje, e o Flux reflete anos de pesquisa acumulada aplicada a uma arquitetura inteiramente nova.

Espaço de trabalho de geração de imagens com Flux AI, com resultados fotorrealistas

A família de modelos Flux

A Black Forest Labs lançou o Flux em várias categorias. Escolher a certa depende do que você está criando e de quanto controle você precisa.

Schnell, Dev e Pro comparados

ModeloVelocidadeQualidadeMelhor para
Flux SchnellMuito rápidaBoaPrototipagem rápida, geração em lote
Flux DevModeradaExcelenteProjetos criativos, cenas detalhadas
Flux ProMais lentaA melhorResultados finais, uso profissional

Flux Schnell é a versão otimizada para velocidade. Ela gera imagens em cerca de 1 a 4 etapas, o que a torna adequada para iterações rápidas quando você precisa testar dezenas de variações de prompt em pouco tempo. A qualidade fica visivelmente abaixo das outras categorias, mas ainda está muito acima da maioria dos modelos rápidos concorrentes.

Flux Dev fica no meio-termo e é, sem dúvida, a versão mais popular entre amadores e profissionais. Ela equilibra velocidade de geração com excelente qualidade de saída, e seus pesos abertos fizeram com que a comunidade construísse um ecossistema enorme de fine-tunes com LoRA em torno dela.

Flux Pro é o carro-chefe. Pesos fechados, acesso somente por API e as saídas de maior qualidade da família. Quando você precisa de uma imagem final para uma campanha, uma página de produto ou uma peça editorial, esta é a versão a usar.

Flux 1.1 Pro Ultra para o máximo de detalhes

O Flux 1.1 Pro Ultra é uma versão aprimorada do Flux Pro, com suporte nativo a saída de 4 megapixels. Em 4MP, detalhes que normalmente perderiam nitidez em tamanhos grandes continuam nítidos: padrões de trama de tecido, elementos arquitetônicos distantes, fios individuais de cabelo em fotos de plano médio.

💡 Quando usar o Ultra: se você produz imagens para impressão, exibição em grande formato ou qualquer uso em que a imagem será vista em alta resolução, a categoria Ultra vale o custo adicional de inferência.

Vista superior de fotografias impressas de IA espalhadas sobre uma mesa de designer

Flux 2: a próxima geração

O Flux 2 Pro e o Flux 2 Dev dão continuidade à linhagem com recursos aprimorados de imagem para imagem, além da geração de texto para imagem. Você pode fornecer uma foto de referência e um prompt de texto, e o Flux 2 sintetiza as duas entradas em uma saída coerente. Isso abre fluxos de trabalho totalmente novos para fotografia de produtos, consistência de personagem e adaptação de cenas.

O Flux 2 Max leva a resolução de saída ainda mais longe, produzindo imagens de 4MP com a liberdade criativa adicional da arquitetura Flux 2. Para trabalhos comerciais em que a entrada de imagem para imagem faz parte do briefing, esta é atualmente a versão mais avançada da linha.

O que faz as imagens do Flux serem tão boas

A diferença de qualidade entre o Flux e os modelos antigos é real, mas entender por que ela existe ajuda você a usá-lo de forma mais eficaz.

Renderização de texto que realmente funciona

Durante anos, renderizar texto legível dentro de imagens foi considerado quase impossível para modelos de difusão. O Flux mudou isso por meio de uma combinação de mudanças na arquitetura e de treinamento com um conjunto de dados com legendas mais ricas. Frases curtas, palavras isoladas e até frases simples colocadas em placas, fachadas de lojas ou embalagens de produtos saem corretamente no Flux, numa taxa que o torna realmente útil para trabalhos de mockup.

A implicação prática: você pode escrever prompts como a coffee shop window with "OPEN" painted in white letters e obter exatamente isso. Você não está mais limitado a tratar o texto dentro da imagem como ruído decorativo.

Aderência ao prompt no nível de detalhe

A maioria dos modelos de imagem trata prompts longos como distribuições de probabilidade, favorecendo a interpretação estatisticamente mais provável. O Flux mantém mais condições simultaneamente. Um prompt que especifique três fontes de luz distintas, uma textura de tecido específica e uma expressão emocional particular em um personagem produzirá uma imagem em que os três elementos estão de fato presentes, e não diluídos na média.

Isso não significa que mais longo seja sempre melhor. O Flux ainda se beneficia de prompts precisos e estruturados. A diferença é que o teto de complexidade é muito mais alto.

Mulher diante de um monitor, observando com atenção resultados fotorrealistas gerados por IA

Como usar o Flux no PicassoIA

O PicassoIA oferece acesso a todos os modelos Flux por meio de uma interface simples, sem chaves de API nem configuração local. Veja como ir do zero até sua primeira imagem.

Passo 1: escolha seu modelo

Vá até o Flux Dev se você está começando. Ele oferece a melhor relação entre qualidade e velocidade e é tolerante com experimentos de prompt. Se você precisa de velocidade para iterar, mude para o Flux Schnell. Para resultados finais, use o Flux Pro ou o Flux 1.1 Pro Ultra.

Passo 2: escreva um prompt estruturado

Os prompts do Flux funcionam melhor quando seguem uma estrutura clara:

  1. Sujeito e ação: o que está na imagem e o que ele está fazendo?
  2. Ambiente: onde está? Como é o cenário?
  3. Iluminação: direção, qualidade e cor da luz.
  4. Câmera e lente: distância focal, abertura, ângulo de tomada.
  5. Estilo e clima: a sensação geral que a imagem deve transmitir.

Um prompt medíocre: a woman in a garden

Um prompt forte: a woman in her 30s sitting on a wooden bench in an overgrown English cottage garden, dappled morning light filtering through apple tree branches overhead, 85mm f/1.8 portrait lens, warm golden tones, natural expression, film grain

O segundo prompt dá ao Flux todas as condições de que ele precisa para tomar decisões reais. O primeiro deixa tudo ao acaso.

Passo 3: ajuste os parâmetros

O PicassoIA expõe os parâmetros que mais importam:

  • Proporção: 16:9 para paisagem, 9:16 para conteúdo vertical de redes sociais, 1:1 para formatos quadrados.
  • Steps (Flux Dev): steps mais altos (28 a 50) melhoram a coerência e o detalhe. Steps mais baixos (10 a 20) são mais rápidos, porém mais suaves.
  • Guidance scale: controla o quanto rigorosamente o modelo segue o seu prompt. Valores entre 3,5 e 7 funcionam bem na maioria dos casos.
  • Seed: defina uma seed fixa para reproduzir resultados ou iterar sobre uma composição de que você gosta.

💡 Dica de pro: comece com um guidance scale em torno de 3,5 e aumente-o gradualmente se o modelo não estiver captando detalhes específicos do seu prompt. Passar de 7 costuma introduzir supersaturação e rigidez.

Comparação lado a lado de diferenças de qualidade em imagens de IA, em um monitor sobre uma mesa

O Flux para edição de imagens

A família Flux vai muito além da geração de texto para imagem. Vários modelos são criados especificamente para editar fotografias existentes.

Edite sem perder o original

O Flux Kontext Pro e o Flux Kontext Max são modelos de edição baseados em instruções. Você fornece uma imagem existente e uma instrução de texto, e o modelo altera apenas o que você especificou, preservando todo o resto. Quer mudar a cor de uma camisa, acrescentar um objeto a uma cena ou reiluminar um retrato? Esses modelos fazem isso com uma precisão que os fluxos tradicionais de inpainting não alcançam.

O Flux Kontext Fast oferece a mesma edição baseada em instruções com velocidade bem maior, o que o torna prático para fluxos de trabalho que exigem várias edições iterativas sem longas esperas.

Inpainting e outpainting

O Flux Fill Pro e o Flux Fill Dev cuidam de tarefas de inpainting e outpainting. O inpainting permite que você mascare uma região de uma imagem e a substitua por conteúdo gerado que combine com o contexto ao redor. O outpainting estende a tela para além do quadro original. As duas operações mantêm consistência de iluminação, perspectiva e qualidade de textura que tornam as edições convincentes.

Mulher navegando em uma galeria de imagens de IA em um notebook, em uma sala de estar escandinava bem iluminada

Controle de profundidade e estrutura

O Flux Depth Pro e o Flux Canny Pro trazem para o ecossistema Flux funcionalidades semelhantes às do ControlNet. O Depth Pro usa mapas de profundidade para restringir a estrutura 3D durante a geração, garantindo que as relações espaciais na saída correspondam à referência. O Canny Pro usa detecção de bordas para preservar a estrutura da composição enquanto altera o estilo ou o conteúdo. Essas ferramentas são essenciais quando você precisa de uma saída consistente em uma série de imagens relacionadas.

Modelos LoRA do Flux para estilos personalizados

O Flux Dev LoRA e o Flux Schnell LoRA permitem aplicar pesos de estilo ajustados sobre os modelos Flux base. Arquivos LoRA (Low-Rank Adaptation) são pequenas adições à rede neural que levam o modelo a um estilo visual, sujeito ou estética específicos, sem retreinar o modelo inteiro.

O que o LoRA faz com sua saída

Um LoRA treinado com fotografia de moda leva o Flux em direção àquele estilo de iluminação, enquadramento de postura corporal e paleta de cores, sem que você precise descrevê-lo em cada prompt. Um LoRA de personagem mantém um rosto consistente ao longo de várias gerações. O resultado prático é uma redução drástica na complexidade do prompt quando você encontra um LoRA que combina com a sua direção criativa.

Treinando o seu próprio

O P Image Trainer no PicassoIA permite treinar pesos LoRA personalizados diretamente no navegador. Envie de 10 a 20 imagens de referência, defina uma palavra-gatilho, e o treinador faz o fine-tuning de um LoRA do Flux no seu sujeito ou estilo específico. Os pesos resultantes podem então ser aplicados por meio do Flux Dev LoRA em todas as gerações seguintes.

Close extremo de uma fotografia impressa de IA segurada entre os dedos, mostrando detalhes finos

3 erros comuns com prompts do Flux

Mesmo com um modelo de alta qualidade, erros de prompt vão continuar produzindo resultados decepcionantes.

Excesso de adjetivos abstratos

Expressões como "bonito", "deslumbrante", "incrível" ou "impressionante" não transmitem nenhuma informação visual específica. O Flux não consegue renderizar "bonito" sem saber como isso se parece no seu contexto. Substitua cada adjetivo abstrato por um descritor visual concreto.

Em vez de: "um retrato bonito de uma mulher"

Experimente: "um retrato de uma mulher, luz suave e difusa de uma janela à esquerda, lente de 85mm, leve sorriso, camisa de linho solta, fundo verde-sálvia discreto"

Modelo errado para a tarefa

Usar o Flux Schnell para resultados finais, ou o Flux Pro para iteração em lote, é um descompasso de recursos. Combine a categoria do modelo com a fase do seu fluxo de trabalho. Prototipe com o Schnell, refine com o Dev, finalize com o Pro.

Ignorar o espaço negativo

O Flux respeita instruções de composição. Se você quer que o sujeito ocupe uma área específica do quadro, diga isso. "Sujeito no terço esquerdo do quadro, grande espaço negativo à direita" vai produzir de forma consistente resultados com melhor composição do que torcer para o modelo escolher um bom recorte.

Dois monitores lado a lado em um home office, mostrando paisagens diferentes geradas por IA

O Flux para variações de imagem

O Flux Redux Dev e o Flux Redux Schnell resolvem um problema específico de fluxo de trabalho: gerar variações de uma imagem existente mantendo sua identidade visual central. Forneça uma imagem de origem, e o Redux gera novas versões com composições, paletas de cores ou iluminações diferentes, preservando a identidade do sujeito e o caráter geral da cena.

Isso é especialmente valioso para fotografia de produtos, em que você precisa de vários ângulos ou contextos do mesmo objeto sem um ensaio fotográfico completo. Também é útil para consistência de personagem em uma série de ilustrações ou posts em redes sociais.

💡 Dica do Redux: quanto mais próximo o guidance scale estiver do padrão, mais liberdade o Redux tem para reinterpretar a composição. Valores mais baixos produzem variações mais próximas da original; valores mais altos produzem variações mais soltas.

Mãos de uma mulher digitando um prompt em uma mesa de café de mármore, com uma xícara por perto

Comece a criar com o Flux hoje

Todos os modelos da família Flux estão disponíveis diretamente no PicassoIA, sem instalação de software, sem configuração de API e sem exigência de hardware. Você escreve um prompt e recebe uma imagem. Essa é, de fato, toda a configuração necessária.

Para um primeiro experimento, vá até o Flux Dev e escreva um prompt que descreva algo específico da sua vida ou do seu trabalho. Um produto que você vende, um lugar que você conhece, uma pessoa que você quer visualizar. A especificidade de prompts pessoais torna os primeiros experimentos bem mais recompensadores do que prompts de teste genéricos.

Quando estiver pronto para ir além das imagens isoladas, o Flux Redux Dev oferece variações a partir de uma única imagem de referência. O Flux Kontext Pro permite editar fotos existentes com uma instrução de texto simples. O Flux Fill Pro estende ou repara qualquer imagem sem emendas visíveis.

O ecossistema Flux completo no PicassoIA representa o conjunto de ferramentas de geração de imagens mais capaz e acessível ao público disponível agora. A única forma de desenvolver intuição real sobre o que o Flux faz de melhor é usá-lo. Comece com um prompt hoje, e os resultados vão ensinar mais do que qualquer artigo.

Jovem em pé diante de uma mesa de trabalho, com expressão confiante, em um escritório criativo de planta aberta

Compartilhe este artigo

Escolha seu idioma