Como usar o FLUX.3 Max para criar imagens

O FLUX.3 Max, da Black Forest Labs, entrega resultados fotorrealistas de texto para imagem que rivalizam com a fotografia profissional. Este artigo mostra como montar o prompt, definir os parâmetros, fazer upscaling e usar os modelos de variação do FLUX no PicassoIA para criar imagens prontas para publicação.

Como usar o FLUX.3 Max para criar imagens
Cristian Da Conceicao
Fundador do Picasso IA

O FLUX.3 Max se tornou discretamente o benchmark com o qual outros modelos de texto para imagem são comparados. Lançado pela Black Forest Labs, ele se baseia na linhagem FLUX para entregar resultados fotorrealistas que rivalizam com a fotografia de estúdio profissional. Se você já testou versões anteriores do FLUX e as achou impressionantes, o FLUX.3 Max leva esse resultado mais longe em fidelidade de resolução, aderência ao prompt e precisão na anatomia humana. Este artigo percorre tudo, desde como o modelo funciona até a escrita de prompts que de fato geram resultados prontos para publicação.

O que o FLUX.3 Max realmente é

O FLUX.3 Max é um modelo de difusão por correspondência de fluxo desenvolvido pela Black Forest Labs, a equipe por trás da série original FLUX.1. Diferente de modelos concorrentes que usam difusão latente com cronogramas de ruído adicionados, o FLUX usa uma arquitetura de transformador de fluxo retificado que treina o modelo para prever trajetórias em linha reta do ruído até a imagem-alvo. O resultado é um modelo que gera imagens com menos artefatos e uma estrutura muito mais consistente em nível de pixel.

A designação "Max" no FLUX.3 se refere à variante com a maior contagem de parâmetros, pensada para cenários em que a qualidade da saída não é negociável. Ilustradores comerciais, agências de publicidade e estúdios de conteúdo a usam quando precisam de imagens que aguentem a análise da impressão ou da exibição em grande formato.

Retrato fotorrealista de uma designer gráfica em um estúdio criativo iluminado, trabalhando em uma estação com monitor panorâmico

A arquitetura por trás do modelo

Em sua essência, o FLUX.3 Max usa uma arquitetura de transformador de difusão multimodal (MMDiT). Tokens de texto e de imagem são processados juntos por camadas de atenção compartilhadas, em vez de serem mantidos separados e unidos apenas nas etapas finais. Na prática, isso significa que o modelo interpreta prompts complexos e em camadas com muito mais precisão do que as abordagens mais antigas baseadas em UNet.

O modelo opera em alta resolução nativa, o que significa que não precisa de truques de pós-processamento para alcançar nitidez. Mechas de cabelo, tramas de tecido, poros da pele, gotas de água no vidro e veios da madeira aparecem porque o modelo aprendeu essas texturas a partir de dados de treinamento em alta resolução, e não porque um upscaler as acrescentou depois.

Como ele se diferencia do FLUX.1 e do FLUX.2

RecursoFLUX.1 DevFLUX.2FLUX.3 Max
Resolução1024px nativo1024px nativo1440px nativo
Precisão na anatomiaBoaMuito boaExcelente
Aderência ao promptAltaAltaMuito alta
Velocidade de inferênciaRápidaModeradaModerada
Melhor usoPrototipagem rápidaResultado equilibradoQualidade para publicação

O FLUX.3 Max sacrifica um pouco da velocidade de inferência em comparação com o FLUX.1 Dev, mas a diferença de qualidade é grande o bastante para que a maioria dos fluxos de trabalho profissionais priorize o resultado em vez da velocidade de iteração.

Preparando-se para usar o FLUX.3 Max

Saber onde e como executar o FLUX.3 Max molda toda a experiência antes mesmo de você escrever o primeiro prompt.

Pontos de acesso e plataformas

O FLUX.3 Max está disponível por meio de várias vias:

  • Hospedagem própria: exige uma GPU com pelo menos 24 GB de VRAM para uma operação confortável em 1024px. Recomendam-se 40 GB ou mais para saídas em 1440px.
  • Endpoints de API: a Black Forest Labs oferece uma API comercial. A Replicate também hospeda o modelo.
  • Plataformas: sites como o PicassoIA tornam os modelos da família FLUX acessíveis sem nenhuma configuração de infraestrutura.

💡 Dica: se você executa o FLUX.3 Max localmente, use quantização fp8 para reduzir os requisitos de VRAM em cerca de 40% com perda mínima de qualidade.

Hardware e ambiente de execução

Para inferência local, o ponto ideal é uma GPU da faixa da RTX 4090 ou da A100. O modelo se beneficia mais da largura de banda rápida da memória do que da contagem bruta de núcleos CUDA, por isso uma única placa com memória de alta largura de banda geralmente supera configurações com várias GPUs para a geração de uma única imagem.

Para uso em nuvem ou em plataformas, nada disso importa. Você tem o modelo completo e a resolução completa sem se preocupar com hardware.

Escrevendo prompts que funcionam

O FLUX.3 Max tem forte aderência ao prompt, mas isso só ajuda se os seus prompts forem específicos. Descrições vagas produzem resultados genéricos. Trate o modelo como um diretor de fotografia que precisa de orientações precisas.

Close extremo macro de mãos digitando em um teclado mecânico, com um monitor desfocado ao fundo

Descrição do sujeito e do ambiente

O que mais faz diferença é descrever o sujeito com precisão física e colocá-lo em um ambiente totalmente descrito. Compare estes dois prompts:

Fraco: A woman sitting in a cafe

Forte: A woman in her early thirties with loosely braided auburn hair, wearing a navy linen jacket, seated at a corner table in a sunlit Parisian cafe, marble table with a ceramic espresso cup, afternoon light slanting through a tall window behind her at 40 degrees

O segundo prompt dá ao modelo informação suficiente para tomar decisões de composição, escolher um ângulo de iluminação e preencher o ambiente com detalhes consistentes.

Iluminação e atmosfera

A descrição da iluminação é onde a maioria dos usuários desperdiça qualidade. O FLUX.3 Max responde a pistas de iluminação com precisão fotográfica. Use termos que um fotógrafo reconheceria:

  • "volumetric morning light from the east at low angle" cria sombras longas e calor dourado
  • "overcast diffused daylight, soft fill, no hard shadows" oferece iluminação plana e uniforme para fotos de beleza
  • "practical lighting from a single tungsten lamp at camera left" produz uma atmosfera quente, direcional e íntima
  • "golden hour backlight with rim lighting on subject" separa o sujeito do fundo

Acrescentar "Kodak Portra 400 film grain" a qualquer prompt adiciona uma camada de realismo fotográfico que eleva a qualidade do resultado imediatamente.

Parâmetros técnicos de câmera

Incluir especificações de lente e de disparo fixa o caráter visual da imagem:

  • Retrato: "85mm f/1.8 shallow depth of field, background bokeh"
  • Paisagem: "24mm f/11 front-to-back sharpness, wide angle"
  • Produto/detalhe: "105mm f/2.8 macro, extreme foreground sharpness"
  • Documental: "35mm f/5.6 natural perspective, handheld feel"

Terminar os prompts com "RAW 8K photography, photorealistic --ar 16:9 --style raw" melhora de forma consistente o realismo da saída no FLUX.3 Max.

Close extremo macro de uma lente de câmera profissional mostrando as lâminas do diafragma e os padrões de interferência do revestimento arco-íris

Parâmetros que controlam o resultado

O FLUX.3 Max expõe vários parâmetros que afetam muito o resultado. Saber o que cada um faz poupa horas de tentativa e erro.

ParâmetroFaixaEfeito
num_inference_steps20-50Mais alto = mais detalhe, mais lento
guidance_scale1-7Mais alto = maior aderência ao prompt
seedQualquer inteiroFixa a aleatoriedade para reprodutibilidade
width / heightAté 1440Resolução da saída
prompt_upsamplingtrue/falseO LLM expande o prompt antes da geração

Guidance scale na prática

O parâmetro guidance_scale é o controle mais mal compreendido. Em 3.5, o modelo mistura interpretação criativa com o seu prompt. Em 7, ele segue o seu texto quase literalmente, o que é poderoso, mas pode deixar as saídas com nitidez excessiva e reduzir a variação natural.

Para retratos e fotografia de estilo de vida, 3.5 to 5.0 costuma produzir os resultados mais convincentes. Para trabalhos comerciais precisos, em que a composição exata importa, aproxime-se de 6.0 to 7.0.

Usando seeds para consistência

Definir um seed fixo trava o padrão de ruído subjacente, o que significa que você pode iterar sobre um prompt mantendo a mesma composição básica. Isso é inestimável para:

  • Rodadas de aprovação com clientes: mostre ao cliente uma composição e depois refine cor e iluminação sem mudar a pose
  • Correspondência de estilo: gere uma série de imagens que compartilham a mesma estrutura espacial, mas diferem no sujeito
  • Depuração de prompts: isole se uma mudança no resultado veio do prompt ou do ruído

O FLUX.3 Max no PicassoIA

O PicassoIA oferece acesso direto aos modelos da família FLUX sem exigir tokens de API nem configuração de GPU. A plataforma hospeda o Flux Redux Dev, o modelo de variação da Black Forest Labs que recebe uma imagem existente e gera variações de alta qualidade preservando a composição estrutural.

Interface de geração de imagens em um monitor widescreen, mostrando miniaturas de retratos fotorrealistas em layout de grade

Usando o Flux Redux Dev para variações de imagem

O Flux Redux Dev funciona de forma diferente da geração padrão de texto para imagem. Em vez de gerar a partir de uma tela em branco, ele recebe uma imagem de referência como entrada principal e cria variações que mantêm o DNA estrutural do original. Isso o torna útil para:

  • Consistência de marca: gere várias imagens de anúncio que compartilhem a mesma disposição do produto e o mesmo enquadramento
  • Continuidade de personagem: mantenha a estrutura facial de um personagem consistente em diferentes cenários
  • Iteração de estilo: explore variações de iluminação e cor sem começar do zero a cada vez

Passo a passo: gere sua primeira imagem

  1. Abra o PicassoIA e vá até o Flux Redux Dev
  2. Envie uma imagem de referência (ou gere uma com outro modelo de texto para imagem primeiro)
  3. Escreva um prompt de variação descrevendo o que deve mudar: "same composition, golden hour lighting instead of overcast, warmer tones, soft shadows from the left"
  4. Defina suas etapas entre 28 e 35 para um bom equilíbrio entre qualidade e velocidade
  5. Baixe e avalie se a composição foi preservada do jeito que você queria

💡 Dica: para melhores resultados com o Redux Dev, sua imagem de referência já deve estar na resolução que você deseja na saída. O modelo remixa a estrutura existente em vez de inventar detalhes novos.

Fazendo upscaling dos seus resultados

Mesmo com a resolução nativa de 1440px, a saída do FLUX.3 Max se beneficia do upscaling com IA para impressão em grande formato ou exibição em tamanho de outdoor. As ferramentas de super-resolução do PicassoIA levam a saída a 4x ou 6x sem os artefatos de halo que os upscalers mais antigos produziam.

Comparação lado a lado em um monitor 4K mostrando uma foto de baixa resolução com ruído versus uma versão com upscaling ultranítida

Qual upscaler se encaixa no seu caso

ModeloMelhor paraEscala máxima
Clarity Pro UpscalerRetratos, textura da pele4x
P-Image UpscalePrioridade na velocidade, resposta em 1 segundo4x
Recraft Crisp UpscaleBordas nítidas, conteúdo gráfico e de produto4x
Google UpscalerPaisagens, detalhes do ambiente4x
Topaz Image UpscaleMáximo detalhe pronto para impressão6x
Real ESRGANUso geral, processamento em lote4x
Crystal UpscalerDetalhe no rosto de retratos4x

Para a maioria das saídas do FLUX.3 Max, o Clarity Pro Upscaler ou o Topaz Image Upscale produz os resultados mais limpos, porque ambos os modelos são treinados em fotografia fotorrealista e não em conteúdo ilustrativo.

Como obter resultados 4x limpos

O erro comum ao fazer upscaling de imagens de IA é aplicar força de redução de ruído excessiva. Imagens de IA já têm áreas limpas, sem ruído, que parecem artificiais sob redução de ruído pesada. O fluxo de trabalho que evita esse problema:

  1. Exporte do FLUX.3 Max na maior resolução nativa disponível
  2. Aplique o upscaling com criatividade/redução de ruído baixa: fique entre 0,2 e 0,4 em uma escala de 0 a 1
  3. Aplique nitidez de forma seletiva na pós-produção: apenas bordas e texturas, não áreas de cor chapada
  4. Exporte como TIFF para impressão, ou JPEG com qualidade de 95% para entrega digital

Combinando com LLMs para prompts melhores

Um dos fluxos de trabalho mais eficazes e pouco usados é usar um modelo de linguagem para escrever ou refinar seus prompts do FLUX.3 Max. A diferença de qualidade entre um prompt escrito à mão e um feito com ajuda de um LLM aparece imediatamente.

Fotógrafo do sexo masculino revisando imagens em um notebook, em uma cafeteria aquecida pela luz do sol da tarde, com raios de luz visíveis

Engenharia de prompts com assistentes de IA

O PicassoIA hospeda vários LLMs que produzem excelentes prompts para geração de imagens:

  • GPT 5: construção de prompts com nuances e múltiplas camadas, com forte capacidade de escrita criativa
  • Claude Sonnet 5: escrita descritiva detalhada, com seguimento preciso de instruções
  • Gemini 3.5 Flash: iteração rápida quando você precisa de várias variantes de prompt em pouco tempo
  • Deepseek v3.1: geração de prompts com bom custo-benefício para fluxos de trabalho de alto volume

O fluxo é simples: descreva a ideia da imagem em linguagem comum, peça ao LLM que a converta em um prompt otimizado para o FLUX com descrições específicas de iluminação, lente e textura, e depois cole o resultado no gerador.

Exemplo de instrução:

"Escreva um prompt detalhado para o FLUX.3 Max para: uma foto de produto de um frasco de perfume de vidro sobre uma pedra de ardósia molhada. Inclua iluminação específica, lente de câmera e atmosfera. Termine com modificadores de fotorrealismo. 60-80 palavras."

Essa abordagem produz prompts que levariam horas para um iniciante desenvolver por tentativa e erro. O LLM preenche todos os detalhes fotográficos que você talvez não pensasse em especificar sozinho.

Resultados reais: o que o FLUX.3 Max produz

Fotografia de retratos

O FLUX.3 Max lida com a anatomia humana melhor do que qualquer iteração anterior. Mãos, que foram o ponto de falha tradicional dos modelos de imagem de IA, saem consistentemente corretas. Textura da pele, dispersão subsuperficial e reflexos nos olhos aparecem sem prompts específicos para isso. Para estúdios que fazem trabalhos editoriais ou publicitários assistidos por IA, a qualidade dos retratos é o motivo mais frequente para trocar os modelos anteriores.

Fotografia aérea de drone de um lago alpino intocado, cercado por floresta de coníferas, no fim da tarde, com reflexos espelhados na água parada

Arquitetura e paisagem

Na arquitetura, o FLUX.3 Max respeita a geometria da perspectiva de uma forma que os modelos mais antigos tinham dificuldade em reproduzir. Linhas paralelas continuam paralelas. Os pontos de fuga são consistentes em todo o quadro. Nas paisagens, o modelo produz profundidade atmosférica com névoa realista, linhas de horizonte adequadas e uma transferência de luz do céu para o solo que parece crível. Não importa se você gera uma floresta densa ao entardecer ou um deserto aberto ao meio-dia: o resultado parece fotograficamente real, e não gerado por computador.

Plano de baixo ângulo de um beco estreito de paralelepípedos europeu ao amanhecer, com pedras molhadas e reflexivas e uma figura solitária ao longe

Fotos comerciais e de produto

A fotografia de produto é onde o FLUX.3 Max concorre diretamente com os orçamentos da fotografia de estúdio. A renderização de materiais (vidro, metal, tecido, couro, cerâmica) é precisa o bastante para uso em catálogo. Combinadas com o Recraft Crisp Upscale e o Bria Increase Resolution, as imagens de produto podem chegar à qualidade pronta para impressão sem uma sessão de estúdio. Para pequenas marcas e criadores independentes, isso representa uma vantagem de custo significativa.

Vista aérea de um espaço criativo de trabalho com caderno de esboços, amostras de cor, caneta stylus e lápis sobre uma mesa de madeira de bétula, com luz do dia fria

5 erros comuns a evitar

A maioria dos problemas com a saída do FLUX.3 Max vem de erros previsíveis:

1. Sobrecarregar o prompt: incluir muitos sujeitos concorrentes força o modelo a fazer concessões. Mantenha o sujeito principal único e claro.

2. Pular a direção da luz: "boa iluminação" não diz nada ao modelo. "Soft directional light from camera left at 45 degrees" produz um resultado específico e consistente.

3. Usar atalhos de estilo: termos como "cinematográfico" ou "profissional" são interpretados de forma inconsistente. Substitua-os por especificações reais de câmera e descrições de iluminação.

4. Ignorar o seed: não definir um seed torna cada regeneração imprevisível. Defina um seed assim que encontrar uma composição de que gosta e, a partir daí, itere sobre o prompt.

5. Fazer upscaling de forma agressiva demais: subir a força de redução de ruído acima de 0,5 em uma imagem de IA já limpa destrói a textura de superfície que a faz parecer fotográfica. Seja conservador.

Comece a criar no PicassoIA

A forma mais rápida de ver o que o FLUX.3 Max pode fazer no seu caso específico é rodar um prompt agora mesmo. O PicassoIA coloca o Flux Redux Dev a um clique de distância, junto com toda a biblioteca de upscalers, incluindo o Clarity Pro Upscaler e o Topaz Image Upscale, para que você possa ir de um prompt de texto a uma imagem pronta para impressão em uma única sessão.

Comece com um prompt na área principal: retrato, paisagem, produto ou arquitetura. Descreva a iluminação de forma explícita. Defina um seed. Gere em alta resolução. Depois passe o resultado por um dos upscalers do PicassoIA para levá-lo ao seu limite máximo de qualidade.

O catálogo completo de modelos, incluindo todos os modelos de texto para imagem, ferramentas de super-resolução e LLMs para refinar prompts, está disponível em picassoia.com/en/all-models.

Compartilhe este artigo

Escolha seu idioma