Premiers pas avec Flux : modèles, versions et mode d’emploi

Flux est le modèle de génération d’images qui a bouleversé les attentes du secteur en matière de réalisme, de précision du texte et de fidélité au prompt. Cet article détaille chaque version de Flux, ses points forts, les différences entre les versions, et la marche à suivre pour créer vos premières images dès aujourd’hui sur PicassoIA. Aucune expérience préalable n’est requise.

Premiers pas avec Flux : modèles, versions et mode d’emploi
Cristian Da Conceicao
Fondateur de Picasso IA

Flux est le modèle de génération d’images le plus commenté de ces deux dernières années, et ce n’est pas un hasard. Contrairement aux modèles qui produisent des images au « look IA » évident, Flux génère des images que des photographes, des designers et des créateurs de contenu prennent régulièrement pour de vraies photographies. Si vous suivez la génération d’images par IA de loin et que vous vous demandez par où commencer, c’est le modèle qui mérite votre attention.

Ce qu’est vraiment Flux

Flux est un modèle de génération d’images à poids ouverts créé par Black Forest Labs, une équipe fondée par d’anciens chercheurs de Stability AI. Publié en août 2024, il a immédiatement fixé une nouvelle norme pour la génération d’images à partir de texte, notamment dans les domaines où les modèles précédents peinaient : le rendu précis du texte, l’anatomie humaine réaliste et le respect fidèle de prompts complexes.

L’architecture repose sur un transformeur de diffusion (DiT), une évolution notable par rapport au backbone U-Net utilisé dans des modèles plus anciens comme Stable Diffusion. Cette conception donne à Flux sa capacité caractéristique à maintenir une cohérence structurelle sur l’ensemble d’une image, ce qui exigeait auparavant des outils supplémentaires comme ControlNet.

Ce qui le distingue

Ce qui différencie Flux n’est pas seulement sa qualité visuelle brute. Trois éléments définissent sa réputation :

  • Fidélité au prompt : Flux suit des prompts complexes à plusieurs conditions avec une précision remarquable. Écrivez « un vélo rouge appuyé contre un mur bleu, un chat endormi sur la selle, dans la lumière douce de l’après-midi » et Flux restituera correctement chacun de ces détails.
  • Rendu du texte : les modèles précédents déformaient systématiquement le texte présent dans les images. Flux gère de manière fiable les chaînes de texte courtes à moyennes, ce qui compte énormément pour les visuels de réseaux sociaux, les maquettes et la narration visuelle.
  • Anatomie humaine : les mains, les doigts et les proportions du visage ont longtemps été le talon d’Achille des modèles d’images par IA. Flux produit des résultats anatomiquement plausibles à un niveau tout simplement supérieur à celui de ses prédécesseurs.

L’équipe derrière le modèle

Black Forest Labs a été fondée en 2024 par Robin Rombach, Andreas Blattmann et des collègues qui ont conçu l’architecture originale de Stable Diffusion. Ce pedigree explique beaucoup de la qualité de Flux. Ce ne sont pas des nouveaux venus : ils ont conçu le pipeline fondamental que la plupart des modèles d’image utilisent encore aujourd’hui, et Flux reflète des années de recherche accumulée appliquées à une architecture entièrement nouvelle.

Espace de génération d’images Flux AI avec des résultats photoréalistes

La famille de modèles Flux

Black Forest Labs a publié Flux en plusieurs niveaux. Le bon choix dépend de ce que vous créez et du degré de contrôle dont vous avez besoin.

Schnell, Dev et Pro comparés

ModèleVitesseQualitéIdéal pour
Flux SchnellTrès rapideBonnePrototypage rapide, génération en volume
Flux DevModéréeExcellenteProjets créatifs, scènes détaillées
Flux ProPlus lenteMeilleureRésultats finaux, usage professionnel

Flux Schnell est la version optimisée pour la vitesse. Elle génère des images en 1 à 4 étapes environ, ce qui la rend adaptée à l’itération rapide lorsque vous devez tester des dizaines de variantes de prompt en peu de temps. La qualité est nettement inférieure aux autres niveaux, mais reste bien supérieure à celle de la plupart des modèles rapides concurrents.

Flux Dev se situe au milieu et compte parmi les versions les plus populaires, tant chez les amateurs que chez les professionnels. Elle équilibre vitesse de génération et qualité de sortie excellente, et ses poids ouverts ont permis à la communauté de construire un écosystème considérable de LoRA issus du fine-tuning autour d’elle.

Flux Pro est le modèle phare. Poids fermés, accès uniquement par API et qualité de sortie la plus élevée de la famille. Lorsque vous avez besoin d’une image finale pour une campagne, une page produit ou un article éditorial, c’est cette version qu’il faut utiliser.

Flux 1.1 Pro Ultra pour un maximum de détails

Flux 1.1 Pro Ultra est une version améliorée de Flux Pro, avec une prise en charge native des sorties à 4 mégapixels. À 4 MP, les détails qui s’adouciraient normalement en grand format restent nets : tissages des tissus, éléments architecturaux lointains, mèches de cheveux individuelles dans les plans moyens.

💡 Quand utiliser Ultra : si vous produisez des images destinées à l’impression, à un affichage grand format ou à tout usage où l’image sera vue en haute résolution, le niveau Ultra vaut le coût d’inférence supplémentaire.

Vue en plongée de photographies IA imprimées éparpillées sur un bureau de designer

Flux 2 : la nouvelle génération

Flux 2 Pro et Flux 2 Dev poursuivent cette lignée avec des capacités d’image vers image améliorées, en complément de la génération de texte vers image. Vous pouvez fournir une photo de référence et un prompt textuel, et Flux 2 combine les deux entrées en une sortie cohérente. Cela ouvre de nouveaux flux de travail pour la photographie de produits, la cohérence des personnages et l’adaptation de scènes.

Flux 2 Max pousse encore plus loin la résolution de sortie, avec des images de 4 MP et la latitude créative supplémentaire de l’architecture Flux 2. Pour les travaux commerciaux où une entrée image vers image fait partie du brief, c’est actuellement le haut de gamme.

Ce qui rend les images Flux si réussies

L’écart de qualité entre Flux et les modèles plus anciens est réel, mais comprendre pourquoi il existe vous aide à mieux l’utiliser.

Un rendu de texte qui fonctionne vraiment

Obtenir un texte lisible dans les images était, pendant des années, considéré comme presque impossible pour les modèles de diffusion. Flux a changé la donne grâce à une combinaison de modifications d’architecture et d’un entraînement sur un jeu de données aux légendes plus riches. Les expressions courtes, les mots isolés et même les phrases simples placés sur des enseignes, des vitrines ou des emballages sortent correctement avec Flux, à un niveau qui le rend réellement utile pour la création de maquettes.

Concrètement, vous pouvez écrire des prompts comme a coffee shop window with "OPEN" painted in white letters et obtenir exactement cela. Vous n’êtes plus limité à considérer le texte présent dans l’image comme un simple élément décoratif.

La fidélité au prompt dans le détail

La plupart des modèles d’image traitent les prompts longs comme des distributions de probabilités, en privilégiant l’interprétation statistiquement la plus probable. Flux tient simultanément davantage de conditions. Un prompt qui précise trois sources de lumière distinctes, une texture de tissu particulière et une expression émotionnelle donnée pour un sujet produira une image où les trois sont réellement présents, au lieu d’être dilués.

Cela ne signifie pas qu’un prompt plus long est toujours meilleur. Flux tire encore profit de prompts précis et structurés. La différence, c’est que le plafond de complexité est beaucoup plus haut.

Femme devant un écran, admirative, face à des résultats d’images photoréalistes générées par IA

Comment utiliser Flux sur PicassoIA

PicassoIA vous donne accès à tous les modèles Flux via une interface simple, sans clé API ni installation locale. Voici comment passer de zéro à votre première image.

Étape 1 : choisissez votre modèle

Rendez-vous sur Flux Dev si vous débutez. Il offre le meilleur rapport qualité-vitesse et tolère bien les essais de prompts. Si vous avez besoin de vitesse pour itérer, passez à Flux Schnell. Pour les résultats finaux, utilisez Flux Pro ou Flux 1.1 Pro Ultra.

Étape 2 : rédigez un prompt structuré

Les prompts Flux fonctionnent mieux lorsqu’ils suivent une structure claire :

  1. Sujet et action : que voit-on dans l’image et que fait-il ?
  2. Environnement : où se situe la scène ? À quoi ressemble le décor ?
  3. Éclairage : direction, qualité et couleur de la lumière.
  4. Caméra et objectif : focale, ouverture, angle de prise de vue.
  5. Style et ambiance : le sentiment général que l’image doit transmettre.

Un prompt médiocre : a woman in a garden

Un prompt efficace : a woman in her 30s sitting on a wooden bench in an overgrown English cottage garden, dappled morning light filtering through apple tree branches overhead, 85mm f/1.8 portrait lens, warm golden tones, natural expression, film grain

Le second prompt donne à Flux toutes les conditions nécessaires pour prendre de vraies décisions. Le premier laisse tout au hasard.

Étape 3 : ajustez les paramètres

PicassoIA expose les paramètres les plus importants :

  • Format : 16:9 pour le paysage, 9:16 pour les contenus verticaux des réseaux sociaux, 1:1 pour les formats carrés.
  • Steps (Flux Dev) : des steps plus élevés (28 à 50) améliorent la cohérence et le détail. Des steps plus faibles (10 à 20) sont plus rapides mais moins nets.
  • Guidance scale : contrôle la rigueur avec laquelle le modèle suit votre prompt. Des valeurs comprises entre 3,5 et 7 conviennent à la plupart des cas.
  • Seed : fixez une seed pour reproduire un résultat ou itérer sur une composition qui vous plaît.

💡 Astuce pro : commencez avec un guidance scale d’environ 3,5 et augmentez-le progressivement si le modèle ne capture pas certains détails de votre prompt. Au-delà de 7, on observe souvent une saturation excessive et un rendu raide.

Comparaison côte à côte des différences de qualité d’images IA sur un écran de bureau

Flux pour l’édition d’images

La famille Flux va bien au-delà de la génération de texte vers image. Plusieurs modèles sont spécialement conçus pour éditer des photographies existantes.

Modifier sans perdre l’original

Flux Kontext Pro et Flux Kontext Max sont des modèles d’édition pilotés par instructions. Vous fournissez une image existante et une instruction textuelle, et le modèle ne modifie que ce que vous précisez, en préservant tout le reste. Vous voulez changer la couleur d’une chemise, ajouter un objet à une scène ou modifier l’éclairage d’un portrait ? Ces modèles s’en chargent avec une précision que les flux de travail d’inpainting traditionnels ne peuvent pas égaler.

Flux Kontext Fast offre la même édition pilotée par instructions à une vitesse nettement supérieure, ce qui le rend pratique pour les flux de travail qui exigent plusieurs modifications successives sans longues attentes.

Inpainting et outpainting

Flux Fill Pro et Flux Fill Dev gèrent les tâches d’inpainting et d’outpainting. L’inpainting vous permet de masquer une zone d’une image et de la remplacer par un contenu généré qui correspond au contexte environnant. L’outpainting étend le cadre au-delà de l’image d’origine. Les deux opérations préservent la cohérence de l’éclairage, de la perspective et de la texture, ce qui rend les modifications crédibles.

Femme parcourant une galerie d’images IA sur un ordinateur portable, dans un salon scandinave lumineux

Contrôle de la profondeur et de la structure

Flux Depth Pro et Flux Canny Pro apportent des fonctionnalités de type ControlNet à l’écosystème Flux. Depth Pro utilise des cartes de profondeur pour contraindre la structure 3D pendant la génération, garantissant que les relations spatiales de la sortie correspondent à la référence. Canny Pro utilise la détection de contours pour préserver la structure de la composition tout en modifiant le style ou le contenu. Ces outils sont indispensables lorsque vous avez besoin d’un rendu cohérent sur une série d’images liées.

Modèles LoRA Flux pour des styles personnalisés

Flux Dev LoRA et Flux Schnell LoRA vous permettent d’appliquer des poids de style affinés par-dessus les modèles Flux de base. Les fichiers LoRA (Low-Rank Adaptation) sont de petits ajouts de réseau de neurones qui orientent le modèle vers un style visuel, un sujet ou une esthétique précis, sans réentraîner l’ensemble du modèle.

Ce que fait un LoRA à votre rendu

Un LoRA entraîné sur la photographie de mode oriente Flux vers ce style d’éclairage, ce cadrage des postures et cette palette de couleurs, sans que vous ayez besoin de les décrire dans chaque prompt. Un LoRA de personnage maintient un visage cohérent sur plusieurs générations. Le résultat pratique est une réduction spectaculaire de la complexité des prompts, une fois que vous avez trouvé un LoRA qui correspond à votre direction créative.

Entraîner le vôtre

P Image Trainer sur PicassoIA vous permet d’entraîner directement dans le navigateur vos propres poids LoRA. Importez 10 à 20 images de référence, définissez un mot déclencheur, et le trainer procède au fine-tuning d’un LoRA Flux sur votre sujet ou style précis. Les poids obtenus peuvent ensuite être appliqués via Flux Dev LoRA pour toutes les générations suivantes.

Gros plan extrême d’une photographie IA imprimée tenue entre les doigts, montrant des détails fins

3 erreurs courantes avec les prompts Flux

Même avec un modèle de haute qualité, des erreurs de prompt produiront systématiquement des résultats décevants.

Surcharger d’adjectifs abstraits

Des termes comme « magnifique », « époustouflant », « incroyable » ou « extraordinaire » ne transmettent aucune information visuelle précise. Flux ne peut pas rendre « magnifique » sans savoir à quoi cela ressemble dans votre contexte. Remplacez chaque adjectif abstrait par un descripteur visuel concret.

Au lieu de : « un portrait magnifique d’une femme »

Essayez : « un portrait de femme, lumière douce et diffuse venant d’une fenêtre à gauche, objectif 85 mm, léger sourire, chemise en lin ample, fond vert sauge discret »

Le mauvais modèle pour la tâche

Utiliser Flux Schnell pour les résultats finaux, ou Flux Pro pour l’itération en volume, constitue un mauvais dimensionnement des ressources. Adaptez le niveau du modèle à la phase de votre flux de travail. Prototypez avec Schnell, affinez avec Dev, finalisez avec Pro.

Ignorer l’espace négatif

Flux respecte les consignes de composition. Si vous voulez que le sujet occupe une zone précise du cadre, dites-le. « Sujet dans le tiers gauche du cadre, large espace négatif à droite » donnera systématiquement de meilleurs résultats qu’en espérant que le modèle choisisse un bon recadrage.

Deux écrans côte à côte dans un bureau à domicile affichant des paysages différents générés par IA

Flux pour les variations d’images

Flux Redux Dev et Flux Redux Schnell résolvent un problème précis de flux de travail : générer des variations d’une image existante tout en conservant son identité visuelle de base. Vous fournissez une image source, et Redux génère de nouvelles versions avec des compositions, des palettes de couleurs ou des éclairages différents, tout en préservant l’identité du sujet et le caractère général de la scène.

C’est particulièrement précieux pour la photographie de produits, où vous avez besoin de plusieurs angles ou contextes du même objet sans séance photo complète. C’est aussi utile pour la cohérence des personnages sur une série d’illustrations ou de publications sur les réseaux sociaux.

💡 Astuce Redux : plus le guidance scale est proche de la valeur par défaut, plus Redux a de liberté pour réinterpréter la composition. Des valeurs plus basses produisent des variations plus serrées ; des valeurs plus élevées en produisent de plus libres.

Mains d’une femme tapant un prompt sur une table de café en marbre, avec une tasse de café à proximité

Commencez à créer avec Flux dès aujourd’hui

Chaque modèle de la famille Flux est disponible directement sur PicassoIA, sans installation de logiciel, sans configuration d’API et sans exigence matérielle. Vous écrivez un prompt et vous obtenez une image. C’est réellement toute la configuration nécessaire.

Pour une première expérience, rendez-vous sur Flux Dev et rédigez un prompt décrivant quelque chose de précis dans votre vie ou votre travail. Un produit que vous vendez, un lieu que vous connaissez, une personne que vous voulez visualiser. La précision des prompts personnels rend les premiers essais nettement plus gratifiants que des prompts de test génériques.

Lorsque vous êtes prêt à aller au-delà des images isolées, Flux Redux Dev vous donne des variations à partir d’une seule image de référence. Flux Kontext Pro vous permet de modifier des photos existantes avec une simple instruction textuelle. Flux Fill Pro prolonge ou répare n’importe quelle image sans coutures visibles.

L’écosystème Flux complet sur PicassoIA représente aujourd’hui la boîte à outils de génération d’images accessible au public la plus performante. La seule façon de développer une véritable intuition de ce que Flux fait bien, c’est de l’utiliser. Commencez par un prompt aujourd’hui, et les résultats vous en apprendront plus que n’importe quel article.

Jeune homme debout devant un bureau réglable, expression assurée, dans un espace de travail créatif ouvert

Partager cet article

Choisissez votre langue