Comment garder des personnages IA cohérents dans chaque scène

Si vous avez déjà généré un personnage IA parfait, pour finir par le voir perdre son visage sur l’image suivante, cet article présente les méthodes exactes qu’utilisent les professionnels pour préserver l’identité d’un personnage à travers les scènes générées par IA. Au programme : numéros de seed, ingénierie des prompts, flux de travail à partir de références et outils de plateforme qui rendent la cohérence accessible, et non fortuite.

Comment garder des personnages IA cohérents dans chaque scène
Cristian Da Conceicao
Fondateur de Picasso IA

Garder un personnage IA cohérent sur plusieurs images est l’un des problèmes les plus frustrants de l’art généré par IA. Vous générez un visage parfait le mardi, essayez de le recréer le mercredi, et le personnage ressemble à une personne totalement différente. Cela arrive parce que la plupart des modèles de diffusion sont sans état, c’est-à-dire qu’ils n’ont aucune mémoire de ce qu’ils ont généré auparavant.

Mais la cohérence est possible. Les professionnels qui travaillent sur les BD IA, les storyboards et les visuels de produits ont mis au point des systèmes fiables pour conserver le même personnage intact sur des dizaines de scènes. Voici exactement comment ils procèdent.

Pourquoi les personnages changent

Le problème de fond des modèles de diffusion

À chaque fois que vous lancez un générateur d’images IA, il repart de zéro. Aucune mémoire intégrée ne conserve la couleur des yeux, la forme du nez ou la texture des cheveux de votre personnage. Le modèle interprète votre prompt texte à chaque fois, ce qui explique que deux générations de « une femme aux cheveux bruns et aux yeux bleus » puissent produire des personnes radicalement différentes.

Ce n’est pas un bug. C’est la nature même de la génération probabiliste. Le modèle puise dans une distribution immense d’images possibles, et chaque tirage est légèrement différent.

Ce que « cohérent » veut vraiment dire

Une véritable cohérence signifie que les traits physiques essentiels du personnage, la structure osseuse, la forme des yeux, le teint et les proportions entre les traits restent identiques d’un contexte à l’autre. La tenue, l’éclairage et la pose peuvent changer. Le visage, lui, ne doit pas changer.

Triptyque d’un personnage montrant des traits du visage cohérents sous trois angles

La plupart des gens confondent « ressemblant » et « cohérent ». Un personnage qui paraît à peu près le même sur la plupart des images n’est pas cohérent. Un personnage dont la mâchoire, la forme des lèvres et l’écartement des yeux restent identiques sur chaque génération, lui, l’est.

Commencez par la fiche de personnage

Les 5 repères physiques

Avant de générer la moindre image, il vous faut une fiche de personnage écrite qui fixe cinq repères physiques :

  1. Forme du visage : ovale, carré, en cœur, rond, allongé
  2. Détails des yeux : couleur, forme (en amande, rond, tombant) et écartement
  3. Structure du nez : largeur de l’arête, forme du bout, ailes du nez
  4. Teint : descripteurs précis comme « olive chaud », « ivoire froid », « ébène profond »
  5. Cheveux : couleur, texture, coupe et longueur en termes précis

N’écrivez pas « beaux cheveux bruns ». Écrivez « cheveux châtain foncé aux épaules, avec de légers reflets, une légère ondulation et une raie sur le côté gauche ». Plus vous êtes précis, moins le modèle doit interpréter.

Directrice artistique examinant des fiches de référence de personnages sur une table lumineuse

Rédigez-la comme une fiche de casting

Considérez votre fiche de personnage comme une fiche de casting pour une production de cinéma. Les directeurs de casting décrivent les acteurs avec un détail physique obsessionnel, car un autre acteur à la scène 4 peut ruiner tout le film.

Rédigez la description de votre personnage en un seul paragraphe dense, et non en liste à puces. Ce paragraphe devient ce que les professionnels appellent le « bloc personnage », et il est copié mot pour mot dans chaque prompt.

💡 Astuce : Gardez votre bloc personnage sous 120 mots. Les blocs trop longs entrent en concurrence avec la description de la scène et peuvent réduire la cohérence au lieu de l’améliorer.

Le numéro de seed est votre arme secrète

Comment fonctionnent les seeds

Chaque image IA est générée à partir d’une seed aléatoire, un nombre qui initialise le processus de génération. Si vous utilisez la même seed avec le même prompt, vous obtenez la même image. Si vous modifiez légèrement le prompt en gardant la seed, l’image change tout en conservant une partie de la structure sous-jacente, y compris la géométrie du visage.

Interface des réglages du numéro de seed sur un écran d’ordinateur

C’est l’outil de cohérence le plus sous-utilisé à la disposition de quiconque génère de l’art IA. Dès que vous générez un personnage qui vous plaît, notez immédiatement son numéro de seed. Conservez-le dans votre fiche de personnage.

Quand figer et quand changer

Figez votre seed lorsque :

  • Vous générez plusieurs poses du même personnage
  • Vous testez différentes variations de tenue
  • Vous créez une continuité d’une scène à l’autre pour une BD ou un storyboard

Changez de seed lorsque :

  • Vous passez à une autre émotion ou expression où la seed vous résiste
  • Vous vieillissez le personnage ou le transformez radicalement
  • Vous créez un tout nouveau personnage

💡 Astuce : Certaines plateformes permettent d’utiliser des plages de seeds, où des numéros voisins produisent des résultats similaires sans être identiques. Essayez des seeds à plus ou moins 50 de votre seed d’origine pour trouver des variantes qui maintiennent la cohérence tout en offrant de la variété.

L’ingénierie des prompts au service de la cohérence

La formule du bloc personnage

Voici la formule exacte qu’utilisent les professionnels pour les prompts de personnages cohérents :

[Mise en place de la scène] + [Bloc personnage] + [Action/Pose] + [Environnement] + [Éclairage] + [Caméra/Technique]

Le bloc personnage ne change jamais. Le reste du prompt s’adapte à la scène.

Exemple de bloc personnage : « jeune femme, 28 ans, visage ovale, yeux bruns foncés en amande, pommettes hautes et marquées, nez petit et droit, lèvres pleines, teint olive chaud, cheveux bruns foncés ondulés aux épaules, silhouette élancée et athlétique »

Ce bloc entre dans chaque prompt, que le personnage se trouve sur une plage ou dans un bureau.

3 erreurs courantes dans les prompts

ErreurCe qui ne va pasCorrection
Descripteurs vagues« belle femme » génère une nouvelle personne à chaque foisUtilisez 8 descripteurs physiques précis ou plus
Placer le bloc personnage à la finLe modèle pondère davantage les premiers tokensPlacez toujours le bloc personnage avant la description de la scène
Modifier un mot du bloc« cheveux bruns » et « cheveux bruns ondulés » déplacent sensiblement la générationCopiez-collez le bloc, ne le retapez jamais

💡 Astuce : Enregistrez votre bloc personnage comme extrait de texte dans un outil de notes. Un seul geste suffit pour le coller dans n’importe quel champ de prompt.

Les outils qui facilitent la cohérence

Portrait Series sur PicassoIA

Le modèle Portrait Series de PicassoIA est conçu spécifiquement pour générer plusieurs portraits de la même personne. Il a été pensé pour traiter directement le problème central de la cohérence, ce qui en fait l’un des outils les plus pratiques pour le travail sur les personnages.

Contrairement aux modèles généralistes, Portrait Series utilise un conditionnement par référence qui ancre la géométrie du visage d’une génération à l’autre. Importez une image de référence de votre personnage, et le modèle s’en sert comme guide structurel pour chaque génération suivante.

Même personnage restant cohérent dans différents décors de scène

Flux Redux pour les variations de scène

Flux Redux Schnell prend une image existante et génère des variations qui conservent l’identité visuelle de l’original. Pour la cohérence d’un personnage, cela signifie que vous partez de votre génération de personnage idéale et que vous utilisez Redux pour le placer dans de nouvelles scènes, poses ou conditions d’éclairage.

Le flux de travail se déroule ainsi :

  1. Générez votre image « maîtresse » du personnage
  2. Donnez-la à Flux Redux Schnell
  3. Décrivez la nouvelle scène ou la nouvelle pose
  4. Le modèle conserve l’apparence de votre personnage tout en appliquant le nouveau contexte

C’est nettement plus fiable que d’essayer de recréer un personnage à partir d’un simple prompt texte.

Flux Canny Pro pour le contrôle structurel

Flux Canny Pro extrait la carte des contours structurels d’une image existante et l’utilise comme contrainte stricte pour les nouvelles générations. Pour les personnages, cela permet de figer la structure osseuse et les proportions tout en changeant l’éclairage, les couleurs ou le style.

Si votre personnage a une silhouette distinctive ou des proportions très spécifiques, le contrôle Canny garantit que ces proportions se maintiennent d’une génération à l’autre.

SDXL comme modèle de base fiable

SDXL reste l’un des modèles de base les plus fiables pour la génération de personnages, car son architecture répond de façon très prévisible aux descripteurs physiques détaillés. De nombreux artistes professionnels de personnages utilisent SDXL comme base principale pour établir un personnage, puis recourent à des outils basés sur Flux pour les variations de scène.

Graphiste examinant des échantillons de couleurs assortis aux imprimés d’un personnage

Bien utiliser les images de référence

Ce qui fait une bonne image de référence

Une image de référence pour la cohérence d’un personnage doit être :

  • Expression neutre : Le sourire ou la grimace exagère les traits et perturbe les générations suivantes
  • Vue de face ou angle léger de 3/4 : Les profils masquent trop de traits sur lesquels le modèle peut s’appuyer
  • Éclairage uniforme : Une lumière diffuse et égale, sans ombres marquées, révèle toute la structure du visage
  • Arrière-plan minimal : Un arrière-plan chargé entre en concurrence avec les données du visage lors du conditionnement
  • Haute résolution : Plus de détails donnent au modèle davantage de points d’appui

L’erreur la plus fréquente consiste à utiliser comme référence une image très stylisée ou à l’éclairage marqué. Le modèle apprend le style et l’éclairage comme faisant partie du personnage, et non seulement le visage.

Femme aux traits cohérents marchant avec assurance dans une rue de la ville à l’heure dorée

Échange de visage ou transfert de style

Ce sont deux approches de cohérence différentes, que l’on confond sans arrêt :

L’échange de visage prélève un visage précis sur une image de référence et le transplante sur un corps généré. Le résultat est photoréaliste et très cohérent, mais il exige une photo de référence réelle, et le rendu reste lié à l’éclairage et à la texture de ce visage particulier.

Le transfert de style préserve le style artistique d’un personnage (couleur des cheveux, teint, proportions générales) sans s’ancrer dans un visage photoréaliste précis. Il est plus souple, mais moins précis.

Pour les personnages fictifs et les créations nativement IA, le transfert de style avec SDXL ControlNet LoRA offre le meilleur équilibre entre souplesse et cohérence.

Tester votre personnage dans différentes scènes

Le test des 5 scènes

Avant de vous engager sur un design de personnage, lancez ce que les professionnels appellent le test des 5 scènes. Générez le même personnage dans ces cinq contextes radicalement différents :

  1. Intérieur neutre : bureau, bibliothèque ou cuisine avec un éclairage plat
  2. Lumière dure en extérieur : soleil de midi tombant verticalement
  3. Scène de nuit : éclairage artificiel, contraste élevé
  4. Gros plan portrait : remplissant 80 % du cadre
  5. Plan en pied : personnage visible de la tête aux pieds

Si le personnage reste reconnaissable dans les cinq, votre prompt et votre flux de travail sont solides. S’il dérive dans l’un de ces contextes, c’est que celui-ci fragilise votre système de cohérence, et il faut le corriger.

Comparaison en écran partagé entre une génération de personnage IA cohérente et une génération incohérente

Quand recommencer et quand affiner

Recommencez lorsque :

  • La structure du visage a changé (une autre ossature, et pas seulement l’expression)
  • Plus de 3 des 5 repères ne correspondent plus
  • La seed qui fonctionnait a cessé de fonctionner après une mise à jour du modèle

Affinez lorsque :

  • Le teint est légèrement décalé mais le visage est juste
  • La couleur des cheveux a dérivé mais le visage est intact
  • La pose est maladroite mais le visage est correct

Affiner consiste à ajouter des prompts négatifs pour l’élément qui dérive, ou à ajuster légèrement les poids du modèle. Recommencer suppose une nouvelle seed et un bloc personnage revu.

Tenez des notes détaillées

Mains rédigeant des notes détaillées sur un personnage dans un carnet en cuir

Les professionnels qui maintiennent la cohérence pendant des mois de travail partagent tous une même habitude : une documentation obsessionnelle. Chaque génération réussie est consignée avec sa seed, son prompt, son modèle et ses réglages. Chaque génération ratée reçoit une note sur ce qui a cassé.

Cela paraît fastidieux jusqu’au moment où vous devez recréer un personnage trois mois plus tard et où votre mémoire des mots exacts employés s’est estompée. Les notes sont ce qui rend la cohérence durable, et non simplement possible une seule fois.

💡 Astuce : Utilisez Flux Schnell LoRA pour itérer rapidement lorsque vous testez des variations de personnage. Sa rapidité vous permet de faire le test des 5 scènes en quelques minutes plutôt qu’en quelques heures, ce qui rend la documentation beaucoup moins pénible.

La cohérence à grande échelle : l’entraînement de LoRA

Lorsque vous avez besoin qu’un personnage reste cohérent sur des centaines d’images, l’ingénierie des prompts et les seeds finiront par atteindre leurs limites. À ce niveau, les professionnels entraînent un LoRA (Low-Rank Adaptation) dédié à leur personnage.

Un LoRA de personnage est une petite couche de modèle affinée, entraînée sur 15 à 30 images de votre personnage. Une fois entraînée, l’ajout de ce LoRA à n’importe quelle génération signifie que le modèle « connaît » désormais votre personnage et le reproduira de façon fiable, sans qu’un long bloc personnage soit nécessaire.

Le framework SDXL ControlNet LoRA de PicassoIA prend en charge le conditionnement structuré des personnages, en combinant contrôle structurel et souplesse du conditionnement LoRA.

Tirages Polaroid du même personnage aux traits parfaitement assortis

Pour la plupart des créateurs, l’entraînement de LoRA est la destination finale dès qu’un personnage devient central dans un travail continu. Il élimine la dépendance à la maîtrise du prompt et rend la cohérence presque automatique.

Commencez à créer vos propres personnages cohérents

La cohérence des personnages dans la génération IA est une compétence, pas une question de chance. Elle demande de construire un système réfléchi avant même d’ouvrir un outil de génération.

La progression est claire : commencez par une fiche de personnage écrite et détaillée, figez une seed dès que vous trouvez une génération qui vous plaît, utilisez votre bloc personnage avec rigueur dans chaque prompt, et appuyez-vous sur des outils comme Portrait Series, Flux Redux Schnell et Flux Canny Pro pour étendre votre personnage à de nouvelles scènes sans perdre son identité.

PicassoIA vous donne accès à tous ces outils au même endroit, des modèles de base texte vers image aux conditionneurs de portrait spécialisés et aux contrôles structurels. Que vous construisiez des personnages pour un roman graphique, une série de contenus ou des visuels de marque, la plateforme propose les outils précis qui rendent la cohérence accessible, et non fortuite.

Choisissez un personnage. Rédigez sa fiche. Lancez le test des 5 scènes. Vous serez surpris de voir à quelle vitesse une approche méthodique transforme un processus frustrant en un flux de travail créatif fiable.

Partager cet article

Choisissez votre langue