Créez votre propre modèle d’IA 18+ avec Seedream 5.0

Seedream 5.0 est le modèle de génération d’images le plus performant de ByteDance à ce jour. Avec la bonne approche d’entraînement LoRA, vous pouvez créer une IA 18+ personnalisée qui génère du contenu pour adultes cohérent, photoréaliste et sans restrictions. Cet article couvre la constitution du jeu de données, les paramètres d’entraînement, les flux de génération et l’upscaling, dans une ressource complète pour les créateurs qui veulent un contrôle total sur leurs résultats d’IA.

Créez votre propre modèle d’IA 18+ avec Seedream 5.0
Cristian Da Conceicao
Fondateur de Picasso IA

Si vous générez des images par IA depuis un moment, vous connaissez déjà la limite. Des modèles génériques, des résultats filtrés et des personnages qui changent d’une image à l’autre. La seule vraie solution est un modèle personnalisé, entraîné sur votre sujet, votre style ou votre esthétique spécifiques. Seedream 5.0 rend cela plus accessible que jamais et, associé à la bonne plateforme pour l’inférence, les résultats sont vraiment saisissants.

Voici ce qu’il faut vraiment savoir pour en construire un à partir de zéro.

Ce qu’apporte Seedream 5.0

ByteDance a publié Seedream 5.0 sous la forme d’un modèle de diffusion basé sur un transformeur, doté de 8 milliards de paramètres. Il marque un progrès notable par rapport à ses prédécesseurs en matière de justesse anatomique, de réalisme de la texture de la peau et de respect du prompt. Le modèle a été entraîné sur un jeu de données beaucoup plus vaste et plus varié que celui de Seedream 4.x, ce qui se traduit par une meilleure généralisation lors du fine-tuning sur de petits jeux de données personnels.

Pour les créateurs qui travaillent sur du contenu 18+ à personnages cohérents, deux améliorations ressortent particulièrement. L’anatomie des mains est nettement meilleure. Le problème des doigts en trop, qui affectait les modèles précédents, est en grande partie résolu. La cohérence du visage d’une génération à l’autre est aussi plus forte, ce qui rend la conservation de l’identité pendant l’entraînement LoRA beaucoup plus fiable.

Femme élégante en combinaison en soie transparente dans un studio blanc minimaliste, photographie éditoriale

8 milliards de paramètres et ce que cela implique

Davantage de paramètres ne garantit pas toujours de meilleurs résultats, mais dans le cas de Seedream 5.0, cette taille améliore directement les résultats qui comptent pour l’entraînement d’un modèle personnalisé. Un modèle plus grand capture davantage de complexité dans son espace latent, ce qui signifie que votre LoRA n’a pas besoin de peiner autant pour se tailler une identité cohérente dans les poids du modèle.

Concrètement : vous pouvez entraîner le modèle sur moins d’images et obtenir tout de même des résultats cohérents. Les modèles précédents exigeaient 50 à 100+ images d’entraînement de haute qualité pour obtenir une identité stable. Avec Seedream 5.0, 20 à 30 images bien sélectionnées peuvent suffire pour produire un personnage fiable.

Seedream 5.0 ou 5 Lite : ce choix compte

VersionParamètresContenu 18+Vitesse moyenne
Seedream 5.0 (complet)8BPris en charge12-20 s
Seedream 5 Lite2BBloqué4-6 s
Seedream 4.57BPris en charge14-22 s

Seedream 5 Lite n’est pas une option pour la génération d’images IA pour adultes. Ses filtres de sécurité fonctionnent au niveau du modèle et non de l’interface, ce qui signifie qu’aucun prompt négatif, aucun fine-tuning ni aucun contournement ne suffira à les contourner. N’utilisez pas Seedream 5 Lite pour du contenu 18+. Si une plateforme affirme proposer « Seedream pour le NSFW » avec la version Lite, elle est soit mal informée, soit elle vous induit en erreur.

Pour des résultats non censurés, utilisez Seedream 5.0 complet ou Seedream 4.5.

Pourquoi Seedream 4.5 est le cheval de bataille du NSFW

Voici une réalité contre-intuitive : pour la génération d’images IA 18+ en particulier, Seedream 4.5 donne souvent de meilleurs résultats que 5.0, alors que 5.0 est techniquement le modèle le plus récent et le plus performant.

La raison tient à la répartition des données d’entraînement. Le jeu d’entraînement massif de Seedream 5.0 contient proportionnellement moins de contenu pour adultes dans les poids appris, ce qui le rend moins sensible à cet univers esthétique, même lorsqu’il n’est pas censuré. Seedream 4.5 bénéficie d’une communauté plus large d’entraîneurs de LoRA qui produisent du contenu pour adultes à partir de ce modèle, ce qui signifie qu’une représentation plus dense de cet univers esthétique existe déjà dans son espace latent.

Lorsque vous faites un fine-tuning d’un LoRA sur Seedream 4.5, le modèle connaît déjà le terrain. Le LoRA n’a qu’à établir « cette personne précise, ce style précis », au lieu d’apprendre aussi au modèle de base à quoi ressemble du contenu pour adultes depuis le début.

Jeune femme sûre d’elle en bralette noire sur une terrasse de toit européenne au crépuscule, horizon de la ville

Résultats stables, zéro filtre

Seedream 4.5 prend nativement en charge les résultats non censurés. Il n’y a ni filtres de sécurité à l’exécution, ni classificateurs de contenu qui interceptent vos appels d’inférence, ni listes noires de mots-clés dans le pipeline de prompts. Ce que vous demandez dans le prompt est ce que vous obtenez, à condition que le prompt soit bien construit.

Cette stabilité s’étend aussi à la génération par lots. Lorsque vous générez 50 ou 100 images en lot, Seedream 4.5 produit une fidélité de personnage plus cohérente sur l’ensemble, ce qui est important si vous construisez du contenu autour d’une persona ou d’une identité visuelle précise.

💡 Recommandation : commencez par Seedream 4.5 pour votre premier modèle personnalisé 18+. Une fois que vous avez un LoRA fonctionnel, testez-le sur Seedream 5.0 et comparez les résultats. Beaucoup de créateurs finissent par utiliser les deux, selon le rendu précis qu’ils recherchent.

Face à face : quand 5.0 l’emporte

Cela dit, Seedream 5.0 a un réel avantage dans certains scénarios :

  • Prompts plus longs : 5.0 gère mieux la cohérence des prompts comportant plusieurs propositions
  • Complexité de l’arrière-plan : 5.0 génère des environnements et des scènes plus détaillés
  • Compositions inhabituelles : les cadrages en contre-plongée, aériens et non standard sont plus fiables avec 5.0
  • Mains et pieds : l’amélioration anatomique de 5.0 est la plus visible dans ces zones

Pour du contenu 18+ centré sur le personnage, où le visage et le corps sont le sujet principal, 4.5 l’emporte souvent en matière de style et d’esthétique. Pour les scènes complexes comportant plusieurs éléments, 5.0 prend l’avantage.

Vue aérienne en plongée d’une femme en bikini corail allongée à côté d’une piscine à débordement, reflets de lumière caustique

Constituer un jeu de données qui fonctionne vraiment

La qualité de vos données d’entraînement est le facteur le plus déterminant du résultat final de votre modèle. Aucun réglage d’hyperparamètres ne compense un jeu de données faible.

Combien d’images et de quel type

Pour un LoRA centré sur un personnage visant des résultats 18+ :

  • Minimum : 20 images (Seedream 5.0 et 4.5 gèrent très bien ce nombre)
  • Plage optimale : 40 à 60 images
  • Rendements décroissants : au-delà de 80 images, les gains de qualité deviennent marginaux

Les images doivent présenter une variété de poses, d’angles, d’éclairages et de tenues. Un jeu de 50 images prises toutes dans la même pièce, avec le même éclairage, est moins bon que 20 images prises dans des conditions réelles variées. Le modèle doit apprendre l’identité du sujet, et non mémoriser une seule configuration photographique précise.

Normes de qualité des images

ExigenceNorme minimale
Résolution512x512 minimum, 1024 px de préférence
Visibilité du visageNet et dégagé sur au moins 80 % des images
Format de fichierJPG ou PNG, sans artefacts de compression marqués
LégendesGénérées automatiquement via le tagger WD14 ou le modèle de vision LLaVA
RecadrageRecadrage centré sur le sujet, arrière-plan superflu réduit au minimum
VariétéAu moins 5 conditions d’éclairage différentes sur l’ensemble

💡 À éviter : les captures d’écran de vidéos, les images de réseaux sociaux très filtrées avec un lissage de peau prononcé, ou les images comportant plusieurs personnes dans le cadre. Chacun de ces éléments dégrade la cohérence de l’identité dans votre modèle entraîné.

Les légendes sont souvent négligées, pourtant elles sont essentielles. Avec P Image Trainer sur PicassoIA, vous pouvez générer automatiquement les légendes lors de l’import. Le pipeline de légendage utilise un modèle de vision pour décrire chaque image, puis intègre cette description au signal d’entraînement afin d’aider le LoRA à comprendre dans quel contexte apparaît le sujet.

Portrait en gros plan extrême d’une belle femme aux yeux bruns, éclairage Rembrandt, texture de peau hyperréaliste et détail des pores

Entraîner votre LoRA personnalisé sur PicassoIA

P Image Trainer est le chemin le plus rapide entre le jeu de données et un LoRA déployable sur PicassoIA. L’interface gère l’essentiel du pipeline d’entraînement tout en vous laissant suffisamment de contrôle sur les paramètres pour obtenir des résultats pertinents, sans avoir à gérer votre propre infrastructure GPU.

Configuration étape par étape

Étape 1 : préparez le dossier de votre jeu de données

Rangez vos images dans un seul dossier. Nommez-le avec le nombre de répétitions et votre mot déclencheur, par exemple : 20_myperson. Le nombre indique à l’entraîneur combien de fois répéter le jeu de données par époque.

Étape 2 : importez les images et définissez votre mot déclencheur

Votre mot déclencheur est celui que vous utiliserez ensuite dans les prompts pour activer l’influence du LoRA. Choisissez quelque chose d’unique, qui n’apparaîtra pas naturellement dans les prompts courants. ohwx, zdjperson, tok ou un nom inventé conviennent tous très bien. Évitez les mots courants auxquels le modèle de base est déjà fortement associé.

Étape 3 : configurez les paramètres d’entraînement

ParamètreValeur recommandéeRemarques
Modèle de baseSeedream 4.5Privilégié pour les résultats 18+
Taux d’apprentissage1e-4Commencez ici, abaissez-le si vous observez du surapprentissage
Époques10 à 20Vérifiez les échantillons à intervalles réguliers
Résolution512 ou 768Adaptez-la à la préparation de votre jeu de données
Rang du réseau32 à 64Plus élevé pour les sujets complexes ou les jeux de données variés
Alpha du réseau16 à 32La moitié du rang du réseau constitue un bon point de départ

Étape 4 : surveillez les échantillons d’entraînement

P Image Trainer génère des images d’échantillon à intervalles réguliers pendant l’entraînement. Surveillez le moment où les échantillons montrent une cohérence d’identité claire. Si le modèle « surapprend » (les résultats ressemblent à une photo copiée plutôt qu’à une image générée avec de nouvelles poses ou de nouveaux réglages), réduisez le nombre d’époques ou abaissez le taux d’apprentissage.

Étape 5 : exportez et testez

Une fois l’entraînement terminé, le LoRA est disponible pour l’inférence. Testez-le d’abord avec un prompt neutre : photo of ohwx, realistic, 8k. Si l’identité ressort clairement dans des contextes variés, vous êtes prêt à rédiger des prompts 18+ avec un contrôle total du style.

Grande femme marchant sur une plage caribéenne déserte à l’heure dorée, vue de dos, bikini blanc à cordelettes, sable mouillé

Générer des images 18+ sans limites

Une fois votre LoRA entraîné, c’est au moment de la génération que PicassoIA Image Editor Pro devient l’outil le plus précieux de votre flux de travail. Il propose des générations illimitées, sans coût en crédits par image, ce qui compte énormément lorsque vous itérez sur des dizaines de prompts pour trouver les réglages optimaux de votre LoRA personnalisé.

PicassoIA Image Editor Pro : aucun plafond de crédits

PicassoIA Image Editor Pro est la principale plateforme de génération d’images 18+ illimitée sur PicassoIA. Contrairement à la plupart des plateformes d’IA qui facturent chaque génération ou limitent la production derrière des systèmes de crédits, Image Editor Pro vous donne un accès sans plafond aux séries de génération. Lorsque vous lancez des centaines de résultats de test pour affiner le comportement de votre LoRA personnalisé selon différentes poses et réglages, c’est la différence entre un flux de travail abordable et un flux au coût prohibitif.

La plateforme prend en charge Seedream 4.5 pour la génération NSFW, qui s’associe directement au flux de travail d’entraînement LoRA décrit plus haut.

Formules de prompts pour des résultats cohérents

Les prompts 18+ efficaces ont une structure constante. Voici la formule qui fonctionne de façon fiable :

[trigger word], [subject description], [clothing/state], [pose or action], [setting], [lighting condition], [quality modifiers]

Exemple :

ohwx woman, wearing minimal red bikini, standing at pool edge, tropical resort, golden hour backlighting, photorealistic, 8k, film grain, Kodak Portra 400

Modificateurs de qualité qui fonctionnent bien avec Seedream 4.5 :

  • photorealistic, RAW photo, 8k resolution
  • Kodak Portra 400, film grain, natural lighting
  • 85mm f/1.4 lens, shallow depth of field
  • hyperrealistic skin texture, visible pore detail

Prompts négatifs à toujours inclure :

  • cartoon, illustration, CGI, 3D render, anime, digital art
  • deformed hands, extra fingers, blurry, low quality, artifacts
  • watermark, signature, text overlay, logo
  • plastic skin, airbrushed, oversmoothed

💡 Approche pro : verrouillez votre numéro de seed lorsque vous trouvez une composition qui vous plaît. Modifier uniquement la tenue ou le décor en conservant le seed produit des variations de personnage bien plus cohérentes qu’une génération purement aléatoire.

Poste de travail à double écran d’un photographe professionnel affichant des comparaisons de portraits générés par IA à différentes étapes, installation de studio

Contrôle du style et effets visuels

L’un des flux de travail les plus puissants pour les modèles personnalisés 18+ consiste à combiner votre LoRA de personnage avec des LoRA de style. Cela vous permet de maintenir la cohérence de l’identité tout en faisant évoluer l’esthétique, de la photographie réaliste vers un éclairage dramatique, ou vers des proportions corporelles spécifiques ou des styles vestimentaires précis.

Mélanger les LoRA pour des looks uniques

Sur PicassoIA Image, vous pouvez empiler plusieurs LoRA simultanément. L’approche standard pour les empiler :

  • LoRA de personnage avec un poids de 0,8 à 1,0 (votre modèle d’identité entraîné)
  • LoRA de style avec un poids de 0,3 à 0,5 (esthétique d’éclairage, style vestimentaire ou look artistique)
  • LoRA d’amélioration des détails avec un poids de 0,2 à 0,4 (texture de la peau, netteté, gain de réalisme)

Des poids supérieurs à 1,0 ont tendance à saturer l’influence du LoRA, ce qui produit des artefacts ou des traits exagérés qui cassent le photoréalisme. Gardez le LoRA de personnage comme signal dominant.

💡 Quand les LoRA entrent en conflit : si deux LoRA tirent dans des directions esthétiques opposées, réduisez les deux poids de 0,2 et utilisez un langage de prompt plus affirmé pour guider le rendu final. Le prompt exerce toujours une influence importante aux côtés des poids des LoRA.

Femme au teint olive en body en dentelle crème, allongée sur une chaise longue vintage dans un appartement parisien baigné de soleil

Contrôle de la pose et de la composition

Pour un contrôle précis de la pose du sujet sans avoir à réentraîner le modèle, la plateforme de PicassoIA prend en charge les flux de travail compatibles ControlNet. Importez une image de référence ou une pose en squelette en bâtonnets, et la génération épousera cette structure tout en appliquant l’identité de votre LoRA et le style de votre prompt.

C’est particulièrement utile pour le contenu 18+ où des poses ou compositions précises comptent pour la direction créative. Vous obtenez l’identité grâce à votre LoRA, la pose exacte grâce à la référence ControlNet et la scène grâce à votre prompt. Les trois entrées se combinent au lieu de se faire concurrence.

Trois modes ControlNet fiables pour les travaux 18+ :

  1. OpenPose : contrôle le squelette du corps et la position des articulations
  2. Depth Map : contrôle la superposition spatiale, utile pour les scènes complexes
  3. Canny Edge : contrôle les détails fins et les contours, utile pour les spécificités vestimentaires

Femme en chemise blanche oversize et short en jean devant un mur de béton brut, décor industriel, photographie de mode éditoriale

Upscaling de vos résultats en 8K

Les résultats standard de Seedream 5.0 et 4.5 font généralement de 512 à 1024 px selon vos réglages. Pour la livraison finale, l’affichage sur grand écran ou simplement la meilleure qualité possible, faire passer vos images dans un upscaler IA est la dernière étape d’un flux de travail professionnel.

PicassoIA propose plusieurs modèles d’upscaling, chacun ayant des points forts différents selon le type d’image à upscaler.

Quel upscaler pour quel usage

UpscalerIdéal pourÉchelle maxLien
Crystal UpscalerDétail des portraits, peau, visage4xSpécialiste des portraits
Clarity Pro UpscalerPlans en pied, scènes complexes4xGénéraliste des scènes
Image Upscale by TopazRésolution maximale, tout sujet6xPlafond le plus élevé
Real ESRGANUpscaling rapide et gratuit4xPriorité à la vitesse
Increase ResolutionTraitements par lots4xFlux de travail en volume
P Image UpscaleRésultats nets rapidement2 à 4xRésultat en une seconde

Pour les portraits 18+, Crystal Upscaler est le premier outil auquel faire appel. Il est spécifiquement entraîné sur des portraits photoréalistes et améliore la texture de la peau, le détail des cheveux et les traits du visage, sans introduire les artefacts de lissage que tendent à ajouter les upscalers généralistes.

Pour les plans en pied ou les scènes à arrière-plan complexe, Clarity Pro Upscaler gère mieux le contexte élargi et préserve le détail des contours sur l’ensemble du cadre, et pas seulement sur le visage.

Pour la résolution maximale absolue, Image Upscale by Topaz propose un agrandissement 6x, qui fait passer une image de 512 px à plus de 3000 px en haute qualité.

Comparaison de portraits côte à côte montrant à gauche le résultat IA d’origine flou, et à droite le résultat upscalé par IA en 8K

Le flux de travail complet d’upscaling

  1. Générez votre image à la résolution de base (512 à 1024 px) avec votre LoRA entraîné
  2. Inspectez le résultat à 100 % de zoom pour repérer les artefacts majeurs avant l’upscaling
  3. Pour les portraits : envoyez l’image vers Crystal Upscaler en 4x comme première passe
  4. Si vous avez besoin de davantage de résolution, enchaînez avec Topaz Image Upscale en 2x pour un résultat combiné de 8x
  5. Téléchargez l’image et effectuez un dernier contrôle qualité en pleine résolution

💡 Un point de vigilance : les upscalers IA « corrigent » parfois des éléments qu’ils interprètent comme des artefacts, ce qui peut modifier certaines caractéristiques corporelles d’une façon que vous n’aviez pas prévue. Si un upscaler modifie des zones qu’il ne devrait pas toucher, essayez plutôt Crystal Upscaler ou Clarity Pro, qui ont tendance à être plus fidèles à l’image source que les modèles généralistes.

Ce que vous pouvez construire à partir de là

Un LoRA entraîné sur Seedream 4.5 ou 5.0, utilisé avec PicassoIA Image Editor Pro, vous offre un pipeline personnel complet de contenu IA 18+, sans coût par image, sans restrictions de contenu et avec un contrôle créatif total sur l’identité et le style.

Femme en pyjama de soie vert sauge au bord d’une chambre minimaliste, baies vitrées du sol au plafond ouvrant sur la ville à l’aube

Le flux de travail de cet article fonctionne tout aussi bien pour plusieurs usages créatifs :

  • Personas IA cohérentes avec le même visage et le même type de corps sur l’ensemble des contenus
  • Création de personnages fantastiques pour la fiction et l’illustration destinées aux adultes
  • Projets créatifs personnalisés construits à partir d’un jeu de données soigneusement sélectionné
  • Expérimentation de styles en appliquant plusieurs LoRA esthétiques à une même identité entraînée

La bibliothèque de modèles de PicassoIA va bien au-delà de Seedream. Il existe 91 modèles de texte vers image disponibles, dont des versions de Flux et des dizaines de modèles communautaires spécialisés. La même approche d’entraînement LoRA avec P Image Trainer fonctionne avec la plupart des modèles de base. Une fois votre jeu de données prêt, vous pouvez donc tester plusieurs architectures pour trouver l’esthétique qui correspond le mieux à votre direction créative.

Le catalogue complet des modèles est disponible sur picassoia.com/en/all-models. Si Seedream 4.5 ne correspond pas à l’esthétique précise que vous recherchez, la bibliothèque compte des dizaines d’autres modèles de base qui y parviendront. Le flux de travail de jeu de données et d’entraînement LoRA reste le même quel que soit le modèle de base que vous choisissez.

Commencez par un petit jeu de données de 20 à 30 images, lancez votre premier entraînement avec P Image Trainer, et générez votre premier lot via PicassoIA Image Editor Pro. La boucle de retour de ce premier test vous indiquera précisément ce qu’il faut ajuster pour le second.

Partager cet article

Choisissez votre langue