La prochaine version de Llama pourrait enfin autoriser le chat NSFW

Meta prépare apparemment sa prochaine version de Llama pour autoriser, pour la première fois, les échanges NSFW, en levant des restrictions de contenu en vigueur depuis longtemps. Ce changement ouvre la porte aux chatbots IA pour adultes, à la fiction créative et à la génération de contenu explicite sur les plateformes open source du monde entier.

La prochaine version de Llama pourrait enfin autoriser le chat NSFW
Cristian Da Conceicao
Fondateur de Picasso IA

Le monde de l’IA open source connaît un changement majeur. Selon des informations qui circulent, la prochaine version de Llama de Meta autoriserait pour la première fois les échanges NSFW sans filtrage lourd par défaut, en abandonnant les restrictions strictes qui ont défini chaque version du modèle jusqu’ici. Si ces informations sont exactes, il s’agirait de l’un des changements de politique les plus importants de l’histoire des grands modèles de langage open source, et les développeurs, les opérateurs de plateformes pour adultes et les auteurs de fiction y prêtent déjà une attention particulière.

Pendant des années, faire tourner un modèle Llama sans censure supposait soit d’appliquer des fine-tunes tiers, soit d’accepter que les poids de base refusent une grande catégorie de prompts. La prochaine version pourrait changer tout cela à la source.

Des développeurs collaborent dans un bureau tech moderne et examinent des schémas de politique d’IA sur des tableaux blancs

Ce que cela change réellement pour Llama

Pourquoi Meta revoit ses règles de contenu

Meta a toujours présenté Llama comme un modèle open source conçu pour les chercheurs, les développeurs et les entreprises. La tension a toujours été la même : l’entreprise veut offrir une utilité maximale tout en évitant les retombées en matière d’image publique liées à son nom associé à des contenus explicites générés à grande échelle.

Ce qui semble changer, c’est la prise de conscience de Meta que l’approche actuelle crée un problème différent. Lorsqu’un modèle de base refuse par défaut les prompts courants à contenu pour adultes, la communauté des développeurs le fine-tune quand même pour le débrider. Résultat : Internet regorge de dérivés non censurés de Llama, dont la plupart ont des garde-fous bien plus faibles sur les contenus non explicites que l’original. Meta cumule les inconvénients : le modèle sert quand même au NSFW, mais Meta perd le contrôle de la sécurité avec laquelle les garde-fous non explicites sont mis en œuvre.

Le changement rapporté est plus nuancé qu’un simple interrupteur. L’idée semble être que les restrictions sur les contenus explicites devraient être une couche à activer volontairement appliquée par celui qui déploie le modèle, et non intégrée aux poids de base d’une façon qui génère des refus en plein milieu d’une conversation.

💡 Ce que cela signifie concrètement : les développeurs de plateformes pour adultes disposeraient d’un modèle de base propre et non censuré. Les développeurs d’applications pour enfants ou d’outils d’entreprise appliqueraient une couche de sécurité par-dessus. Ces deux scénarios deviendraient plus prévisibles et plus contrôlables.

La faille du fine-tuning qui existe déjà

Quiconque connaît l’écosystème Llama sait que des modèles non censurés existent depuis le lancement de Llama 2 7B Chat. Dans les semaines qui suivent chaque sortie de Llama, la communauté produit des variantes « abliterated » ou « uncensored » en supprimant les vecteurs de refus des poids du modèle. Ces fine-tunes circulent librement sur Hugging Face et les plateformes similaires.

Cela signifie que la politique de contenu stricte par défaut de Meta n’a jamais réellement empêché l’usage NSFW de Llama. Elle a seulement ajouté des frictions pour les développeurs qui veulent une base propre et bien entretenue, et contraint les plateformes pour adultes à s’appuyer sur des fine-tunes communautaires de qualité variable. Supprimer cette friction au niveau officiel revient, à bien des égards, simplement à reconnaître la réalité.

Gros plan de mains tapant sur un clavier mécanique avec une interface de chat IA qui brille sur un écran incurvé

Qui veut réellement un accès LLM sans censure

Les plateformes pour adultes qui réclament de vraies solutions

Le marché des plateformes pour adultes propulsées par l’IA a fortement grandi. Les sites proposant des compagnons IA, des chatbots de jeu de rôle et des services de fiction créative attirent régulièrement des millions d’utilisateurs par mois. Beaucoup de ces services fonctionnent actuellement avec des alternatives à GPT-4, des dérivés Llama fine-tunés ou des modèles spécifiques de fournisseurs plus petits.

La plainte principale de ces opérateurs est constante : les solutions actuelles impliquent des coûts annexes importants. Soit vous payez des tarifs API premium auprès d’un fournisseur aux politiques permissives, soit vous hébergez vous-même un modèle open source fine-tuné et vous assumez les coûts d’infrastructure et les compromis de qualité qui accompagnent les dérivés communautaires.

Une base Llama sans censure, proposée par Meta, résoudrait ces deux problèmes. Ce secteur aurait accès à un modèle à la pointe, maintenu et mis à jour par l’une des meilleures équipes de recherche en IA au monde, sans avoir à gérer la qualité des fine-tunes ni à payer des tarifs API premium.

💡 Le raisonnement économique est clair : les plateformes d’IA pour adultes représentent aujourd’hui un segment qui pèse plusieurs milliards de dollars. Un Llama officiel sans censure capterait directement ce marché du déploiement.

Chercheurs et auteurs de fiction aux besoins légitimes

Au-delà des plateformes pour adultes, une population importante et souvent négligée souhaite accéder à un LLM sans censure pour des usages entièrement non sexuels. Des criminologues qui étudient les schémas de communication du dark web, des auteurs qui écrivent des dialogues de méchants réalistes, des développeurs de jeux qui scénarisent des personnages moralement complexes et des chercheurs en sécurité qui explorent les techniques d’ingénierie sociale se heurtent tous au même mur.

Les filtres de contenu actuels sont des outils grossiers. Ils bloquent fréquemment des scénarios clairement fictifs, des analyses académiques de la violence et du crime, des écrits créatifs abordant des thèmes difficiles, et même l’analyse historique d’atrocités. Le coût de cette sur-restriction pèse le plus lourdement sur les chercheurs légitimes qui n’ont pas la formation technique nécessaire pour faire tourner leurs propres fine-tunes.

Un modèle Llama officiel plus permissif sur le NSFW offrirait à cette population une option bien entretenue, sans nécessiter de gestion de serveurs ni d’expertise en déploiement sur mesure.

Auditorium bondé lors d’une conférence communautaire sur l’IA open source, avec un écran de projection affichant des schémas de modèles Llama

Comment fonctionne le système de garde-fous actuel de Llama

Ce que Llama Guard 4 bloque réellement

L’approche de Meta en matière de modération de contenu a considérablement évolué. Llama Guard 4 12B est un modèle classificateur spécialisé, entraîné à repérer les contenus dangereux dans plusieurs catégories. Il fonctionne comme une couche séparée qui peut être appliquée aux entrées et sorties de n’importe quel LLM, en signalant les réponses qui entrent dans les catégories d’infraction définies.

La taxonomie actuelle des infractions comprend :

CatégorieDescription
S1 Crimes violentsInstructions pour des violences de masse, du terrorisme
S2 Crimes non violentsFraude, piratage, synthèse de drogues
S3 Crimes sexuelsScénarios non consentis, implication de mineurs
S4 Protection de l’enfanceTout contenu sexuel impliquant des mineurs
S5 DiffamationFausses déclarations nuisibles sur des personnes réelles
S6 Conseils spécialisésConseils médicaux, financiers ou juridiques dangereux
S7 Vie privéeDoxxing, instructions de surveillance
S8 Propriété intellectuelleReproduction directe de contenus protégés par le droit d’auteur
S9 Armes à létalité indiscriminéeInstructions sur les armes CBRN
S10 HaineContenu attaquant des caractéristiques protégées
S11 Suicide/automutilationMéthodes détaillées
S12 Contenu sexuelContenu pour adultes (configurable)
S13 ÉlectionsEntrave au vote, désinformation

Remarquez que S12 (Contenu sexuel) est explicitement listé comme configurable. C’est le cas depuis Llama Guard 2, qui reconnaît que le contenu pour adultes est un usage légitime pour certains déploiements. La prochaine version de Llama semble aller plus loin en rendant le modèle de base lui-même permissif sur S12 par défaut, au lieu d’obliger les déployeurs à configurer le classificateur de garde et à lutter en même temps contre les refus du modèle de base.

Où se situent les limites aujourd’hui

Llama 4 Scout Instruct et Llama 4 Maverick Instruct, les versions publiques actuelles, refusent fermement et systématiquement les contenus sexuels explicites. Ils abordent des sujets proches du contenu pour adultes, traitent des thèmes matures dans des contextes clairement littéraires et gèrent une gamme raisonnable d’écrits romantiques sans déclencher de refus stricts. Mais un jeu de rôle explicite prolongé ou une description graphique d’actes sexuels provoque des refus au niveau du modèle, quel que soit le prompt système.

La solution de contournement actuellement utilisée par les développeurs sérieux combine :

  1. Un prompt système personnalisé qui établit le contexte fictionnel ou créatif
  2. Une configuration de Llama Guard avec S12 désactivé
  3. En général, une base fine-tunée plutôt que le modèle instruct officiel

Ce processus en trois étapes est exactement la friction qu’une prochaine version officiellement permissive éliminerait.

Deux ingénieurs logiciels dans une salle serveur examinant une documentation de sécurité IA sur une tablette, entourés de baies de serveurs illuminées

Llama 4 face à la suite

Les performances actuelles de Scout et Maverick

Llama 4 Scout Instruct utilise une architecture à mélange d’experts avec 17 milliards de paramètres actifs (109 Md au total), ce qui lui donne de solides performances en raisonnement complexe, en tâches à long contexte et en écriture créative dans les limites de sa politique de contenu. Il gère des fenêtres de contexte de 10 millions de tokens, ce qui le rend exceptionnel pour la fiction longue, l’analyse de documents et les projets créatifs étendus.

Llama 4 Maverick Instruct va plus loin avec 17 milliards de paramètres actifs issus d’un ensemble de 400 milliards, offrant des performances comparables à celles des meilleurs modèles sur le code, le raisonnement et les tâches multimodales. Les deux modèles sont disponibles directement sur PicassoIA, ce qui vous permet de tester leurs capacités actuelles et leur gestion des contenus sans aucune installation locale.

Ce que la prochaine version pourrait changer

Les changements évoqués semblent porter sur deux points précis. D’abord, les données de fine-tuning d’instructions de la prochaine version incluraient, selon les informations, du contenu explicite, ce qui entraînerait le modèle à traiter naturellement les prompts pour adultes au lieu de les refuser. Ensuite, le prompt système par défaut n’inclurait plus de consignes de restriction de contenu, cette responsabilité revenant entièrement au déployeur.

Selon les informations disponibles, ce qui ne changerait pas, ce sont les restrictions codées en dur sur les contenus impliquant des mineurs (S4), les instructions pour les armes de destruction massive (S9) et les contenus conçus pour faciliter la violence dans le monde réel. Ces restrictions devraient rester dans les poids du modèle de base, quels que soient le prompt système ou la configuration.

Cette distinction est importante : l’objectif n’est pas un modèle où « tout est permis ». C’est un modèle qui traite le contenu entre adultes consentants de la même manière que n’importe quelle autre tâche d’écriture créative.

💡 Pour les créateurs de plateformes : vous pourriez enfin déployer un modèle de qualité Meta pour des usages destinés aux adultes sans gérer votre propre pipeline de fine-tuning. La conformité et la sécurité deviennent bien plus simples lorsque le modèle de base est conçu pour votre cas d’usage.

Générer des images NSFW dès maintenant

Vous n’avez pas besoin d’attendre la prochaine version de Llama pour commencer à créer du contenu IA pour adultes. Tant que la partie chat dépend de Meta, le domaine de la génération d’images a déjà pris cette direction de façon décisive.

Belle femme en bikini rouge sur une plage tropicale à l’heure dorée, océan turquoise en arrière-plan

Seedream 4.5 domine le secteur

Pour la génération d’images NSFW, Seedream 4.5 constitue le benchmark actuel. Il produit des figures humaines photoréalistes avec une précision anatomique exceptionnelle, gère des scènes complexes impliquant une nudité partielle et des contenus suggestifs avec une composition naturelle, et maintient une apparence de personnage cohérente d’une génération à l’autre. Le respect du prompt pour les contenus pour adultes est parmi les meilleurs disponibles, ce qui signifie que vous obtenez ce que vous décrivez plutôt qu’une approximation aseptisée.

Pour quiconque a essayé d’anciens modèles capables de NSFW et a été déçu par une anatomie déformée, des textures de peau ternes ou un éclairage incohérent, Seedream 4.5 représente un progrès significatif. Les résultats peuvent passer pour de la photographie professionnelle à première vue.

Utiliser PicassoIA Image Editor Pro pour une production illimitée

PicassoIA Image Editor Pro enrichit votre flux de génération d’images avec des outils d’inpainting, d’outpainting et de remplacement d’objets qui fonctionnent avec les modèles capables de NSFW. Vous pouvez ainsi générer une image de base, puis affiner des zones précises avec des prompts ciblés, corriger la composition, modifier les vêtements ou étendre la scène au-delà du cadre d’origine.

La fonctionnalité de générations illimitées rend cet usage particulièrement précieux pour la création de contenu pour adultes, où obtenir le bon résultat exige généralement d’itérer sur de nombreuses variantes. Plutôt que de compter des crédits par image, vous pouvez lancer autant de générations que le processus créatif le demande.

Femme élégante en nuisette en soie ivoire sur une chaise longue en velours sous un éclairage de studio dramatique

Obtenir les meilleurs résultats avec le chat NSFW par IA

Des prompts système qui fonctionnent vraiment

Que vous utilisiez un dérivé Llama actuel sans censure ou que vous attendiez la prochaine version officielle, la qualité de votre prompt système détermine l’essentiel de vos résultats. Les prompts système les plus efficaces pour le chat NSFW partagent plusieurs caractéristiques :

  • Posez un cadre fictionnel clair : commencer par « Vous êtes un personnage dans une histoire de fiction pour adultes... » donne systématiquement de meilleurs résultats que les prompts qui tentent de contourner les politiques de contenu.
  • Précisez le ton et le registre : « Écrivez dans le style de l’érotisme littéraire » produit des résultats différents de « Soyez explicite ». Le premier tend à donner un texte plus cohérent et plus lisible.
  • Définissez tôt le contexte relationnel : les modèles génèrent un comportement de personnage plus constant lorsque la dynamique de la relation est établie dans le prompt système plutôt que dans la conversation.
  • Évitez les méta-discussions : les prompts qui demandent au modèle d’« ignorer ses restrictions » ou de « faire comme s’il n’avait aucune règle » créent de l’instabilité. Les prompts qui fournissent simplement un contexte créatif et laissent la conversation suivre son cours donnent de meilleurs résultats.

💡 Astuce : les meilleurs prompts de jeu de rôle NSFW se lisent comme les premières pages d’un roman, pas comme des instructions adressées à une machine. Décrivez le monde, décrivez les personnages et laissez le modèle compléter les dialogues.

Des modèles plus adaptés au jeu de rôle pour adultes

Tous les grands modèles de langage ne gèrent pas le jeu de rôle NSFW de la même façon, même lorsqu’ils ont des politiques de contenu permissives. Les différences tiennent aux données d’entraînement et aux choix de fine-tuning RLHF.

Meta Llama 3 70B Instruct a montré de solides performances en écriture créative et gère mieux les thèmes matures que ses variantes plus petites lorsque les prompts système établissent des contextes fictionnels clairs. Avec 70 milliards de paramètres, il dispose d’une capacité suffisante pour maintenir la cohérence des personnages sur de longues conversations.

Meta Llama 3.1 405B Instruct pousse cela plus loin avec une qualité de prose exceptionnelle et un travail nuancé sur les personnages. Si vous construisez une plateforme de fiction pour adultes où la qualité d’écriture est le principal facteur différenciant, la variante 405B produit un texte nettement plus riche que les modèles plus petits.

Meta Llama 3 8B Instruct reste utile pour des applications à fort volume et à enjeux plus faibles, où la rapidité et le coût comptent davantage que la qualité de la prose, par exemple pour générer des descriptions, rédiger de courtes réponses de chat ou traiter des tâches de classification au sein d’un pipeline plus large.

Femme séduisante en robe de cocktail debout avec assurance devant un fond de studio blanc, éclairage de magazine de mode

Vue d’ensemble : IA open source et liberté de contenu

Ce que signale la démarche de Meta

Le changement rapporté chez Meta traduit une maturation plus large de la façon dont le secteur de l’IA envisage la politique de contenu. L’instinct initial, né en partie de la prudence réglementaire et en partie d’une réelle préoccupation face aux usages abusifs, consistait à restreindre le plus possible et à pécher par excès de prudence en refusant largement. Des années de déploiement réel ont montré que cette approche a un coût considérable.

Les modèles trop restrictifs sont contournés. Les utilisateurs migrent vers des alternatives moins soucieuses de la sécurité. Les développeurs construisent autour des restrictions plutôt qu’avec le modèle. L’effet net est que l’écosystème des développeurs se fragmente, que la recherche en sécurité devient plus difficile à appliquer de façon cohérente, et que l’entreprise qui publie le modèle s’expose à des risques de réputation sans obtenir le bénéfice en matière de sécurité qu’elle recherchait.

💡 Le changement de perspective : autoriser les contenus NSFW tout en maintenant des limites strictes sur les catégories réellement dangereuses est de plus en plus perçu comme plus responsable que des refus généralisés qui poussent les utilisateurs vers des alternatives moins bien entretenues.

Comment Llama Guard s’intègre dans un avenir permissif

Un modèle de base permissif ne signifie pas l’absence d’outils de sécurité. Llama Guard 4 12B resterait un composant essentiel pour tout déploiement qui souhaite un contrôle fin du contenu. Les opérateurs qui doivent s’assurer que leur plateforme pour adultes ne s’adresse pas par inadvertance à des mineurs, qui veulent journaliser et auditer le contenu à des fins de conformité, ou qui doivent faire respecter des limites de contenu précises dans un environnement par ailleurs permissif continueraient de s’appuyer sur le classificateur Guard.

Le changement est que cela devient un choix explicite du déployeur, plutôt qu’une valeur par défaut inévitable imposée par le modèle de base. C’est une différence importante pour les opérateurs de plateformes qui ont géré jusqu’ici la friction entre les restrictions intégrées au modèle et leurs propres politiques de plateforme.

Belle femme en bralette en dentelle blanche dans un appartement baigné de soleil, lumière du matin à travers des rideaux translucides

Ce que vous pouvez faire dès aujourd’hui avec PicassoIA

Alors que la version NSFW de Llama reste à l’horizon, PicassoIA propose déjà l’ensemble des outils pour la création de contenu IA pour adultes. Que vous souhaitiez générer des images suggestives, créer de la photographie glamour, expérimenter la nudité artistique ou faire tourner de grands modèles de langage abordant des thèmes matures, tout est disponible sur picassoia.com/en/all-models.

Le volet génération d’images est particulièrement solide en ce moment. Avec plus de 90 modèles de texte vers image disponibles, vous pouvez sélectionner des modèles spécifiquement pour un rendu photoréaliste, pour des styles visuels précis, ou pour des modèles connus pour bien gérer les contenus pour adultes. L’association de la génération de base avec les outils d’inpainting et d’outpainting de PicassoIA Image Editor vous offre un flux de travail prêt pour la production, pour créer le type de contenu dont les plateformes pour adultes ont réellement besoin.

Côté modèles de langage, vous pouvez déjà accéder à Llama 4 Scout Instruct et Llama 4 Maverick Instruct directement dans votre navigateur, tester leurs capacités actuelles et disposer d’une base de référence claire pour ce que la prochaine version est censée améliorer.

Femme séduisante sur un canapé crème avec une tablette, lumière naturelle de l’après-midi venant de grandes fenêtres

Lorsque la prochaine version de Llama sortira, PicassoIA sera parmi les premières plateformes à l’intégrer, vous donnant un accès immédiat sans installation locale ni gestion d’infrastructure. D’ici là, la génération actuelle de modèles vaut la peine d’être testée dès maintenant. Commencez à générer, commencez à tester des prompts et construisez votre flux de travail pour être prêt à profiter pleinement du moment où les restrictions tomberont.

La communauté de l’IA open source contourne les restrictions de contenu depuis des années. La prochaine version de Llama pourrait enfin rendre cela inutile.

Partager cet article

Choisissez votre langue