Vous avez tapé un prompt tout à fait standard. Peut-être une femme en robe d’été sur une plage, ou un zoom lent sur un mannequin de mode en studio. Veo 3.1 a renvoyé un signalement de sécurité du contenu, sans vidéo, et sans explication détaillée au-delà d’un message de refus laconique. Cela arrive constamment, et la frustration est légitime, car le prompt n’était pas pornographique, pas explicite, et dans de nombreux cas pas même suggestif de façon significative. Alors, que se passe-t-il réellement ?
Veo 3.1 est l’un des modèles de génération de vidéos par IA les plus performants disponibles aujourd’hui, offrant une sortie en 1080p avec audio natif d’une manière que la plupart des concurrents ne parviennent pas encore à égaler. Mais sa modération de contenu est calibrée pour un cas d’usage tout à fait différent de ce dont la plupart des professionnels de la création ont besoin. Comprendre pourquoi il signale certains prompts, et ce que vous pouvez réellement faire à ce sujet, vous fait gagner du temps et des crédits.

Le filtre de sécurité de Google privilégie l’échelle
Veo 3.1 est un produit de Google DeepMind, déployé à grande échelle dans des applications grand public, des API d’entreprise et des intégrations tierces. Quand un modèle fonctionne à ce volume, la politique de sécurité des contenus n’est pas dictée uniquement par la volonté d’empêcher les sorties nuisibles, mais aussi par l’exposition juridique, les relations avec les annonceurs et les exigences réglementaires de dizaines de juridictions simultanément.
Le système de sécurité a été conçu pour le pire scénario, et non pour le cas limite d’un créatif professionnel avec un projet légitime. Les faux positifs, c’est-à-dire les prompts signalés alors qu’ils sont réellement inoffensifs, sont considérés comme un coût acceptable dans ce compromis. C’est pourquoi des prompts qui passeraient n’importe quelle relecture humaine raisonnable sont tout de même rejetés par un système automatisé optimisé pour l’échelle.
Le problème s’aggrave, car chaque version de Veo a été plus conservatrice que la précédente. Veo 2 avait un filtre serré. Veo 3 était plus strict. Veo 3.1 l’est encore davantage, et il n’existe aucune variante plus souple dans la gamme. Veo 3.1 Fast et Veo 3.1 Lite appliquent la même couche de sécurité avec le même niveau de sensibilité que le modèle complet.
Trois couches de détection qui travaillent ensemble
La modération de contenu dans Veo 3.1 ne fonctionne pas comme un simple filtre de mots. Elle exécute au moins trois mécanismes de détection parallèles, tous actifs en même temps :
Correspondance d’embeddings sémantiques. Le modèle projette votre prompt dans un espace vectoriel sémantique et vérifie sa proximité avec des groupes de concepts signalés. Cela signifie que vous n’avez pas besoin d’employer exactement un mot signalé. Les termes sémantiquement voisins de concepts problématiques dans cet espace déclenchent eux aussi le filtre. « Maillot de bain » est plus proche, dans cet espace, des catégories signalées que « vêtements d’été », même si le rendu visuel que vous décrivez est identique.
Évaluation de l’intention contextuelle. Même si aucun élément pris isolément ne déclenche un signalement, l’ensemble du prompt reçoit un score d’intention déduite. Un prompt qui combine un sujet féminin, un cadre privé, une proximité de la caméra avec le corps et un éclairage chaleureux et intime est perçu comme présentant un risque plus élevé que chacun de ces éléments pris séparément. Le système évalue les schémas de combinaison, et pas seulement les termes individuels.
Analyse conditionnée par l’image. Pour les flux d’image vers vidéo, l’image source est analysée avant le début de toute génération. Une photo source d’une femme en bikini peut déclencher un signalement à l’étape d’analyse de l’image, quel que soit le texte du prompt. Cela détecte les flux de travail qui tentent d’utiliser des prompts textuels neutres avec des images sources suggestives.

Ce que le filtre lit en premier
Avant que la génération de vidéo ne commence, Veo 3.1 fait passer votre prompt textuel dans un classifieur de sécurité. Ce classifieur a été entraîné sur un vaste jeu de données de contenus signalés et approuvés, et il attribue des scores selon plusieurs catégories de préjudice simultanément, et pas seulement le contenu pour adultes. Un seul prompt peut être évalué pour le contenu sexuel, la violence, le harcèlement et les questions de droits d’auteur en même temps.
Le classifieur ne sait pas que vous êtes photographe de mode professionnel, que votre public se compose d’adultes avertis ayant accepté les contenus pour adultes, ni que la scène que vous décrivez est moins explicite qu’un reportage de magazine classique. Il applique un filtre universel qui doit fonctionner pour chaque utilisateur, dans chaque contexte, des adolescents des applications grand public aux clients API des entreprises.
Les schémas de prompts qui déclenchent un signalement
Connaître les schémas précis qui élèvent le score de risque vous permet de travailler plus efficacement avec le système, ou de décider plus vite de changer de modèle lorsque le contenu sort réellement de ce qu’accepte Veo 3.1.
Les descripteurs vestimentaires qui déclenchent des alertes
Les descriptions directes de vêtements à couverture minimale sont les déclencheurs les plus fiables. Des mots comme « bikini », « lingerie », « maillot de bain », « transparent », « topless » et « révélateur » déclenchent systématiquement une alerte. Mais les formulations descriptives le font aussi : « à peine couverte », « tenue révélatrice », « bretelles uniquement » et « vêtements minimaux » sont tous perçus comme sémantiquement proches des catégories signalées, en raison de la manière dont le modèle d’embeddings a été entraîné.
Le système repère aussi les termes liés à la mode et au glamour lorsqu’ils sont combinés. « Photo glamour » plus un sujet féminin plus un studio plus une proximité de la caméra avec le corps déclenche un signalement, même lorsqu’aucune description vestimentaire n’est présente dans le prompt. Le schéma de combinaison compte autant que les termes individuels.

Le langage de caméra que Veo considère comme risqué
Les descriptions de caméra et de plans qui mettent l’accent sur la proximité avec le corps constituent une source de signalement importante et souvent sous-estimée. Ces formulations élèvent systématiquement le score de risque :
- « Gros plan sur les jambes, la taille ou le torse »
- « Zoom lent sur le corps du sujet »
- « Plan serré de la taille vers le bas »
- « La caméra remonte des pieds au visage »
- « Très gros plan sur la peau, les lèvres ou les courbes »
- « Plan moyen centré sur la poitrine ou les hanches »
Un langage de cadrage qui suggère le voyeurisme, même involontairement, se combine aux autres facteurs de risque du prompt. Un travelling avant lent sur un sujet neutre dans un cadre public neutre passe sans problème. Le même mouvement de caméra appliqué à une femme en tenue minimale dans un cadre privé ne passe pas.
Les décors qui augmentent le score de risque
Les espaces privés et intimes présentent des scores de risque de base plus élevés, même avec des prompts entièrement neutres et des sujets neutres :
- Chambres, surtout la nuit ou avec un éclairage romantique et doux
- Salles de bain et zones de douche
- Cabines d’essayage et vestiaires
- Chambres d’hôtel et suites privées
- Tout lieu décrit explicitement comme « privé » ou « intime »
Les décors publics sont nettement plus sûrs. Une plage en milieu de journée, une rue de ville, un studio avec du matériel visible, une terrasse de restaurant en extérieur. Ces signaux contextuels abaissent le score de risque global du prompt, même lorsque d’autres éléments sont centrés sur le corps ou vêtus de façon minimale.
Veo 3.1 face aux versions précédentes
Le comportement de signalement de Veo 3.1 est nettement plus strict que ce que les utilisateurs ont constaté avec les versions précédentes. Ce schéma est intentionnel et cohérent sur l’ensemble de la gamme.
Il n’existe aucune option de configuration pour réduire la sensibilité. Aucun paramètre d’API, aucune variante de modèle, aucune formulation de prompt ne désactive entièrement le filtre de sécurité. Si votre cas d’usage exige de générer un contenu que Veo 3.1 bloque systématiquement, la solution est d’utiliser un autre modèle, et non de continuer à retoucher le même prompt à coups de refus successifs.

L’approche de la modération de contenu dans Veo 3.1 n’est pas le standard du secteur. D’autres modèles adoptent des approches sensiblement différentes, et ces différences comptent pour le travail créatif professionnel.
Seedance 2.5 et l’approche de ByteDance
Seedance 2.5 gère systématiquement le glamour, les maillots de bain et les contenus centrés sur le corps que Veo 3.1 bloque purement et simplement. ByteDance calibre le filtre de Seedance pour les contenus suggestifs plutôt que pour une posture défensive maximale, en acceptant les premiers et en ne rejetant que les contenus réellement explicites. Le modèle produit des vidéos allant jusqu’à 10 secondes avec audio synchronisé en 1080p, ce qui en fait un concurrent direct en qualité pour Veo, avec une politique nettement plus permissive.
Seedance 2.0 et Seedance 2.0 Mini suivent la même politique de contenu. Les trois acceptent les prompts décrivant des vêtements minimaux, des décors de plage et de piscine avec un cadrage rapproché, et des scénarios de photographie glamour que Veo rejette catégoriquement.
💡 Test rapide : si votre prompt est signalé sur Veo 3.1, soumettez-le tel quel à Seedance 2.5. Vous obtiendrez souvent une génération propre dès la première tentative.
Kling v2.6 et v3
Kling v2.6 et Kling v3 Video de Kwai ont historiquement figuré parmi les modèles majeurs les plus souples pour la mode, la beauté et les contenus lifestyle impliquant un travail de caméra centré sur le corps. Les deux modèles restituent la peau, la texture des tissus et les mouvements réalistes avec une grande fidélité, et acceptent un éventail de prompts plus large que la gamme Veo 3.x.
Kling v2.5 Turbo Pro vaut aussi le détour pour les flux de travail à haut volume où vous avez besoin à la fois d’une génération plus rapide et d’une politique de contenu plus permissive.
Wan 2.7 pour les flux de travail ouverts
Wan 2.7 T2V et Wan 2.7 I2V offrent aux créatifs professionnels la plus grande souplesse pour les contenus lifestyle matures, sans nécessiter un travail d’ingénierie de prompts important pour contourner les filtres. Wan 2.7 est un modèle à poids ouverts, et le déploiement de PicassoIA le reflète avec une politique de contenu nettement moins restrictive que celle appliquée commercialement par Google.

Utiliser Veo 3.1 sur PicassoIA
Si vous souhaitez travailler spécifiquement avec Veo 3.1, il existe des approches de prompting qui réduisent le taux de refus sans sacrifier la qualité créative.
Étape par étape sur la plateforme
- Ouvrez Veo 3.1 sur PicassoIA et commencez à décrire votre scène.
- Commencez par le décor, et non par le sujet. Établissez le cadre complet avant d’introduire la personne.
- Utilisez un langage vestimentaire neutre : « habillée pour la plage » plutôt que « bikini », « tenue d’été » plutôt que « robe révélatrice », « tenue de sport » plutôt que « brassière et short ».
- Formulez le langage de caméra autour du mouvement plutôt que de la proximité : « la caméra recule lentement pour révéler » plutôt que « gros plan serré sur », « panoramique doux sur la scène » plutôt que « zoom lent sur son corps ».
- Évitez les décors privés autant que possible. Si la scène peut se dérouler en extérieur, déplacez-la en extérieur.
- Soumettez le prompt. En cas de signalement, retirez d’abord le langage de proximité de la caméra, puis les précisions vestimentaires, puis les descripteurs de décor, en testant après chaque suppression pour isoler l’élément qui déclenche le refus.
- Pour Veo 3.1 Fast : les mêmes règles s’appliquent, avec une sortie plus rapide et la même sensibilité de filtre. Pour Veo 3.1 Lite : sortie en résolution plus basse, mêmes règles de contenu.
Prompts acceptés et prompts refusés
💡 ACCEPTÉ : « Une femme en robe d’été marche le long d’une plage à l’heure dorée, plan large d’établissement, brise océane douce, lumière naturelle chaude, cinématographique 1080p »
💡 REFUSÉ : « Une femme en bikini sur la plage, zoom lent sur ses jambes, soleil chaud de l’après-midi, cadrage en gros plan sur le bas du corps »
La différence : aucune précision vestimentaire et un cadrage large, face à une précision vestimentaire et une direction de caméra centrée sur le corps. Le second prompt échoue non pas à cause d’un mot, mais à cause de la combinaison.
💡 ACCEPTÉ : « Mannequin de mode en robe blanche dans un studio sur le toit, éclairage professionnel, style de photographie éditoriale, plan à distance moyenne »
💡 REFUSÉ : « Mannequin de mode en lingerie transparente dans un studio, éclairage intime et dramatique, plan serré sur le torse, très gros plan sur la texture de la peau »
Retirez les précisions vestimentaires et éloignez la caméra, et Veo 3.1 approuvera souvent ce qu’il bloquait auparavant.
Où aller quand Veo vous refuse
Lorsque les ajustements du prompt ne règlent pas le problème et que le contenu dont vous avez besoin sort de ce qu’accepte Veo 3.1, changer de modèle est la bonne décision. Dépenser des crédits en refus répétés n’est pas un flux de travail.
Seedance pour le glamour et les maillots de bain
Seedance 2.5 est la recommandation principale pour les maillots de bain, le glamour et les contenus lifestyle que Veo bloque systématiquement. Il gère toute la gamme des contenus suggestifs mais non explicites, produit une vidéo en 1080p avec audio synchronisé, et fonctionne à des vitesses de génération compétitives. Seedance 1.5 Pro est une solution de repli solide pour cette catégorie lorsque vous voulez des clips plus courts ou un rendu esthétique différent.
Kling pour les contenus de mode centrés sur le corps
Kling v3 Video excelle dans les contenus de mode et de beauté avec un travail de caméra solide centré sur le corps. Le modèle restitue la texture des tissus, le détail de la peau et les mouvements réalistes avec une grande fidélité, et accepte les prompts qui incluent des cadrages rapprochés, des descriptions de maillots de bain et des descripteurs de décors intimes que Veo 3.1 bloque par défaut.

Wan 2.7 pour une souplesse maximale
Wan 2.7 T2V offre l’acceptation de prompts la plus large pour les contenus matures parmi les modèles vidéo de haute qualité de PicassoIA. Pour le travail d’image vers vidéo avec des images sources suggestives rejetées à l’étape d’analyse d’image chez Veo, Wan 2.7 I2V est l’alternative directe, sans modification. Il contourne le contrôle de sécurité conditionné par l’image que Veo 3.1 applique aux images d’entrée.
Le coût réel du sur-filtrage
La sur-modération a un coût en aval qui n’apparaît que rarement dans les indicateurs de sécurité des produits. Les marques de mode, les créateurs lifestyle, les plateformes de contenus pour adultes et les photographes artistiques sont des utilisateurs légitimes avec des projets créatifs légitimes. Lorsque le filtre rejette un prompt d’éditorial de mode, une animation de photographie glamour ou un concept artistique de nudité suggérée, ces utilisateurs ne deviennent pas meilleurs en ingénierie de prompts du jour au lendemain. Ils changent de plateforme.
Veo 3.1 produit une partie des meilleures vidéos disponibles actuellement. Les rendus cinématographiques sont vraiment impressionnants, la synchronisation audio est native et de grande qualité, et la sortie en 1080p conserve bien les détails fins. Si Google calibrait la politique de contenu un peu moins défensivement, sans renoncer à une application significative de la sécurité, le modèle servirait un marché créatif professionnel nettement plus large.
Tant que cela ne change pas, le flux de travail rationnel consiste à utiliser Veo 3.1 pour les catégories de contenus qu’il gère sans friction : récits cinématographiques, séquences de type documentaire, vidéos produit, plans de paysages et contenus de mouvement abstraits. Pour le glamour, la mode, le lifestyle et les travaux créatifs matures, les meilleurs outils sont Seedance 2.5, Kling v3 ou Wan 2.7.
Choisir le modèle selon le cas d’usage
| Type de contenu | Meilleur modèle | Pourquoi ça marche |
|---|
| Récit cinématographique | Veo 3.1 | Meilleur mouvement et audio natif |
| Clips cinématographiques rapides | Veo 3.1 Fast | Même qualité, génération plus rapide |
| Vidéos longues | Seedance 2.5 | Jusqu’à 10 secondes, filtre permissif |
| Maillots de bain et glamour | Seedance 2.5 | Accepte les prompts centrés sur le corps |
| Contenus mode et corps | Kling v3 Video | Excellent rendu de la peau et des tissus |
| Contenus lifestyle matures | Wan 2.7 T2V | Politique de contenu la plus souple |
| Animation de photos matures | Wan 2.7 I2V | Contourne le contrôle de sécurité au niveau de l’image |
| Contenus matures à petit budget | Kling v2.6 | Qualité à moindre coût par génération |

Commencer à créer sur PicassoIA
PicassoIA vous donne accès à tous les modèles de cet article au sein d’une seule plateforme. Veo 3.1, Veo 3.1 Fast, Seedance 2.5, Kling v3 Video et Wan 2.7 sont tous disponibles sans changer de compte ni gérer des identifiants d’API séparés.
Le flux de travail pratique : testez d’abord votre prompt sur Veo 3.1 pour la meilleure qualité cinématographique. S’il est signalé, passez le même prompt, sans modification, sur Seedance 2.5 ou Kling v3. Pour le travail d’image vers vidéo avec des images sources que Veo rejette à l’étape d’analyse d’image, Wan 2.7 I2V est le remplacement direct.
💡 Vous pouvez parcourir toute la gamme des modèles de génération d’images et de vidéos sur picassoia.com/en/all-models pour trouver le bon choix, que ce soit pour un contenu cinématographique que Veo 3.1 gère sans friction, ou pour un travail créatif mature qui nécessite un environnement moins restrictif.
Les modèles sont là. La plateforme est là. Ce qui change avec ces informations, c’est de savoir quel outil choisir en premier, et lequel utiliser quand le premier dit non.

