Comment planifier une vidéo avant de la générer avec l’IA

La plupart des vidéos IA échouent avant même que le générateur ne s’ouvre. Faire l’impasse sur la pré-production gaspille des crédits et donne un résultat fade. Cet article détaille chaque étape de la planification, de la définition de votre concept à la rédaction de prompts efficaces, en passant par la liste de plans et le choix du bon modèle, pour que votre premier rendu compte.

Comment planifier une vidéo avant de la générer avec l’IA
Cristian Da Conceicao
Fondateur de Picasso IA

La plupart des gens ouvrent un générateur de vidéos IA, tapent une phrase vague, puis passent l’heure suivante à se demander pourquoi le résultat n’a rien à voir avec ce qu’ils imaginaient. Le problème n’est pas le modèle. Le problème, c’est le plan, ou plus exactement l’absence de plan. Avant de cliquer sur générer, il y a des décisions à prendre, et la qualité de ces décisions détermine si votre premier rendu est exploitable ou s’il s’agit d’un crédit gaspillé.

Planification d’une liste de plans pour la génération de vidéos IA

Pourquoi planifier vous fait économiser des crédits

La génération de vidéos par IA coûte cher en temps et en calcul. Un seul rendu avec un modèle comme Seedance 2.0 ou Veo 3 peut prendre entre 30 secondes et plusieurs minutes, et le résultat dépend entièrement de la précision avec laquelle vous avez défini ce que vous vouliez avant de cliquer sur générer. Une mauvaise planification entraîne davantage de tentatives. Davantage de tentatives signifient plus de temps et plus de coûts. Tout réalisateur de vidéos professionnel, qu’il travaille avec des acteurs ou avec des modèles IA, commence par la pré-production. Il en va de même pour la vidéo IA.

La plus grosse erreur

L’erreur la plus courante consiste à confondre « j’ai une idée » et « j’ai un plan ». Une idée, c’est « un chef qui cuisine dans une cuisine ». Un plan, c’est « un gros plan sur les mains d’un chef qui replie une pâte fraîche sur un marbre fariné, une lumière douce de fenêtre venant de la gauche, un lent travelling avant, une atmosphère chaude de milieu de journée ». La seconde description donne à l’IA quelque chose de concret sur lequel travailler. La première lui laisse la latitude de produire quelque chose que vous ne vouliez probablement pas.

Des entrées vagues donnent des sorties vagues. Ce n’est pas un défaut du modèle. C’est le reflet direct de la consigne qu’il a reçue.

À quoi ressemble une bonne pré-production

Au minimum, un plan vidéo exploitable comprend :

  • Un concept central : de quoi parle cette vidéo, en une phrase
  • Un sujet et une action : qui ou quoi fait quoi
  • Un environnement : où se déroule la scène
  • Un style visuel : lumière, ambiance, ton
  • Un langage de caméra : angle, mouvement, distance de l’objectif
  • Une idée de durée : s’agit-il d’un clip de 5 secondes ou d’une scène de 10 secondes

Vous n’avez pas besoin d’une bible de pré-production hollywoodienne. Vous avez besoin de ces six éléments notés avant de toucher à l’outil. Dix minutes de planification font régulièrement gagner une heure de régénération.

Croquis de storyboard pour la pré-production vidéo

Définir le concept avant tout le reste

Toute vidéo qui fonctionne doit son succès à un concept clair. Toute vidéo qui échoue a sauté cette étape en espérant que le modèle comblerait les vides. Il ne le fera pas.

Trouver l’idée centrale

Écrivez une phrase qui décrit ce que votre vidéo est. Une seule. Pas un paragraphe, pas une liste. Une seule phrase. Voici un modèle :

« Un [sujet] [action] dans [environnement], avec [ambiance ou sentiment]. »

Par exemple : « Une femme qui court dans une rue détrempée par la pluie, la nuit, avec un sentiment d’urgence et une tension cinématographique. »

Cette phrase unique est votre étoile polaire. Chaque décision de prompt que vous prendrez ensuite doit s’y rattacher. Si un détail descriptif ne sert pas cette phrase, il n’a probablement pas sa place dans le prompt. Cette contrainte impose la clarté, et c’est exactement ce à quoi les modèles d’IA répondent le mieux. Réduisez la phrase jusqu’à ce qu’elle soit précise, puis construisez le prompt à partir d’elle.

Qui va regarder ?

Avant de choisir un modèle ou d’écrire le moindre mot de prompt, demandez-vous à qui cette vidéo est destinée et où elle sera vue. Un clip pour les réseaux sociaux, consulté en vertical sur mobile, exige des spécifications totalement différentes d’une vidéo horizontale destinée à l’en-tête d’un site web.

Cela compte, car cela influe directement sur :

  • Le format : vertical (9:16) pour le mobile, horizontal (16:9) pour le web et le bureau, carré (1:1) pour la plupart des réseaux sociaux
  • La durée : de 3 à 6 secondes pour les accroches sur les réseaux sociaux, de 8 à 15 secondes pour les intégrations web
  • Le rythme : des coupes rapides conviennent aux environnements où l’attention est courte, un mouvement plus lent convient aux contextes de marque haut de gamme

Connaître votre audience avant d’écrire le moindre mot de prompt élimine une grande catégorie de régénérations. Vous ne produirez pas par accident un magnifique plan paysage destiné à une plateforme qui le recadre dans un cadre vertical.

Rédaction d’un prompt vidéo détaillé sur un ordinateur portable

Rédigez le prompt d’abord, ouvrez l’outil ensuite

C’est l’habitude la plus importante que vous puissiez prendre lorsque vous travaillez avec la vidéo IA. La rédaction du prompt ne se fait pas à la volée dans le champ de texte de l’outil. Elle se fait dans une application de notes, un document ou un carnet papier. Vous l’écrivez. Vous le corrigez. Vous le relisez à voix haute. Puis vous le collez.

Sujet, action, environnement

Chaque prompt de vidéo IA repose sur trois piliers structurels : le sujet, l’action et l’environnement. Si l’un d’eux manque, le modèle comble les vides, et le résultat est souvent méconnaissable.

ÉlémentVersion faibleVersion forte
Sujet« une personne »« une femme d’une quarantaine d’années, manteau sombre, cheveux mouillés »
Action« marche »« marche vite, tête baissée, en évitant tout contact visuel »
Environnement« ville »« trottoir de ville détrempé par la pluie, flaques réfléchissantes, enseignes chaleureuses »

La version forte prend 10 secondes de plus à écrire et produit un résultat radicalement différent. Une description faible du sujet oblige le modèle à inventer un personnage. Une description faible de l’action fait retomber sur un mouvement générique. Un environnement faible produit un décor qui correspond rarement à l’ambiance que vous aviez prévue.

Angles de caméra et mouvements

Les modèles de vidéo IA répondent bien au langage cinématographique. Ce sont des termes qui définissent non seulement ce qui se trouve dans le cadre, mais aussi la manière dont ce cadre se déplace. Voici les descripteurs les plus fiables :

  • Lent travelling avant : la caméra se rapproche progressivement du sujet, ce qui attire l’attention et crée de l’intimité
  • Travelling droit ou travelling gauche : la caméra suit un mouvement latéral et révèle progressivement l’environnement
  • Contre-plongée : prise de vue depuis le bas, par rapport au niveau des yeux, qui ajoute puissance et dramatisme au sujet
  • Plan large aérien : plan d’ensemble en surplomb, qui exprime l’échelle et le lieu
  • Gros plan : plan serré sur un visage ou un détail, qui crée de l’intimité et un poids émotionnel
  • Plan fixe : aucun mouvement de caméra, tout se passe dans un cadre immobile, idéal pour les vidéos de produits ou de plats

Choisissez un seul mouvement de caméra par plan. Empiler plusieurs mouvements dans un même prompt (« travelling avant avec panoramique vers la droite et inclinaison vers le haut ») tend à désorienter le modèle. Choisissez le mouvement qui sert le mieux le moment, et tenez-vous-y.

Ambiance et lumière

La lumière n’est pas une touche finale. Elle fait partie de la structure du prompt. Une scène éclairée par « soleil dur de milieu de journée venant directement d’en haut » ne donne pas du tout la même impression qu’une scène identique éclairée par « lumière dorée douce de l’heure dorée, venant de la gauche, longues ombres au sol ». Les deux décrivent la lumière du soleil. Les vidéos obtenues n’auront rien à voir.

Descripteurs de lumière courants qui donnent des résultats constants :

  • Lumière matinale diffuse et douce, ciel couvert
  • Soleil de midi dur et vertical, ombres courtes et tranchées
  • Heure dorée, lumière chaude et directionnelle venant de la droite
  • Lumière du jour couverte, lumière plate et uniforme, rendu documentaire
  • Éclairage par lampe pratique, intérieur chaleureux, arrière-plan sombre
  • Clair de lune, tonalité bleu froid, éclairage ambiant de faible intensité

💡 Astuce : adaptez la lumière à l’émotion. Une lumière chaude paraît sûre et nostalgique. Un bleu froid paraît tendu ou mélancolique. Une lumière directionnelle dure crée du drame. Une lumière plate et couverte crée un ton neutre et observateur.

Erreurs fréquentes dans les prompts

Trois schémas donnent systématiquement de mauvais résultats :

  1. Décrire le résultat au lieu de la scène : « une belle vidéo de la nature » indique au modèle la qualité que vous voulez, pas ce qu’il doit montrer. Décrivez la scène réelle avec des détails précis.
  2. Utiliser des mots émotionnels abstraits comme descripteur principal : « magique », « épique », « époustouflant » ne sont pas des consignes visuelles. Traduisez le sentiment en termes visuels concrets.
  3. Inclure des contradictions : « mouvement rapide, suspense lent, dramatique, paisible » n’est pas une direction. Le modèle en fait une moyenne médiocre. Choisissez un seul ton et tenez-vous-y.

Carte mentale du concept vidéo sur un tableau blanc

Constituer une liste de plans

La liste de plans est le document de planification le plus simple du cinéma. C’est une liste numérotée dans laquelle chaque ligne décrit un plan. L’équivalent IA ressemble presque en tout point, et il est tout aussi indispensable pour quiconque produit plus d’un seul clip.

Une idée par plan

Chaque entrée numérotée de votre liste de plans doit décrire un seul moment visuel. Pas une scène avec plusieurs choses qui se passent. Un seul moment, une seule position de caméra, une seule action.

Exemple de liste de plans pour une vidéo produit en trois clips :

  1. Gros plan aérien sur des mains qui ouvrent une boîte noire mate posée sur une surface blanche, lumière de studio douce venant du haut, lent travelling avant sur le couvercle qui se soulève
  2. Produit visible dans du papier de soie blanc, plan fixe, léger changement de mise au point du papier vers la texture de la surface du produit
  3. Plan moyen d’une personne tenant le produit, bras et torse seulement, lumière naturelle nette venant de la fenêtre à gauche, très lente rotation de la main révélant le dos du produit

Ces trois plans racontent une histoire visuelle cohérente lorsqu’ils sont assemblés dans l’ordre. Si vous essayiez de décrire les trois dans un seul prompt, le modèle choisirait une direction au hasard, ou mélangerait les plans en quelque chose d’involontaire.

L’ordre compte

Raisonnez en séquences, pas en clips isolés. Demandez-vous : qu’est-ce qui précède ce plan, et qu’est-ce qui le suit ? La vidéo passe-t-elle du large au serré, en installant le décor avant le détail ? Part-elle du calme vers le dynamique, ou ouvre-t-elle sur de l’énergie avant de se poser dans l’immobilité ?

Planifier la séquence évite aussi les redondances. Si vous avez déjà un plan large d’installation, passez à un plan moyen ou serré qui apporte une nouvelle information visuelle, plutôt que de créer un second plan large. Chaque clip de la liste doit ajouter quelque chose que le clip précédent ne montrait pas.

Quelle est la durée de chaque plan ?

La plupart des outils de vidéo IA produisent des clips à durée fixe, généralement 5 secondes par clip. Planifiez en fonction de cette contrainte. Une vidéo finale de 15 secondes nécessite trois clips distincts de 5 secondes, chacun planifié et généré séparément, puis assemblé dans un logiciel de montage. Cinq plans dans votre liste représentent environ 25 secondes de rushes avant montage. Tenez-en compte dès le départ, pour ne pas planifier une séquence impossible à générer en pratique.

Examen d’une sortie de vidéo IA sur une tablette

Choisir le bon modèle

Tous les modèles de vidéo IA ne se comportent pas de la même façon. Choisir le mauvais modèle pour votre concept réduit à néant votre travail de planification, car chaque outil a des forces et des tendances qui joueront contre vous si vous allez dans la mauvaise direction.

Texte vers vidéo ou image vers vidéo

La première décision consiste à savoir si vous partez d’un texte ou d’une image.

Le texte vers vidéo fonctionne le mieux lorsque :

  • Vous voulez que le modèle construise l’univers visuel à partir de votre description écrite
  • Vous disposez d’un prompt précis et détaillé
  • Vous n’avez pas de référence visuelle existante à reproduire

L’image vers vidéo fonctionne le mieux lorsque :

  • Vous disposez déjà d’une image source (une photo ou une image générée par un modèle d’image)
  • Vous voulez une apparence constante du sujet sur plusieurs clips
  • Vous avez besoin que la première image corresponde à quelque chose de précis

Pour maintenir une cohérence visuelle dans une séquence de plusieurs clips, l’image vers vidéo est l’approche la plus fiable. Le sujet reste identique d’un clip à l’autre, car il part toujours de la même image source.

Interface de sélection de modèles de vidéo IA

5 modèles à connaître

Voici cinq modèles disponibles sur PicassoIA qui couvrent les cas d’usage les plus courants en planification vidéo :

ModèleIdéal pourQualité de sortie
Seedance 2.0Qualité cinématographique, audio natif intégré, mouvement fluide1080p
Kling v2.6Mouvement humain photoréaliste, scènes cinématographiques1080p
Wan 2.7 I2VAnimation d’images sources, transitions fluides du sujetHD
Hailuo 02Sortie 1080p rapide, bonne préservation des détails1080p
LTX 2.3 ProSortie en résolution 4K à partir de prompts texte détaillés4K

Si vous débutez, PicassoIA Video est un outil de texte vers vidéo gratuit et illimité. Utilisez-le pour vérifier que votre prompt fonctionne avant de vous engager dans un rendu premium.

💡 Astuce : testez d’abord votre prompt sur le modèle gratuit. Servez-vous du résultat comme retour visuel pour affiner le prompt. Utilisez ensuite Seedance 2.0 ou Kling v2.6 pour la version finale.

Réglez vos spécifications

Une fois que vous savez ce que vous allez créer et quel modèle vous utiliserez, fixez les paramètres techniques avant de générer quoi que ce soit. Ces réglages influencent le résultat, quelle que soit la qualité d’écriture de votre prompt.

Format

Le format correspond au rapport largeur/hauteur de votre cadre. La plupart des modèles prennent en charge :

  • 16:9 : paysage standard, idéal pour le web, YouTube et les présentations sur ordinateur
  • 9:16 : portrait vertical, idéal pour le mobile, Reels, TikTok, Shorts
  • 1:1 : carré, constitue un choix sûr pour toutes les plateformes

Réglez-le avant de rédiger votre prompt final. Il influence les choix de composition. Un sujet bien cadré en 16:9 paraîtra maladroit en 9:16 si vous n’avez pas prévu de marge verticale et une composition plus serrée dans la description.

Résolution et durée

Pour les premiers tests, une résolution plus basse se génère plus vite et suffit pour vérifier que votre prompt fonctionne. Pour le résultat final, visez au moins 720p. Pour les plateformes où la netteté compte, le 1080p est la norme.

Des modèles comme Wan 2.7 T2V et Veo 3 produisent un bon rendu 1080p à partir de prompts bien structurés. Sora 2 mérite d’être envisagé lorsque vous avez besoin d’une haute résolution combinée à un respect précis du prompt. Dans la plupart des outils de vidéo IA, la durée est fixe par clip. Intégrez donc cette contrainte dans votre liste de plans et générez chaque clip séparément.

Monteur vidéo professionnel examinant des clips générés par IA sur une station à double écran

Testez d’abord un seul plan

Avant de générer les cinq ou dix clips de votre liste de plans, générez le premier. Examinez-le attentivement. Prenez une décision en fonction de ce que vous voyez. Puis poursuivez.

Ce qu’il faut vérifier au premier rendu

Lorsque votre premier clip est généré, examinez ces éléments dans l’ordre :

  1. Fidélité du sujet : le sujet principal correspond-il à ce que vous avez décrit dans le prompt ?
  2. Fidélité de l’action : le mouvement ou l’activité correspond-il à votre intention ?
  3. Lumière et ambiance : l’atmosphère correspond-elle au sentiment prévu pour ce plan ?
  4. Comportement de la caméra : le modèle a-t-il respecté l’angle et le mouvement indiqués ?
  5. Rythme : le clip paraît-il trop rapide, trop lent ou juste à sa place dans la séquence ?

Si trois de ces points ou plus sont défaillants, le prompt doit être sérieusement revu avant de générer un autre clip. Générer cinq mauvais clips alors que le premier a échoué est l’une des erreurs les plus fréquentes et les plus coûteuses en production de vidéo IA.

La boucle d’affinage

Lorsqu’un clip ne correspond pas à l’entrée de votre liste de plans, revenez à l’élément précis qui a échoué. Le sujet était-il faux ? Ajoutez un détail physique plus précis. Le mouvement de caméra était-il faux ? Réécrivez avec une terminologie cinématographique plus claire et plus standard. L’ambiance était-elle décalée ? Revoyez le descripteur de lumière.

Modifiez une seule chose à la fois. Si vous réécrivez l’intégralité du prompt à chaque tentative, vous ne parviendrez jamais à isoler ce qui a corrigé ou cassé chaque élément.

💡 Astuce : tenez un journal des modifications simple : version du prompt, ce que vous avez changé, ce qui s’est amélioré. Après trois ou quatre tentatives, vous aurez une idée claire de la façon dont le modèle réagit à votre langage. Ce journal sert aussi de base réutilisable pour de futurs projets avec le même modèle.

Femme rédigeant un script vidéo sur un bloc-notes dans un espace de travail créatif

Comment utiliser PicassoIA pour planifier vos vidéos

PicassoIA vous donne accès à plus de 100 modèles de texte vers vidéo issus de tous les grands fournisseurs de vidéo IA, réunis au même endroit. Cela compte pour la planification, car différents concepts fonctionnent mieux sur différents modèles, et les avoir côte à côte vous permet d’itérer sans changer de plateforme ni gérer plusieurs comptes.

Commencez par les modèles gratuits

L’outil PicassoIA Video est gratuit et illimité, ce qui en fait le point de départ idéal pour tout nouveau concept. Servez-vous-en pour valider vos descriptions de plans. Si le modèle saisit correctement le sujet principal et le mouvement dans la version gratuite, votre prompt fonctionne. Passez ensuite à un modèle premium pour le rendu final. Cette approche en deux temps fait économiser des crédits et raccourcit nettement la boucle d’itération.

Utilisez l’image vers vidéo pour la cohérence

Si la cohérence visuelle entre les clips compte pour vous, générez d’abord une image source avec les outils de texte vers image de PicassoIA, puis utilisez un modèle d’image vers vidéo comme Wan 2.7 I2V pour l’animer. Le sujet reste identique d’un clip à l’autre, car chacun part de la même image source.

Pour des résultats 1080p rapides avec une bonne qualité de mouvement, Hailuo 02 est un choix solide. Pour une résolution maximale lorsque la qualité de sortie est prioritaire, LTX 2.3 Pro propose de la 4K. Pour un contenu cinématographique stylisé à forte tonalité visuelle, Pixverse v5.6 mérite d’être testé aux côtés des options haut de gamme.

Miniatures de vidéos générées par IA affichées sur un écran de studio

Votre prochaine vidéo commence par un document

Le meilleur résultat de vidéo IA que vous obtiendrez commence par un document vierge, et non par un onglet de navigateur ouvert. Rédigez le concept. Rédigez la liste de plans. Rédigez les prompts un par un. Relisez-les. Affinez-les. Puis générez.

Chaque outil de PicassoIA est disponible dès que vous disposez d’un plan solide. Les modèles gratuits vous permettent de tester ce plan sans frais. Les modèles premium vous permettent de l’exécuter avec de la qualité. Ce qui distingue une vidéo qui fonctionne d’une vidéo qui ne fonctionne pas n’est presque jamais le modèle. C’est la préparation qui se cache derrière le prompt.

Commencez par un seul plan. Planifiez-le entièrement. Générez-le. Regardez ce qui en sort. Modifiez une chose. Recommencez. C’est le processus, répété jusqu’à obtenir exactement ce que vous vouliez créer. L’outil est prêt lorsque votre plan l’est.

Partager cet article

Choisissez votre langue