Convertissez vos photos en vidéos verticales avec Wan 2.7 Pro

Wan 2.7 Pro change la façon dont les créateurs produisent leurs vidéos verticales. Cet article vous montre comment transformer des photos fixes en vidéos dynamiques 9:16 pour TikTok, Reels et Shorts, avec des conseils de prompts, le détail des réglages et des comparaisons de modèles pour les utilisateurs de PicassoIA.

Convertissez vos photos en vidéos verticales avec Wan 2.7 Pro
Cristian Da Conceicao
Fondateur de Picasso IA

La vidéo verticale s’est imposée. TikTok, Instagram Reels, YouTube Shorts : le format 9:16 est là où se joue l’attention, et les photos fixes ne suffisent plus. Avec Wan 2.7 I2V sur PicassoIA, vous pouvez convertir n’importe quelle photographie en un clip vidéo vertical fluide et réaliste en quelques minutes, sans toucher à une seule chronologie de montage.

Il ne s’agit pas d’un lent processus d’animation image par image. Wan 2.7 Pro analyse l’éclairage, la profondeur et la position du sujet de votre photo, puis génère un mouvement fluide qui donne l’impression que la scène d’origine a toujours été en mouvement. Les cheveux bougent doucement. La lumière change. L’environnement respire. Le résultat donne une vidéo qui paraît captée, pas fabriquée.

Ce que fait réellement Wan 2.7 Pro

L’écart entre photos et vidéo

La plupart des créateurs disposent de milliers de photos inutilisées. De belles prises issues d’une séance qui n’ont jamais été publiées, parce que les plateformes privilégient la vidéo. Wan 2.7 Pro comble cet écart en traitant votre photo comme la première image d’une vidéo et en générant tout ce qui se passe ensuite.

Le modèle ne se contente pas de zoomer ou de panoramiquer sur l’image. Ce procédé façon effet Ken Burns produit un mouvement manifestement artificiel que les spectateurs reconnaissent immédiatement. À la place, Wan 2.7 I2V utilise un processus de diffusion entraîné sur de très vastes jeux de données vidéo pour prédire un mouvement temporel réaliste : la manière dont l’eau ondule, dont le tissu tombe et bouge, ou dont l’expression d’une personne peut évoluer au cours des cinq secondes suivantes. Le résultat est une conversion image vers vidéo de qualité cinématographique, qui tient même en sortie verticale 1080p.

Mains d’un photographe tenant un appareil reflex affichant une photo de portrait sur l’écran LCD en studio

Pourquoi le format vertical change tout

La vidéo horizontale est ce qu’on attend sur YouTube ou sur les écrans d’ordinateur. La vidéo en mode portrait (9:16) est ce qui arrête le pouce sur TikTok et Reels. Le problème a toujours été que la plupart des photographes professionnels cadrent en orientation paysage, et que recadrer une photo paysage en 9:16 détruit la composition.

Wan 2.7 I2V contourne entièrement ce problème. Vous pouvez importer une photo en orientation portrait et obtenir une sortie native en 9:16. Vous pouvez importer une photo carrée ou paysage et utiliser les réglages de recadrage du modèle pour vous concentrer sur le sujet. Vous pouvez même laisser le modèle étendre naturellement le contexte, pour que le cadre vertical paraisse voulu et non recadré. C’est pourquoi l’association d’une bonne photo de portrait et de Wan 2.7 I2V produit un meilleur contenu social que la plupart des vidéos verticales tournées au téléphone.

Le modèle Wan 2.7 I2V, expliqué

En quoi il diffère des anciennes versions de Wan

La famille Wan a beaucoup progressé. Wan 2.5 I2V a introduit un conditionnement fiable par image. Wan 2.6 I2V a amélioré la cohérence du mouvement et mieux géré les arrière-plans complexes. Wan 2.7 Pro franchit une nouvelle étape sur deux points précis.

Fidélité du mouvement : le mouvement des sujets est plus réaliste sur le plan physique. La dynamique des tissus, le mouvement des cheveux et les micro-expressions du visage ne produisent plus les légères déformations que les versions précédentes montraient parfois. Lorsque vous soumettez un portrait au modèle, le mouvement obtenu paraît ancré dans la façon dont cette personne précise bougerait réellement sous cette lumière-là.

Respect du prompt : le modèle suit les prompts de mouvement avec plus de précision. Si vous écrivez « la caméra zoome lentement pendant que le sujet sourit », Wan 2.7 Pro exécute à la fois le mouvement de caméra et le changement d’expression. Les versions précédentes ignoraient souvent l’un des deux éléments, en se rabattant sur un mouvement ambiant générique.

Stabilité en mode portrait : la composition verticale est nettement plus propre. Les anciens modèles Wan étaient principalement entraînés sur des données vidéo horizontales, ce qui se traduisait parfois, dans la sortie verticale, par des artefacts près des bords du cadre. Wan 2.7 Pro gère le cadre 9:16 nativement, sans distorsion de la composition.

Résolution et caractéristiques de sortie

CaractéristiqueValeur
Format de sortieMP4
Résolution maximale1080p
Format vertical9:16
Durée de clip par défaut5 secondes
Fréquence d’images24 fps
AudioAmbiance audio synchronisée native

💡 Cinq secondes suffisent largement pour les accroches TikTok et les intros de Reels. Bouclez le clip dans votre application de montage si vous avez besoin d’une durée plus longue.

Vue aérienne en plongée d’un espace de travail de créateur de contenu avec un iMac affichant un logiciel de vidéo verticale et un anneau lumineux

Comment utiliser Wan 2.7 I2V sur PicassoIA

PicassoIA vous donne un accès direct à Wan 2.7 I2V sans clé API, sans configuration GPU locale ni réglage technique. Voici le processus exact, de la photo à la vidéo publiée.

Étape 1 : importez votre photo source

Rendez-vous sur la page du modèle Wan 2.7 I2V sur PicassoIA et cliquez sur le champ d’import d’image.

Ce qui fonctionne le mieux :

  • Photos en orientation portrait (prises en 9:16 ou 4:5)
  • Minimum 1024 px sur le petit côté
  • Format JPEG ou PNG
  • Photos avec un sujet net et un arrière-plan identifiable

Ce qu’il faut éviter :

  • Les artefacts de compression importants, que le modèle capte et amplifie dans le mouvement
  • Les photos très sombres ou très surexposées, car la génération de mouvement dépend de la lecture de la profondeur de la scène
  • Les photos comportant beaucoup de texte dans le cadre, car le texte se déforme de façon imprévisible lors de la génération vidéo

Étape 2 : rédigez votre prompt de mouvement

C’est là que la plupart des utilisateurs obtiennent des résultats décevants. Un prompt faible produit un mouvement flottant et générique. Un prompt solide produit exactement la vidéo que vous aviez en tête.

Le modèle répond le mieux aux prompts qui décrivent ce qui bouge, comment cela bouge et ce que fait la caméra, dans cet ordre.

Prompt faible : « belle femme qui marche »

Prompt solide : « les cheveux de la femme bougent doucement dans une brise légère venant de la gauche, elle tourne légèrement la tête vers la caméra avec un sourire calme, travelling avant lent, lumière chaude du matin »

Gardez vos prompts sous 80 mots. Le modèle gère bien la précision, mais perd en exactitude lorsque les prompts dépassent un paragraphe.

Étape 3 : réglez le format en vertical

Dans le menu déroulant du format, sélectionnez 9:16. Si votre photo source est déjà en orientation portrait, le modèle utilise le cadre complet. Si elle est en paysage, le modèle recadre par défaut au centre sur le sujet. Pour une sortie de meilleure qualité, sélectionnez 1080p dans le champ de résolution. La génération prend un peu plus de temps, mais la différence de netteté est importante lorsque la vidéo est lue en plein écran sur un téléphone.

Étape 4 : générez et téléchargez

Cliquez sur Générer. Wan 2.7 I2V se termine généralement en 60 à 120 secondes sur l’infrastructure GPU de PicassoIA. Prévisualisez la vidéo dans le lecteur intégré avant de la télécharger, pour repérer tôt les éventuels artefacts. Si le mouvement paraît trop marqué ou trop discret, ajustez le curseur intensité du mouvement et relancez la génération.

Jeune homme faisant défiler un flux de vidéos verticales sur un smartphone dans un café en plein air, en lumière chaude de l’après-midi

Rédiger des prompts qui donnent des résultats

Les mots de mouvement qui fonctionnent

Le modèle Wan 2.7 I2V est fortement associé à un vocabulaire de mouvement précis. Ces mots donnent systématiquement de meilleurs résultats :

Type de mouvementMots-clés efficaces
Cheveux et tissus« brise légère », « vent doux venant de la gauche », « le tissu ondule »
Caméra« travelling avant lent », « poussée subtile », « léger panoramique à droite », « plan fixe »
Éclairage« changement de lumière dorée », « passage d’ombre de nuage », « scintillement de lumière chaude »
Sujet« léger tour de tête », « souffle doux », « le regard se déplace vers la gauche », « les lèvres s’entrouvrent légèrement »
Environnement« les feuilles bruissent », « l’eau scintille », « la fumée monte doucement »

💡 Combinez un mouvement du sujet, un mouvement de caméra et une condition d’éclairage pour une qualité de sortie maximale. Trois éléments constituent le bon équilibre. Au-delà de cinq, le résultat se dilue.

Décrire précisément le mouvement de caméra

Le mouvement de caméra est la capacité la plus fiable du modèle. Ces formulations fonctionnent de manière constante :

  • « travelling avant lent » : la caméra se rapproche progressivement du sujet pendant la durée du clip
  • « grue douce vers le haut » : la caméra s’élève légèrement, révélant davantage d’arrière-plan en haut du cadre
  • « léger changement de mise au point » : l’arrière-plan se floute progressivement pendant le clip, comme si la mise au point était refaite en cours de plan
  • « plan fixe » : aucun mouvement de caméra, idéal pour les portraits où le sujet est le seul élément en mouvement

Les erreurs courantes qui font chuter la qualité

Surcharger le prompt : demander trop d’actions simultanées produit un chaos visuel. Si vous voulez des cheveux qui bougent, un tour de tête, une poussée de caméra et une lumière changeante en même temps, le modèle fera des compromis sur chacun d’eux. Choisissez vos deux ou trois éléments les plus importants.

Décrire le résultat final au lieu de l’action : « Belle vidéo cinématographique » n’apporte rien d’utile au modèle. « Les feuilles frémissent doucement en arrière-plan pendant que le regard du sujet passe lentement du hors-champ à la caméra, poussée lente » donne des instructions exploitables.

Mettre du langage négatif dans le prompt principal : écrire « pas de tremblement, pas de flou » dans le champ du prompt principal ne supprime pas fiablement ces comportements. Utilisez le champ dédié de prompt négatif si l’interface en propose un, ou formulez votre prompt en termes positifs précis sur ce que vous voulez.

Négliger la qualité de l’image source : le modèle ne peut pas inventer de détails absents de la photo. Une source floue produit une vidéo floue. Un JPEG très compressé produit des artefacts de blocs dans la vidéo. Les sorties de meilleure qualité proviennent toujours de photos nettes et bien exposées.

Gros plan d’un écran de smartphone affichant une vidéo verticale générée par IA d’une plage tropicale posé sur une surface en béton

Les meilleures photos à utiliser en entrée

Orientation portrait ou paysage

Les prises de vue en portrait se convertissent le plus naturellement en vidéo verticale. Lorsque la composition a été pensée pour une lecture verticale (sujet centré, arrière-plan encadrant le haut et le bas), la sortie 9:16 paraît voulue. Les photos paysage peuvent aussi fonctionner, mais elles demandent une rédaction de prompt réfléchie pour gérer le recadrage. Si votre sujet se trouve sur le tiers gauche du cadre, précisez « focus sur le sujet à gauche, la caméra se déplace légèrement vers la droite » pour éviter que le modèle ne recadre par défaut au centre et n’exclue votre sujet.

Conditions d’éclairage qui fonctionnent

La lumière naturelle de l’heure dorée produit le mouvement le plus chaud et le plus organique. Le dégradé de lumière du chaud au froid à ce moment de la journée fournit au modèle de solides informations de profondeur, qui se traduisent par un effet de parallaxe et une séparation sujet-arrière-plan plus convaincants dans la vidéo.

La lumière douce d’un ciel couvert crée un éclairage uniforme que le modèle gère de façon prévisible. Le mouvement tend à être plus propre, avec moins d’artefacts sur les contours du sujet.

Le plein soleil de midi est la condition la plus difficile. Les ombres profondes et très contrastées créent des zones de détail perdu que le modèle doit inventer, ce qui produit parfois un mouvement de remplissage irréaliste pendant la génération vidéo.

L’éclairage de studio en intérieur fonctionne bien lorsque le montage repose sur trois points ou sur une softbox. Un éclairage intérieur plat et peu contrasté, provenant d’une seule source au-dessus, tend à produire une vidéo plate, avec peu de profondeur perçue.

💡 Si vous avez une photo prise en plein soleil de midi, essayez d’abord les outils de super-résolution de PicassoIA pour restaurer les détails des contours avant de la soumettre à Wan 2.7 I2V.

Résolution et format de fichier

Le modèle extrait davantage d’informations de scène à partir d’images sources plus grandes. Recommandations minimales :

  • Portraits : 1024 x 1820 px ou plus pour une sortie native en 9:16
  • Plans d’environnement : 1080 x 1920 px ou plus
  • Photos de produits : 1024 x 1024 px ou plus (fournissez une source en 1:1, puis spécifiez une sortie en 9:16 dans le modèle)

Le format PNG conserve le plus de détails sans perte pour le traitement par le modèle. Un JPEG à 90 % de qualité ou plus est également fiable. Évitez les photos exportées avec une qualité JPEG inférieure à 80 %, car les artefacts de compression apparaîtront dans la sortie vidéo.

Photographe femme cadrant un portrait avec un appareil hybride dans un parc urbain ensoleillé, en contre-plongée

Wan 2.7 Pro face aux autres modèles vidéo

Face à Wan 2.6 I2V

Wan 2.6 I2V est un solide prédécesseur que de nombreux créateurs utilisent encore pour la génération en masse. Les différences entre les versions 2.6 et 2.7 sont perceptibles, sans être spectaculaires :

CaractéristiqueWan 2.6 I2VWan 2.7 I2V
Stabilité en mode portraitBonneNettement meilleure
Réalisme du mouvementSolidePlus exact sur le plan physique
Respect du promptMoyenPlus fort
Vitesse de générationLégèrement plus rapideLégèrement plus lente
Résolution maximale1080p1080p

Si vous générez de gros lots et que la vitesse compte plus que la qualité maximale, Wan 2.6 I2V reste un choix solide. Pour une sortie de qualité finale destinée à la publication, Wan 2.7 Pro vaut le temps de génération supplémentaire.

Face à Kling v2.6 et Kling v3 Video

Kling v2.6 et Kling v3 Video offrent une qualité cinématographique exceptionnelle, en particulier pour les séquences à mouvement dramatique. Ce sont de bons choix pour la vidéo au format paysage, mais leurs résultats sont moins constants en sortie portrait (9:16) que ceux de Wan 2.7 Pro. Pour les contenus sociaux verticaux en particulier, Wan 2.7 Pro a un avantage net. Pour une narration cinématographique en format large, Kling v3 Video peut produire des résultats plus spectaculaires.

Face à Hailuo 02 et Pixverse v5

Hailuo 02 excelle en génération rapide et convient parfaitement au prototypage rapide et à l’idéation. La qualité de sortie est inférieure à celle de Wan 2.7 Pro pour un travail détaillé sur des portraits, mais l’avantage en vitesse est réel lorsque vous enchaînez de nombreuses itérations. Pixverse v5 produit une vidéo stylistiquement vive, mais penche vers une esthétique légèrement retouchée, à saturation très poussée. Pour une conversion photo vers vidéo brute et photoréaliste, fidèle à l’image source, Wan 2.7 Pro offre des résultats plus propres.

Ordinateur portable dans un petit studio maison sombre affichant une comparaison en écran partagé entre une photo fixe et une image animée

Des cas d’usage concrets à essayer

Contenus TikTok à partir de photos de produits

Les marques e-commerce et les petits entrepreneurs photographient leurs produits en permanence. Les photos statiques de produits défilent sur TikTok en un instant. Convertir la même photo en un clip de cinq secondes (par exemple, le produit qui pivote légèrement, ou un emballage qui capte un changement de lumière) améliore immédiatement le contenu, sans budget de tournage vidéo.

Exemple de prompt pour les photos de produits : « le produit pivote de 15 degrés dans le sens horaire sur place, la lumière ambiante du studio passe du chaud au froid sur l’étiquette, léger changement de mise au point vers le texte au premier plan, caméra fixe »

Reels Instagram à partir de photographie de portrait

Les photographes de portrait qui veulent réutiliser leur travail pour Reels peuvent convertir chaque image en un court clip : un léger tour de tête, un sourire qui se dessine, des cheveux qui bougent dans une brise, une poussée lente vers les yeux. Ces clips publiés en Reels surpassent systématiquement les publications statiques en portée et en découvrabilité du profil.

Exemple de prompt pour les portraits : « le regard du sujet passe lentement d’un léger hors-champ à un contact visuel direct, un sourire discret se dessine aux coins de la bouche, les cheveux bougent doucement dans une brise légère venant de la gauche, changement de mise au point lent de l’arrière-plan vers le visage »

Shorts YouTube à partir de photographie de voyage et de style de vie

Les créateurs qui construisent des chaînes de Shorts YouTube autour de la photographie, du voyage ou du style de vie peuvent convertir en lot leurs images les plus fortes en courts clips vidéo avec Wan 2.7 I2V. Associez chaque clip à une voix off grâce aux modèles de synthèse vocale de PicassoIA et à une piste musicale issue des outils de génération musicale par IA, et vous obtenez un Short fini sans rien tourner de nouveau.

💡 Générez 10 clips verticaux à partir de vos meilleures photos, ajoutez une ambiance audio avec les outils audio de PicassoIA et planifiez un Short par jour pendant deux semaines. L’ensemble du lot ne demande qu’un après-midi de production.

Femme aux cheveux bouclés naturels utilisant une tablette sur un canapé en lin blanc, en train de créer du contenu vidéo vertical

Quand utiliser Wan 2.7 R2V à la place

Wan 2.7 R2V (Reference-to-Video) est un modèle apparenté de la même famille, qu’il vaut la peine de bien connaître. Là où I2V utilise votre image comme première image de la vidéo et anime à partir de là, R2V l’utilise comme référence visuelle pour le style, l’apparence du personnage et la composition de la scène, sans verrouiller la vidéo sur cette image de départ exacte.

Utilisez Wan 2.7 I2V lorsque : vous voulez que la vidéo parte exactement de votre photo et s’anime ensuite. Le sujet, l’arrière-plan et la composition correspondent tous à l’image source dès la première image.

Utilisez Wan 2.7 R2V lorsque : vous voulez générer un nouveau contenu vidéo qui correspond à l’aspect, au personnage ou à l’environnement de votre photo de référence, mais avec des poses, des angles de caméra ou des séquences d’action différents, absents de l’original.

Il existe aussi Wan 2.7 T2V pour générer un contenu vidéo entièrement nouveau à partir d’une description textuelle, sans aucune image source. Les trois variantes de Wan 2.7 couvrent ensemble tous les points de départ : texte seul, image de référence ou animation directe d’une photo. Pour un contenu social vertical construit à partir de photographies existantes, I2V est presque toujours le bon point de départ.

Vue en plongée du bureau d’un créateur avec des planches-contacts imprimées, un carnet de storyboard et un smartphone en position verticale

D’autres modèles vidéo sur PicassoIA

Si vous voulez créer des vidéos verticales sans photo source, PicassoIA propose plus de 100 modèles texte vers vidéo aux côtés de la famille Wan 2.7. Options notables pour la création de contenus verticaux :

  • Seedance 2.0 : le modèle phare de ByteDance, avec génération audio synchronisée intégrée, excellent pour les contenus portés par la musique
  • Kling v3 Omni Video : produit une sortie 1080p cinématographique à partir de texte, efficace pour les récits dramatiques et la narration
  • Hailuo 02 : génération rapide avec une qualité solide, idéal pour itérer vite lorsque le volume compte plus que la qualité maximale
  • LTX 2 Pro : modèle vidéo 4K de haute qualité de Lightricks, pour les créateurs qui ont besoin d’une résolution de sortie maximale
  • PicassoIA Video : le générateur vidéo gratuit et illimité de la plateforme, parfait pour expérimenter sans se soucier des crédits

Ces outils et Wan 2.7 I2V cohabitent dans la même interface, ce qui signifie que vous n’avez jamais à choisir entre animer une photo existante et générer quelque chose de totalement nouveau. Les deux flux de travail ne sont qu’à un clic. Parcourez le catalogue complet sur picassoia.com/en/all-models.

Skyline de ville à l’heure dorée vue à travers un smartphone tenu à la verticale, avec la barre de progression de la génération vidéo par IA visible

Commencez à créer avec vos photos

Chaque photographe possède un disque dur rempli d’images qui n’ont jamais trouvé leur public. Wan 2.7 I2V donne à ces photos une seconde vie, dans le format que les réseaux sociaux récompensent réellement aujourd’hui.

La barrière d’entrée est basse : importez une photo, rédigez une description de mouvement de 30 mots, sélectionnez 9:16 en 1080p, puis cliquez sur générer. En moins de deux minutes, vous obtenez un clip vidéo vertical qui paraît avoir été tourné spécialement pour les réseaux sociaux. Pas d’équipe de tournage. Pas de studio de montage. Pas de séquences supplémentaires.

Rendez-vous sur PicassoIA et ouvrez Wan 2.7 I2V. Choisissez votre photo de portrait la plus réussie, rédigez un prompt de mouvement en utilisant le vocabulaire et la structure exposés plus haut, puis lancez la première génération. Ce premier clip vous dira exactement ce que ce modèle peut faire avec votre style photographique, vos sujets et votre éclairage.

Vos photos ont déjà la qualité. Wan 2.7 Pro y ajoute le mouvement.

Partager cet article

Choisissez votre langue