Le mode Image-Pro de Wan 2.7 : ce qui a changé

Wan 2.7 est livré avec un mode Image-Pro dédié qui modifie en profondeur la manière dont le modèle traite les images de référence, gère la science des couleurs et préserve la fidélité visuelle dans les séquences vidéo générées. Cet article détaille chaque changement technique, compare la version à Wan 2.6 et explique comment obtenir les meilleurs résultats sur PicassoIA dès maintenant.

Le mode Image-Pro de Wan 2.7 : ce qui a changé
Cristian Da Conceicao
Fondateur de Picasso IA

La série Wan de Wan-video est l’une des lignées de modèles vidéo d’IA les plus suivies en 2027. Chaque version a apporté quelque chose de réellement utile, et Wan 2.7 ne fait pas exception. Mais cette version a introduit un élément qui n’a pas reçu assez d’attention au lancement : le mode Image-Pro. Ce n’est pas un simple réglage mineur. Il change la façon dont le modèle construit l’information visuelle à un niveau fondamental, et la différence de rendu se voit dès la première image.

Il ne s’agit pas de termes à la mode. Il s’agit de ce qui a réellement changé dans le pipeline, de ce que vous voyez lorsque vous comparez les rendus côte à côte, et de la manière de travailler avec les trois variantes de Wan 2.7 sur PicassoIA : Wan 2.7 T2V, Wan 2.7 I2V et Wan 2.7 R2V.

Ce qu’est vraiment le mode Image-Pro

Avant d’aborder les changements, il est utile de savoir ce que le mode Image-Pro cherche à résoudre. Les versions précédentes de Wan traitaient l’image de référence principalement comme un seed de mouvement : un point de départ que le processus de diffusion interpolait dans le temps. La qualité de cette première image était acceptable, mais ce n’était pas la priorité.

Le mode Image-Pro change cette priorité. Le modèle traite désormais la première image comme un artefact centré sur l’image, en appliquant une passe dédiée à la qualité d’image avant que le pipeline de diffusion vidéo ne commence. Autrement dit, l’image de départ est rendue selon une norme différente de celle de Wan 2.6 ou Wan 2.5.

L’ancienne approche face à la nouvelle

Dans Wan 2.5 I2V et Wan 2.6 I2V, l’image de référence que vous importiez servait de signal de conditionnement. Le modèle échantillonnait autour d’elle. Le niveau de détail correspondait à ce que vous aviez importé, sans amélioration notable.

Avec le mode Image-Pro dans Wan 2.7 I2V, l’image entrante passe par un pré-traitement d’amélioration : accentuation des détails, normalisation des couleurs et upscaling sensible aux contours. La vidéo obtenue ne part pas simplement du niveau de qualité de votre image. Elle le dépasse souvent.

Comparaison de qualité côte à côte sur deux écrans dans un studio moderne

Pourquoi la qualité d’image compte dans la vidéo IA

La plupart des créateurs réfléchissent aux modèles vidéo en termes de cohérence du mouvement, de respect du prompt ou de résolution. La qualité d’image au niveau de la frame passe souvent inaperçue. Pourtant, si la première image est floue ou manque de détails, chaque image suivante hérite de cette base. Vous ne pouvez pas compenser une image de référence faible avec du flou de bougé.

Le mode Image-Pro s’attaque à ce problème à la source. C’est la raison pour laquelle les rendus de Wan 2.7 paraissent plus cinématographiques, même lorsque le prompt n’a pas changé.

Les changements techniques dans Wan 2.7

Le mode Image-Pro n’est pas une fonctionnalité unique. C’est un ensemble de modifications dans la manière dont Wan 2.7 traite l’information visuelle à trois étapes : avant la diffusion, pendant la diffusion et dans le post-traitement de sortie.

Amélioration de la résolution et du détail

Wan 2.7 prend en charge une sortie native en 1080p avec Wan 2.7 T2V. Ce n’est pas nouveau pour les modèles vidéo, mais ce qui a changé, c’est la manière dont le détail est traité à cette résolution. Les versions précédentes adoucissaient parfois les textures en 1080p, à cause des artefacts de compression introduits lors de l’étape d’encodage dans l’espace latent.

Le mode Image-Pro utilise une passe de VAE (Variational Autoencoder) à plus haute fidélité, qui préserve plus fidèlement les informations de texture. Le tissage des tissus, les pores de la peau, le grain du bois, les reflets métalliques : ces éléments survivent mieux au cycle encodage-décodage que dans Wan 2.6.

Baie de serveurs dans un centre de données montrant l’infrastructure de calcul de l’IA

💡 Note pratique : avec Wan 2.7 I2V, importer une image source de meilleure qualité reste essentiel. Le mode Image-Pro améliore votre entrée, mais il amplifie ce qu’elle contient. Une source 4K nette donnera un résultat nettement meilleur qu’une source 720p compressée.

Le système d’image de référence

Wan 2.7 R2V introduit une capacité de référence-vers-vidéo distincte de l’I2V. R2V traite l’entrée non comme une image de départ, mais comme une référence de sujet, ce qui permet au modèle d’animer le sujet dans une nouvelle scène ou un nouveau contexte de mouvement.

Le mode Image-Pro n’affecte pas R2V de la même façon que I2V. Dans R2V, la passe de qualité se concentre sur l’isolation du sujet et l’extraction de ses caractéristiques, plutôt que sur le traitement de l’image entière. Le modèle identifie les principales caractéristiques visuelles du sujet (détail des cheveux, texture des vêtements, géométrie du visage) et les préserve spécifiquement tout en construisant le contexte vidéo autour d’elles.

Cela rend Wan 2.7 R2V nettement plus utile pour les flux de travail d’animation de personnages, où la cohérence du sujet compte davantage que la fidélité de l’arrière-plan.

Vue aérienne à plat du poste de travail d’un designer avec des planches de référence IA imprimées et des outils créatifs

Les différences réelles que vous remarquerez

La description technique aide, mais que voit-on réellement dans le rendu ?

Étalonnage des couleurs et mappage des tons

Les rendus de Wan 2.6 tendaient à une légère désaturation des couleurs dans les zones de détails à haute fréquence. Les reflets de peau, les tissus clairs, les surfaces réfléchissantes : tout cela pouvait parfois se délaver. Ce n’était pas spectaculaire, mais c’était suffisamment régulier pour nécessiter un étalonnage en post-production.

Wan 2.7 avec le mode Image-Pro gère nettement mieux la courbe tonale. Les hautes lumières conservent davantage d’informations chromatiques, les ombres présentent un dégradé plus profond sans s’écraser en noir pur, et l’ensemble a une réponse de courbe plus cinématographique, plus proche du film. Le rendu se rapproche davantage de ce que l’on obtient en tournant en RAW avec une caméra cinéma numérique que ne le faisaient les versions précédentes de Wan.

Portrait macro en gros plan montrant un détail de peau extraordinaire et un éclairage cinématographique

Fidélité du visage et des textures

C’est là que le mode Image-Pro a l’impact visible le plus fort. Dans les versions précédentes de Wan, le détail du visage dans les séquences vidéo s’adoucissait souvent au fil de 5 à 10 secondes. L’interpolation du mouvement moyennait les détails fins comme les pores, les cheveux fins et le détail des yeux.

Wan 2.7 applique un mécanisme d’attention spécialement réglé pour les traits du visage humain pendant la passe de diffusion vidéo. Résultat : les visages conservent mieux leurs détails sur des séquences plus longues. Les yeux restent nets. Les mèches de cheveux individuelles gardent leur séparation au lieu de se fondre en une masse.

La fidélité des textures hors visage s’est aussi améliorée. Les surfaces en brique montrent les joints de mortier individuels d’une image à l’autre. Les tissus tissés laissent apparaître une structure de fils qui ne se floute pas pendant le mouvement. Le grain du bois conserve sa direction et sa profondeur, même lorsque la caméra bouge.

💡 Pour les vidéos centrées sur les personnages : Wan 2.7 R2V est le meilleur choix lorsque le sujet humain est au centre de l’attention. Le prétraitement d’isolation du sujet de R2V, combiné à la préservation des textures d’Image-Pro, offre une cohérence du visage et du corps nettement meilleure qu’avec l’I2V pour l’animation de personnages.

Comment utiliser Wan 2.7 sur PicassoIA

PicassoIA donne accès aux trois variantes de Wan 2.7. Voici comment utiliser chacune efficacement.

Étapes pour l’I2V

Le flux de travail d’image vers vidéo dans Wan 2.7 I2V fonctionne au mieux lorsque l’image de référence transmet déjà l’éclairage et la composition souhaités :

  1. Ouvrez Wan 2.7 I2V sur PicassoIA
  2. Importez une image de référence de haute qualité (1080p ou plus recommandé)
  3. Rédigez un prompt de mouvement décrivant le déplacement : ce qui bouge, comment et à quelle vitesse
  4. Réglez la résolution sur 1080p pour activer le pipeline Image-Pro complet
  5. Lancez la génération et patientez (en général 60 à 90 secondes)

Le prompt de mouvement compte autant que l’image. Décrivez le mouvement de façon précise : « légère dérive de la caméra vers la droite, feuilles qui se balancent doucement au premier plan, la personne reste immobile » fonctionne mieux que « faites bouger cette image ».

Vidéaste avec une caméra cinéma sur un toit à l’heure dorée, éclairé à contre-jour par un coucher de soleil chaud

Étapes pour le T2V

Wan 2.7 T2V génère une vidéo entièrement à partir de texte. Le mode Image-Pro s’applique ici à la première image générée, avant que le modèle ne poursuive la séquence :

  1. Ouvrez Wan 2.7 T2V sur PicassoIA
  2. Rédigez une description de scène détaillée incluant le sujet, l’environnement, l’éclairage et le comportement de la caméra
  3. Réglez la résolution sur 1080p
  4. Ajoutez des instructions explicites de mouvement de caméra dans votre prompt
  5. Générez et évaluez la qualité de la première image avant de vous engager dans des séquences plus longues

Pour le T2V, le bénéfice d’Image-Pro est le plus visible sur les gros plans. Les plans larges d’établissement montrent une amélioration moindre, car le détail par pixel compte moins à cette distance. Les plans moyens et les gros plans sont là où vous remarquerez le rendu plus propre.

Conseils pour de meilleurs résultats

ConseilS’applique àPourquoi
Utilisez une résolution 1080pT2V, I2VActive le pipeline Image-Pro complet
Importez des images sources en 1080p ou plusI2VUne entrée de meilleure qualité donne une base de sortie meilleure
Décrivez l’éclairage dans votre promptT2VLe modèle s’appuie sur les indices d’éclairage pour calibrer le mappage des tons
Précisez explicitement le mouvement de caméraToutes les variantesRéduit les artefacts d’interpolation
Utilisez R2V pour l’animation de personnagesR2VLe prétraitement d’isolation du sujet donne une meilleure cohérence du visage

💡 L’éclairage dans les prompts est sous-estimé : le mappage des tons de Wan 2.7 réagit aux descriptions d’éclairage. Écrire « lumière matinale chaude venant de la gauche, ombres profondes à droite » fournit au modèle des informations de calibrage qui influencent tout le pipeline des couleurs.

Comparaison en écran partagé, d’une image floue de faible qualité à une image photoréaliste d’une netteté cristalline

Wan 2.7 face à Wan 2.6 : comparaison directe

La différence entre Wan 2.6 et Wan 2.7 n’est pas révolutionnaire sur tous les critères. Certains aspects se sont nettement améliorés, d’autres sont restés similaires.

Comparaison de vitesse

Wan 2.6 et 2.7 ont des temps de génération comparables en 480p. En 1080p, Wan 2.7 est légèrement plus lent en raison de la passe de prétraitement Image-Pro. Ce traitement supplémentaire ajoute environ 10 à 15 secondes par génération, un coût minime au regard de l’amélioration de la qualité.

Si la vitesse prime sur la qualité, Wan 2.5 T2V Fast reste l’une des options les plus rapides de la famille Wan sur PicassoIA.

Benchmarks de qualité

CritèreWan 2.6Wan 2.7
Résolution native720p / 1080p1080p
Conservation des détails du visageModéréeÉlevée
Fidélité des texturesModéréeÉlevée
Justesse des couleursBonneTrès bonne
Cohérence du mouvementBonneBonne
Cohérence du sujet (R2V)N/ATrès bonne

Le score de cohérence du mouvement, qui reste identique, ne constitue pas un reproche à l’égard de Wan 2.7. Il reconnaît simplement que Wan 2.6 était déjà solide sur le mouvement. Les gains de la version 2.7 se concentrent sur la qualité d’image, précisément le domaine que le mode Image-Pro devait traiter.

Créatrice de contenu utilisant deux écrans affichant l’interface d’une plateforme IA et un rendu vidéo photoréaliste

Quelle variante de Wan 2.7 choisir ?

Il existe trois variantes, et choisir la mauvaise pour votre cas d’usage vous fera perdre en qualité. Voici quand chacune a du sens.

T2V, I2V ou R2V

Wan 2.7 T2V sert lorsque vous avez une scène précise en tête, mais aucune image de référence. Le modèle génère l’ensemble du visuel à partir de votre description textuelle. Idéal pour : les plans d’établissement, les visuels abstraits, les scènes d’environnement pour lesquelles vous n’avez pas besoin d’un rendu spécifique.

Wan 2.7 I2V sert à animer une image précise que vous possédez déjà. Le modèle utilise votre image comme image zéro et génère le mouvement à partir de là. Idéal pour : les vidéos produit, les visites architecturales, l’animation de photographies.

Wan 2.7 R2V sert à animer un sujet précis, issu d’une photo de référence, dans un nouveau contexte. Idéal pour : l’animation de personnages, placer une personne dans une scène différente, animer un sujet avec un mouvement contrôlé tout en changeant l’environnement.

💡 Le bon choix compte plus que le prompt : utiliser l’I2V alors que vous avez besoin du comportement de R2V (ou l’inverse) donnera de moins bons résultats, quelle que soit la qualité de votre prompt. Le prétraitement est différent, tout comme ce que le modèle privilégie.

D’autres modèles à comparer

Wan 2.7 n’évolue pas en vase clos. Voici sa position par rapport à d’autres modèles vidéo haut de gamme disponibles sur PicassoIA.

Alternatives à Wan 2.7 sur PicassoIA

Kling v2.6 de Kwai VGI est un concurrent sérieux pour la génération de vidéos cinématographiques. Il gère très bien la dynamique du mouvement et produit des sorties 1080p de haute qualité. Là où Wan 2.7 prend l’avantage, c’est dans le prétraitement Image-Pro lors du travail en I2V. Kling v2.6 n’a pas d’équivalent à cette passe de qualité de la première image.

LTX 2.3 Pro de Lightricks est conçu pour une sortie 4K, ce qui le place immédiatement dans une autre catégorie en matière de résolution. Si vous avez besoin de vidéo 4K, LTX 2.3 Pro est le bon choix. Si le 1080p suffit, Wan 2.7 vous donne davantage de contrôle sur la qualité de la première image grâce à Image-Pro.

Ray 3.2 de Luma offre une sortie HDR exceptionnelle et se distingue particulièrement pour les contenus de nature et de paysage. Wan 2.7 produit des résultats plus réguliers pour les sujets humains, tandis que Ray 3.2 l’emporte souvent en matière de génération de vidéos d’environnement et d’atmosphère.

Seedance 2.5 de ByteDance peut générer des vidéos de 30 secondes, nettement plus longues que la fenêtre standard de Wan 2.7. Pour les contenus longs, Seedance 2.5 a un avantage structurel. Pour des clips plus courts et de meilleure qualité, où la première image compte, Wan 2.7 a l’avantage.

Veo 3.1 de Google fait partie des modèles texte vers vidéo les plus performants disponibles. Sa génération audio native et sa qualité 1080p sont solides. Pour le texte vers vidéo pur, Veo 3.1 est un véritable concurrent de Wan 2.7. Là où Wan 2.7 se distingue, c’est dans les capacités I2V et R2V avec le mode Image-Pro : Veo 3.1 n’a pas d’équivalent au pipeline image vers vidéo avec traitement de qualité de la première image.

Équipe de production cinéma travaillant sur un plateau avec des projecteurs et du matériel professionnels

Constatez la différence par vous-même

La meilleure façon de voir ce que fait réellement le mode Image-Pro est de lancer le même prompt avec Wan 2.6 I2V et Wan 2.7 I2V, avec des entrées identiques. Utilisez un portrait de visage comme image de référence. La différence de conservation des détails de la peau, de netteté des yeux et de justesse des couleurs sur toute la séquence vidéo sera immédiatement visible.

PicassoIA vous donne accès aux trois variantes de Wan 2.7 sans avoir besoin de mettre en place une infrastructure locale. Pour les flux de travail qui dépendent de la qualité de la première image, les variantes I2V et R2V avec le mode Image-Pro représentent une avancée significative par rapport à ce qui était possible avec Wan 2.6.

Pour l’éventail complet des options de génération vidéo, la page de tous les modèles sur picassoia.com/en/all-models présente chaque modèle dans toutes les catégories, y compris la famille Wan en pleine croissance et les options concurrentes de Kling, Ray, LTX, Veo et Seedance.

Le pipeline de qualité d’image dans la génération vidéo IA rattrape celui du mouvement depuis un moment. Avec Wan 2.7 et le mode Image-Pro, il n’est plus le maillon faible. Faites passer votre prochain projet par ce pipeline et constatez à quel point la base a évolué.

Mains tenant une photographie imprimée montrant un détail photographique exceptionnel sous une lumière chaude de fenêtre

Partager cet article

Choisissez votre langue