Non, Wan 3.0 n’est pas open source, du moins pas aujourd’hui. Alibaba l’a publié en bêta publique accessible uniquement par API le 6 août 2026, a élargi le lancement le 24 août 2026, et les vérifications les plus récentes que j’ai pu trouver (datées de mi-septembre 2026) ne montraient toujours ni poids sur Hugging Face, ni dépôt GitHub avec le code d’inférence, ni licence publiée. Si votre projet repose sur le téléchargement du modèle et son exécution sur votre propre GPU, ce projet est en suspens. Si votre objectif est de produire une bonne vidéo avec, vous pouvez le faire dès maintenant avec Wan 3 sur PicassoIA.
Cet article sépare les faits confirmés des rumeurs. Vous y trouverez la chronologie de sortie, le prix par seconde en 480p, 720p et 1080p, le coût d’un clip réel, un court tutoriel pour Wan 3 et Wan 3 Prime, ainsi que des formules de prompt qui tiennent pour des clips allant jusqu’à 30 secondes.
💡 Verdict rapide : Wan 3.0 est fermé, facturé à la seconde via l’API d’Alibaba, et limité au 1080p. Vous pouvez l’essayer en ligne sans rien installer ni posséder de GPU.
Wan 3.0 est-il open source aujourd’hui ?
Ce qu’exige l’open source
Pour un modèle vidéo, « open source » n’est pas une étiquette marketing. Trois éléments doivent exister avant que quelqu’un puisse le dire sans sourciller :
- Des poids téléchargeables sur un hébergeur public comme Hugging Face.
- Un code d’inférence que vous pouvez exécuter vous-même, généralement sur GitHub.
- Une licence qui précise ce que vous avez le droit de faire avec les fichiers et les résultats, comme Apache 2.0.
Au moment où j’écris, Wan 3.0 ne remplit aucune de ces trois conditions. Un audit de 27 dépôts officiels Hugging Face et de 6 dépôts officiels GitHub n’a rien trouvé de plus récent que la version 2.2. Un article communautaire sur l’écosystème Wan dans son ensemble formulait le même avertissement en termes simples : ne livrez pas un produit qui dépend du fait que Wan 3.0 soit sous Apache 2.0.

| Élément | État de Wan 3.0 |
|---|
| Poids publics | Aucun publié |
| Code d’inférence | Aucun publié |
| Licence | Aucune publiée |
| Accès | API uniquement, via Alibaba Cloud Model Studio |
| Étiquette de l’API | Toujours marquée en préversion |
| Hébergement autonome | Impossible |
Pourquoi l’historique de Wan indique un modèle fermé
Les versions précédentes racontent l’histoire. Wan 2.1 et Wan 2.2 ont été publiés avec des poids ouverts sous Apache 2.0, ce qui explique que ce nom soit devenu un favori de ceux qui aiment faire tourner des modèles en local. Puis la gamme phare est passée derrière une API.
| Version | Sortie | Poids | Licence |
|---|
| Wan 2.1 | Début 2025 | Ouverts | Apache 2.0 |
| Wan 2.2 | 28 juillet 2025 | Ouverts | Apache 2.0 |
| Wan 2.5, 2.6, 2.7 | De septembre 2025 à avril 2026 (selon les informations) | API uniquement | Non publiée |
| Wan 3.0 | 6 août 2026 | API uniquement | Non publiée |
Quatre générations phares d’affilée, 2.5, 2.6, 2.7 et maintenant 3.0, ont été livrées fermées. Alibaba publie toujours des modèles plus petits de contrôle et d’animation avec des poids ouverts (Wan-Dancer-14B est un exemple signalé, sous Apache 2.0), mais le principal modèle de texte vers vidéo reste derrière l’API.
⚠️ Prévoyez un modèle fermé. Tant qu’Alibaba n’aura pas publié les poids et une licence sur ses pages officielles Hugging Face et GitHub, considérez Wan 3.0 comme un service hébergé. Vérifiez à nouveau ces pages avant tout achat de matériel.
Que choisir si vous avez besoin de poids ouverts
Si les poids ouverts sont une exigence absolue, les choix réalistes sont les modèles qui les ont déjà publiés. Wan 2.2 est la version la plus récente de Wan avec des poids sous Apache 2.0. HunyuanVideo de Tencent et LTX Video de Lightricks ont également été publiés comme modèles ouverts, chacun sous sa propre licence, il faut donc lire la licence avant de construire quoi que ce soit dessus. Ces trois modèles sont plus anciens et plus courts que Wan 3.0, mais vous pouvez les faire tourner sur votre propre matériel et vérifier exactement ce que vous avez le droit de faire avec les résultats.
Date de sortie et chronologie
Des dates sur lesquelles vous pouvez compter
Les premières fuites indiquaient le 6 août, et la bêta publique est bien arrivée à cette date. Un lancement plus large a suivi environ deux semaines et demie plus tard.

- 28 juillet 2025 : Wan 2.2 arrive avec des poids ouverts.
- De septembre 2025 à avril 2026 : Wan 2.5, 2.6 et 2.7 sortent sous forme de produits API.
- 6 août 2026 : ouverture de la bêta publique de Wan 3.0, API uniquement.
- 24 août 2026 : lancement élargi.
- Mi-septembre 2026 : la dernière vérification que j’ai trouvée montrait toujours aucun poids sur Hugging Face.
Ce que signifie le statut de préversion
La référence de l’API étiquette toujours Wan 3.0 comme préversion. En pratique, cela signifie trois choses : l’accès peut dépendre de votre région et de votre compte, certains comptes ont signalé un accès uniquement sur invitation, et les tarifs peuvent changer sans beaucoup de préavis. Si vous construisez un produit dessus, confirmez d’abord la disponibilité et les tarifs dans votre propre console.
Ce que Wan 3.0 sait faire
Caractéristiques en bref
Les chiffres ci-dessous proviennent de la documentation publique de l’API et des pages des modèles.
| Caractéristique | Wan 3.0 |
|---|
| Résolutions | 480p, 720p, 1080p (pas de 4K) |
| Durée du clip | 2 à 30 secondes |
| Formats | 16:9, 9:16, 4:3, 3:4, 1:1, adaptatif |
| Audio | Généré en même temps que la vidéo, multilingue |
| Modes | Texte vers vidéo, image vers vidéo, première et dernière image, référence vers vidéo |
| Entrées de référence | Jusqu’à 10 images, 5 clips vidéo, 5 pistes audio |
L’allongement de la durée est le point fort. La génération précédente plafonnait à 15 secondes, donc un seul rendu de Wan 3 peut désormais couvrir une scène complète sans assembler plusieurs clips. Les entrées de référence comptent aussi. Fournir au modèle jusqu’à 10 images, 5 clips vidéo et 5 pistes audio permet de viser un personnage, un produit ou une voix cohérents sur plusieurs plans, au lieu d’espérer qu’un prompt textuel reproduise deux fois le même visage.

Là où il reste en deçà
- Pas de 4K. La sortie s’arrête à 1080p. Pour une résolution supérieure, il faut un autre modèle ou un upscaler.
- Les clips longs prennent du temps. Un rendu documenté de 30 secondes d’image vers vidéo en 720p a demandé environ 15 minutes.
- Limites de la préversion. Les quotas, les régions et les tarifs évoluent encore.
Les échantillons de temps de rendu sur PicassoIA donnent une idée approximative. Un échantillon de 5 secondes en 1080p sur Wan 3 a pris environ 322 secondes, tandis que les échantillons de Wan 3 Prime ont pris environ 36 secondes en 480p et environ 102 secondes en 1080p. Les prompts diffèrent, prenez donc ces chiffres comme des ordres de grandeur, pas comme un benchmark.
Prix de Wan 3.0 par seconde
Tarifs officiels de l’API
Alibaba Cloud Model Studio facture à la seconde de sortie. Voici les tarifs internationaux annoncés au lancement, ainsi que le tarif de Chine continentale à titre de comparaison.
| Formule | 480p | 720p | 1080p |
|---|
| Standard (international) | 0,05 $ | 0,10 $ | 0,20 $ |
| Prime (international) | 0,068 $ | 0,14 $ | 0,28 $ |
| Chine continentale | ¥0,30 | ¥0,60 | ¥1,20 |
La formule Prime coûte environ 36 à 40 % de plus que Standard à chaque résolution. Alibaba propose aussi un quota gratuit de 30 secondes par modèle, valable 90 jours.
Ce que coûte réellement un clip
Multipliez le tarif par le nombre de secondes. C’est toute la formule.
| Clip | Standard | Prime |
|---|
| 5 secondes en 480p | 0,25 $ | 0,34 $ |
| 5 secondes en 720p | 0,50 $ | 0,70 $ |
| 5 secondes en 1080p | 1,00 $ | 1,40 $ |
| 15 secondes en 1080p | 3,00 $ | 4,20 $ |
| 30 secondes en 1080p | 6,00 $ | 8,40 $ |

Ce sont les essais ratés qui font fondre le budget. Dix brouillons de 5 secondes en 480p coûtent 2,50 $ en formule Standard, alors que dix brouillons de 5 secondes en 1080p coûtent 10 $. Quelques habitudes permettent de garder la facture raisonnable :
- Faites petit pour commencer. Testez l’idée en 480p et 5 secondes avant de dépenser pour du 1080p.
- Réglez d’abord le prompt. Les clips courts révèlent les problèmes de prompt aussi clairement que les longs.
- Réutilisez les seeds. Une fois un brouillon satisfaisant, conservez son seed et augmentez la résolution.
- Ne faites un long clip qu’une fois. Ne consacrez le budget de 30 secondes qu’à un prompt déjà testé.
- Testez gratuitement d’abord. Wan 3 peut être essayé gratuitement en ligne sur PicassoIA, vous pouvez donc peaufiner vos prompts avant de payer à la seconde ailleurs.
💡 Les tarifs changent, et les prix varient selon les régions. Considérez chaque chiffre ici comme un instantané et confirmez-le dans votre propre console avant de valider le budget d’un projet.
Utiliser Wan 3 sur PicassoIA
Choisir un modèle et ses réglages
Wan 3 et Wan 3 Prime partagent les mêmes entrées sur PicassoIA, les étapes sont donc identiques.
- Ouvrez la page du modèle et saisissez votre prompt dans le champ Prompt.
- Réglez la résolution. La valeur par défaut est 1080p. Passez en 480p pendant vos essais.
- Réglez la durée. La valeur par défaut est 5 secondes. Augmentez-la, jusqu’à 30, seulement une fois un brouillon concluant.
- Choisissez le format. La valeur par défaut est adaptatif. Choisissez 16:9 pour le paysage, 9:16 pour le vertical, 1:1 pour le carré. Ce réglage est ignoré lorsque vous importez une image.
- Ajoutez un prompt négatif pour ce que vous ne voulez jamais voir, comme les filigranes, les personnes en trop ou le texte scintillant.
- Décidez de l’expansion du prompt. Elle est activée par défaut. Elle aide les prompts courts, ajoute de la latence, et mérite d’être désactivée lorsque votre prompt est déjà précis.
- Verrouillez un seed entre 0 et 2147483647 si vous voulez reproduire un résultat.
- Générez puis téléchargez le clip.
L’image vers vidéo en pratique
Importez une première image au format JPG, PNG, BMP ou WEBP, de 10 Mo maximum, et décrivez uniquement ce qui doit bouger. L’image porte déjà le sujet, la lumière et les couleurs, donc votre prompt peut se concentrer sur le mouvement et la caméra.

Un portrait comme celui ci-dessus fait une bonne image de départ. Un prompt tel que « il lève les yeux de la tablette, sourit à quelqu’un hors champ, de la vapeur s’élève de la tasse posée sur la table, lent travelling avant, bruit doux de conversations de café » donne au modèle une action claire, un mouvement de caméra et un son.
Des conseils de prompt qui fonctionnent
Une formule de prompt en cinq parties
Les bons prompts Wan 3 suivent le même ordre : sujet, action, caméra, lumière, son. Comme l’audio est généré avec la vidéo, la dernière partie n’est pas facultative.

- Sujet : qui ou quoi, avec deux ou trois détails concrets.
- Action : un seul verbe principal par plan, au présent.
- Caméra : un seul mouvement, comme « lent travelling avant », « suivi à l’épaule » ou « plan large fixe ».
- Lumière : moment de la journée et direction, comme « soleil bas venant de la gauche ».
- Son : bruit d’ambiance, ambiance musicale ou une réplique de dialogue entre guillemets.
Voici trois prompts à copier et adapter :
« Un cabriolet rouge vintage prend un virage sur une route côtière en corniche, plan aérien au drone qui s’incline lentement vers le bas, de longues ombres dorées du soleil couchant, le fracas des vagues en contrebas, un doux ronronnement de moteur et des mouettes. »
« Une boulangère sort un plateau de croissants d’un four en pierre, gros plan sur ses mains couvertes de farine, caméra à l’épaule, douce lumière de fenêtre venant de la gauche, le craquement de la croûte et une musique de radio discrète. »
« Une randonneuse atteint une crête à l’aube et pose son sac à dos, plan large fixe, lumière bleue froide qui vire à l’or, vent sur l’herbe, chants d’oiseaux au loin. »

Rythmer un clip de 30 secondes
Les clips longs ont tendance à dériver lorsque le prompt décrit un seul instant. Écrivez plutôt des temps forts, une courte phrase par phase, pour que le modèle sache où aller. Aucune syntaxe d’horodatage particulière n’est documentée, considérez donc ceci comme du langage naturel.

« D’abord, un plan large d’un phare au crépuscule avec des vagues en contrebas. Ensuite, la caméra se rapproche le long des rochers pendant que la lampe s’allume. Puis un gardien ouvre la porte et sort sur le balcon. Enfin, la caméra s’élève au-dessus du gardien pour révéler toute la côte, avec le bruit du vent et une cloche lointaine. »
Un storyboard rapide, comme le croquis ci-dessus, est le moyen le plus rapide de trouver vos temps forts avant de dépenser le moindre dollar dans un rendu.
Prompts négatifs et seeds
- Prompt négatif : listez ce que vous ne voulez jamais, par exemple « filigrane, sous-titres, flou de bougé, doigts en trop, visages déformés ».
- Seed : ne modifiez qu’une seule chose à la fois. Si le seed et le prompt changent tous les deux, vous ne pourrez pas savoir ce qui a aidé.
- Expansion du prompt : gardez-la activée pour les idées en une ligne et désactivez-la pour les prompts que vous avez rédigés avec soin.
- Un seul mouvement de caméra par plan. Combiner travelling, panoramique et zoom donne généralement des résultats confus.
Cinq erreurs courantes à éviter
- Empiler les mouvements de caméra. Un travelling, un panoramique et un zoom se contrarient. Choisissez-en un.
- Caser une histoire dans 5 secondes. Une seule action tient. Trois actions se transforment en flou, donc découpez-les en clips séparés ou allongez la durée.
- Laisser le son vide. Avec l’audio natif, un emplacement sonore vide reçoit une ambiance générique. Nommez plutôt deux sons concrets.
- Utiliser des éloges vagues. Des mots comme « magnifique » ou « épique » ne donnent rien à dessiner au modèle. Décrivez l’objectif, la lumière et la matière que vous voulez voir.
- Commencer en 1080p. Le premier rendu est un test. Lancez-le en 480p, puis refaites le meilleur résultat en pleine résolution avec le même seed.
Wan 3 n’est pas la seule option pour les clips longs en haute résolution. Ces modèles sont tous disponibles sur PicassoIA, et les notes proviennent de leurs pages.
| Modèle | Meilleur usage |
|---|
| Wan 3 | Clips allant jusqu’à 30 secondes en 1080p maximum, entrée texte ou image |
| Wan 3 Prime | Texte vers vidéo en 1080p jusqu’à 30 secondes avec une image de départ facultative |
| Wan 2.7 T2V | Texte vers vidéo en 1080p, de la génération précédente |
| Seedance 2.5 | Vidéos allant jusqu’à 30 secondes |
| Seedance 2.5 Lite | Vidéos gratuites et illimitées allant jusqu’à 10 secondes |
| Kling v3 Video | Texte vers vidéo cinématographique |
| Veo 3.1 | Texte vers vidéo en 1080p |
| LTX 2.3 Pro | Vidéo 4K à partir de texte |

Si vous avez besoin de 4K, LTX 2.3 Pro est le meilleur choix, car Wan 3 s’arrête à 1080p. Si vous voulez un clip court gratuit et illimité, Seedance 2.5 Lite convient. Si vous voulez le rendu unique le plus long, Wan 3 et Seedance 2.5 sont les deux à tester côte à côte avec le même prompt.
Créer votre premier clip avec Wan 3
Vous n’avez besoin ni d’un compte API, ni d’un GPU, ni d’un week-end libre pour savoir si Wan 3 convient à votre travail. Ouvrez Wan 3 sur PicassoIA, collez l’un des prompts ci-dessus, réglez 480p et 5 secondes, puis générez. Modifiez une seule chose à la fois, gardez le seed qui vous plaît, et ce n’est qu’ensuite que vous augmenterez la résolution et la durée.

Pour un second avis, lancez le même prompt sur Wan 3 Prime et comparez le mouvement. Et si la question de l’open source compte pour vous, suivez les pages officielles de Wan. Si des poids apparaissent un jour, les prompts ci-dessus pourront être repris dans une installation locale. Essayez votre premier clip sur Picasso IA dès aujourd’hui.