Runway fait évoluer son architecture Gen-4 par petites étapes, et avec Gen-4.5, le saut est nettement perceptible. Si vous utilisiez la version précédente et vous demandez si la mise à jour change vraiment quelque chose à votre flux de travail, la réponse courte est oui. Les changements ne sont pas cosmétiques. La qualité du mouvement, la cohérence d’une image à l’autre et la fidélité avec laquelle le modèle suit vos prompts ont tous connu de réelles améliorations. Cet article passe en revue chaque changement notable de Gen-4.5, vous montre comment utiliser le modèle étape par étape et le confronte aux principaux concurrents disponibles en 2027.

Ce qui a réellement changé dans Gen-4.5
Le passage de Gen-4 à Gen-4.5 n’est pas un simple effet d’annonce. Trois domaines ont fait l’objet d’une attention particulière : la précision du contrôle du mouvement, la stabilité d’une image à l’autre et la fidélité au prompt. Chacun d’eux influe sur l’utilité du modèle pour un travail créatif professionnel, que vous produisiez des courts métrages, du contenu pour les réseaux sociaux ou des vidéos commerciales.
Le pinceau de mouvement multiple
Le pinceau de mouvement multiple est la fonctionnalité phare de cette version. Dans Gen-4, vous pouviez suggérer un mouvement général par des prompts textuels, mais le modèle décidait seul de la façon dont les objets se déplaçaient les uns par rapport aux autres. Gen-4.5 vous offre un contrôle précis : vous tracez des zones directement sur votre image source et attribuez à chaque zone un vecteur de mouvement indépendant.
Cela compte énormément pour les scènes à plusieurs sujets. Une personne qui marche vers la gauche pendant qu’une foule en arrière-plan se déplace vers la droite, ou une voiture qui s’éloigne pendant que la caméra effectue un panoramique dans la direction opposée. Avant cette mise à jour, obtenir ce type de chorégraphie demandait d’assembler plusieurs générations distinctes en post-production. Désormais, cela se fait en une seule passe de génération.
L’outil prend aussi en charge le mouvement en couches. Vous pouvez attribuer une lente dérive au ciel de l’arrière-plan, un mouvement modéré aux arbres du second plan et une trajectoire spécifique plus rapide à votre sujet au premier plan. Le résultat est un effet de profondeur par parallaxe qui nécessitait auparavant un logiciel dédié aux motion graphics.
💡 Astuce : Veillez à ce que les vecteurs de mouvement des régions adjacentes soient clairement différenciés. Des directions qui se chevauchent perturbent le modèle et produisent un mouvement mêlé et non voulu dans la zone de recouvrement. Un petit espace entre les régions tracées évite totalement ce problème.
Améliorations de la cohérence temporelle
L’un des problèmes récurrents des premiers modèles de vidéo par IA était le scintillement. Les visages se déplaçaient subtilement d’une image à l’autre. Les textures des vêtements ondulaient ou pulsaient. Les petits objets en arrière-plan apparaissaient et disparaissaient, ce qui brisait immédiatement l’immersion.
Gen-4.5 répond à ce problème grâce à une attention temporelle améliorée dans l’architecture du modèle. Concrètement, cela donne :
- Des textures de peau et de surface qui restent stables sur toute la durée du clip
- Des éléments d’arrière-plan qui ne scintillent plus et ne disparaissent plus d’une image à l’autre
- Des cheveux et des tissus qui bougent avec une inertie physiquement plausible, au lieu de passer d’une position à l’autre
- Un éclairage constant, même lorsque les sujets traversent différentes zones du cadre
- Une identité des objets préservée : une tasse de café posée sur une table reste une tasse de café, avec la même forme et la même couleur du début à la fin
Pour quiconque génère des vidéos de type face caméra, des interviews ou des gros plans de produits, cette seule amélioration justifie de choisir Gen-4.5 plutôt que sa version précédente. La différence se voit dès le premier visionnage.
Un meilleur respect des prompts
Gen-4.5 est nettement meilleur pour suivre des consignes textuelles précises. La version précédente respectait souvent l’ambiance générale d’un prompt tout en ignorant les détails, notamment en ce qui concerne le mouvement de caméra et le comportement des petits objets dans le cadre.
Le modèle mis à jour gère désormais correctement des instructions comme « travelling lent vers le sujet » ou « des feuilles tombent depuis le haut à gauche pendant que le sujet reste immobile ». Un prompt précis donne maintenant un résultat tout aussi précis, au lieu d’une simple approximation. C’est particulièrement utile pour les créateurs qui ont constitué des bibliothèques de prompts détaillées et qui comptent sur une interprétation constante pour maintenir le style visuel d’un projet.

Gen-4 ou Gen-4.5 : les vraies différences
Voici une comparaison directe de ce qui a changé entre les deux versions, sur les fonctionnalités les plus importantes pour la production :
| Fonctionnalité | Gen-4 | Gen-4.5 |
|---|
| Contrôle du mouvement | Suggestions textuelles uniquement | Zones du pinceau de mouvement multiple |
| Cohérence temporelle | Modérée, scintillement visible | Scintillement nettement réduit |
| Respect du prompt | Intention générale respectée | Consignes précises suivies |
| Résolution maximale | 1280x768 | 1280x768 |
| Durée maximale | 10 secondes | 10 secondes |
| Contrôle de la caméra | De base (piloté par le texte) | Directionnalité améliorée |
| Cohérence du sujet | Variable d’un clip à l’autre | Plus stable au sein du clip |
| Mouvement multicouche | Non disponible | Disponible via l’outil pinceau |
| Tarification | Basée sur les crédits | Basée sur les crédits (inchangée) |
Le plafond de résolution n’a pas changé, ce qui mérite d’être signalé. Si une sortie en 4K est une exigence stricte pour votre projet, vous devrez toujours lancer une passe de super-résolution après la génération. C’est une limite réelle par rapport à plusieurs concurrents qui produisent désormais du 1080p natif, voire davantage, dans leur chaîne de base.

Mode texte vers vidéo
La chaîne texte vers vidéo de Gen-4.5 prend un prompt écrit et produit un clip d’une durée maximale de 10 secondes. Le modèle est optimisé pour les contenus cinématographiques et gère particulièrement bien les environnements naturels, les intérieurs architecturaux et les sujets humains. Les prompts abstraits ou surréalistes peuvent donner des résultats saisissants, mais la cohérence y est plus difficile à anticiper et à contrôler d’une génération à l’autre.
La structure de prompt la plus fiable pour Gen-4.5 suit ce schéma :
[Description du sujet] + [Action et mouvement] + [Environnement] + [Instruction de caméra] + [Ambiance et éclairage]
Par exemple : « Une femme en manteau blanc traverse lentement un champ de blé baigné de soleil, la caméra la suit par l’arrière à faible hauteur, lumière dorée de fin de journée, léger mouvement du vent dans l’herbe. » Cette structure donne au modèle des instructions claires à chaque niveau : qui, ce qu’il fait, où il se trouve, comment se comporte la caméra et ce que la scène doit évoquer.
Évitez les qualificatifs émotionnels vagues comme « beau » ou « dramatique » utilisés seuls. Décrivez plutôt les conditions visuelles précises qui créent cette émotion. « Contre-jour de fin d’après-midi avec reflets de lentille » est plus utile que « éclairage magnifique ».
Mode image vers vidéo
C’est en mode image vers vidéo que Gen-4.5 devient un véritable outil de production. Vous fournissez une image fixe et un prompt de mouvement, et le modèle anime l’image tout en préservant le style visuel, l’éclairage et la composition de votre source.
Ce mode est particulièrement utile lorsque vous disposez :
- De photos de produits que vous voulez animer avec un mouvement subtil
- D’illustrations ou de concept art qui ont besoin d’animation
- De portraits pour lesquels vous voulez une respiration, des clignements et des mouvements de regard naturels
- D’images d’architecture que vous souhaitez animer avec des éléments d’environnement comme le vent, l’eau ou les variations de lumière
- De visuels de marque ou de logos pour lesquels vous avez besoin d’un mouvement contrôlé et conforme à l’identité de marque
Le pinceau de mouvement multiple s’intègre directement à ce mode. Vous peignez des zones sur votre image source, attribuez des vecteurs de mouvement à chacune, puis laissez le modèle calculer la physique de l’interaction de ces mouvements entre eux et avec la géométrie de la scène.
5 conseils pour de meilleurs résultats

Obtenir des résultats constamment bons avec Gen-4.5 suppose de comprendre la manière dont le modèle interprète ce qu’on lui donne. Ces cinq pratiques font une différence mesurable sur la qualité des sorties :
- Utilisez des images de référence dès que possible. Les sorties en image vers vidéo sont plus cohérentes que le texte vers vidéo pur, car le modèle dispose d’un point de départ visuel concret. L’identité du sujet, les conditions d’éclairage et la composition sont tous fixés à partir de la référence.
- Décrivez le mouvement au niveau de la phrase. Au lieu de « caméra en mouvement », écrivez « travelling latéral lent de la gauche vers la droite, le sujet reste centré dans le cadre tout du long ». Plus l’instruction de caméra est explicite, plus elle est exécutée fidèlement.
- Gardez des scènes simples sur le plan de la composition. Un sujet principal avec un arrière-plan bien défini donne de meilleurs résultats qu’une scène complexe à plusieurs éléments, en matière de cohérence et de stabilité temporelle.
- Séparez les régions du pinceau de mouvement multiple par des espaces clairs. Les définitions de mouvement débordent sur les régions voisines lorsque les attributions se chevauchent, ce qui produit un mouvement intermédiaire confus qui ne respecte aucune des deux consignes.
- Générez plusieurs variantes du même prompt. Gen-4.5 présente une variabilité notable d’une exécution à l’autre. Générer trois à cinq versions d’un même prompt vous donne un choix de résultats et augmente nettement les chances d’obtenir un bon rendu.
💡 Astuce : Pour les contenus de type face caméra en particulier, partez d’un portrait photographique en haute résolution plutôt que de générer un personnage à partir d’un texte. Les améliorations de cohérence temporelle de Gen-4.5 préservent bien plus fidèlement l’identité faciale lorsque la source est une vraie photographie.
Les limites de Gen-4.5
Aucun modèle n’est sans faiblesses. Voici les domaines dans lesquels Gen-4.5 peine encore, par rapport à ce dont les créatifs professionnels ont besoin et à ce que les modèles concurrents proposent désormais :
Plafond de résolution. Avec un maximum de 1280x768, tout ce qui est destiné à la diffusion, au cinéma ou à une livraison 4K pour les réseaux sociaux nécessite une étape distincte d’upscaling (augmentation de la résolution). Des concurrents comme LTX 2.3 Pro produisent de la 4K native, et Kling v3 gère le 1080p nativement, sans étape de post-traitement.
Durée maximale d’un clip. Avec 10 secondes par génération, vous ne pouvez pas produire de séquences longues en une seule passe. Assembler plusieurs clips introduit des problèmes de cohérence : faire correspondre l’éclairage, l’apparence des sujets et le comportement de la caméra d’une génération à l’autre demande un temps considérable et souvent des corrections manuelles.
Pas d’audio natif. Gen-4.5 produit des vidéos muettes. Des modèles comme Veo 3 et Seedance 2.0 génèrent désormais dans une seule passe un son d’ambiance, des dialogues et de la musique synchronisés avec la vidéo. Pour les créateurs qui veulent des clips entièrement finis sans travail de post-production supplémentaire, c’est un écart important.
Coût en crédits des flux de travail à forte itération. Runway fonctionne sur un système de crédits, et Gen-4.5 consomme des crédits à un rythme qui s’accumule vite lorsque vous enchaînez de nombreuses générations pour trouver la bonne prise. Les créatifs soucieux de leur budget et qui travaillent en volume ressentiront cette contrainte bien plus fortement que ceux qui produisent occasionnellement des pièces très travaillées.

La concurrence en 2027
Gen-4.5 est un modèle solide, mais le paysage de la génération de vidéos par IA en 2027 est extrêmement concurrentiel. Plusieurs alternatives surpassent Gen-4.5 dans des catégories précises, qui comptent selon les types de production.
Kling v3
Kling v3 de Kuaishou est actuellement l’un des modèles de texte vers vidéo les plus performants disponibles. Il produit du 1080p natif, gère les scènes complexes à plusieurs sujets avec une forte cohérence temporelle et dispose de son propre système de contrôle du mouvement, via Kling v3 Motion Control. Pour les créatifs qui privilégient la résolution de sortie et la complexité des sujets, Kling v3 est aujourd’hui le choix le plus performant. La variante Kling v2.6 reste également une option fiable pour qui recherche un bon équilibre entre vitesse et qualité.
Sora 2 Pro
Sora 2 Pro d’OpenAI offre une qualité de simulation physique que Gen-4.5 ne peut pas égaler pour la dynamique des fluides, la simulation de tissus et les interactions complexes de particules. Si votre contenu fait intervenir de l’eau, du feu, de la fumée ou des tissus complexes soumis au vent, Sora 2 Pro produit des résultats nettement plus exacts sur le plan physique, qui tiennent à un examen attentif.
Veo 3
Veo 3 de Google est la référence actuelle pour la génération de vidéos synchronisées avec l’audio. Il produit un son d’ambiance, des dialogues et une musique atmosphérique en même temps que les images, en une seule passe de génération. Pour les créateurs de contenus sociaux et les spécialistes du marketing qui ont besoin de clips prêts à publier avec du son, cet avantage de flux de travail est considérable. Veo 3.1 va plus loin avec une meilleure fidélité audio et un rendu plus rapide.
Seedance 2.0
Seedance 2.0 de ByteDance est particulièrement performant pour une génération rapide en haute qualité. Seedance 2.0 Fast est le modèle à privilégier lorsque vous avez besoin d’itérer rapidement sans trop sacrifier la qualité visuelle. Pour les agences et les créatifs qui travaillent en gros volumes, le rapport vitesse-qualité est difficile à battre.

Voici comment ces modèles se comparent sur les critères qui comptent le plus pour les choix de production :
| Modèle | Résolution maximale | Audio natif | Contrôle du mouvement | Idéal pour |
|---|
| Runway Gen-4.5 | 1280x768 | Non | Pinceau de mouvement multiple | Courts métrages cinématographiques, mouvement précis |
| Kling v3 | 1080p | Non | Contrôle du mouvement avancé | Contenus professionnels en haute résolution |
| Sora 2 Pro | 1080p | Oui | Standard | Scènes riches en physique |
| Veo 3 | 1080p | Oui | Standard | Contenus sociaux synchronisés avec l’audio |
| Seedance 2.0 | 1080p | Oui | Standard | Itération rapide, gros volumes |
| LTX 2.3 Pro | 4K | Non | Standard | Sortie en ultra-haute résolution |
Gen 4.5 est disponible directement sur PicassoIA, ce qui vous permet de générer une vidéo de qualité Runway sans gérer un compte Runway distinct ni vous repérer dans son système de crédits autonome. Le flux de travail est simple et accessible aux débutants.

Étape 1 : Ouvrez la page du modèle Gen 4.5
Rendez-vous sur la page du modèle Gen 4.5 sur PicassoIA. Vous y verrez le champ de saisie du prompt et l’option permettant d’importer une image de référence pour le mode image vers vidéo.
Étape 2 : Choisissez votre mode de génération
Si vous partez uniquement d’un texte, rédigez votre prompt directement dans le champ de saisie. Si vous disposez d’une image de référence, importez-la à l’aide du champ prévu à cet effet. Le mode image vers vidéo s’active automatiquement lorsqu’une image est détectée, et l’outil pinceau de mouvement multiple apparaît dans la barre d’outils.
Étape 3 : Rédigez un prompt structuré
Suivez la structure Sujet, Action, Environnement, Caméra, Ambiance décrite précédemment. Pour le pinceau de mouvement multiple : cliquez sur l’icône du pinceau, tracez vos zones sur l’image importée et attribuez une direction de mouvement à chacune à l’aide des commandes directionnelles. Gardez les zones séparées dans l’espace pour éviter les débordements de mouvement.
Étape 4 : Réglez vos paramètres
- Durée : Commencez par 5 secondes pour une itération plus rapide et moins coûteuse. Passez à 10 secondes une fois que vous disposez d’une structure de prompt qui produit des résultats cohérents.
- Format : 16:9 pour les contenus en paysage, 9:16 pour les formats verticaux des réseaux sociaux.
- Intensité du mouvement : Les réglages modérés donnent les résultats les plus stables. Des réglages de mouvement élevés peuvent introduire des artefacts temporels, même avec les améliorations de Gen-4.5, en particulier autour des sujets qui bougent vite.
Étape 5 : Générez et évaluez
Lancez votre tâche. La génération prend généralement de 60 à 120 secondes, selon la charge actuelle des serveurs. Évaluez le résultat par rapport à votre brief de mouvement. Si la cohérence du visage n’est pas au rendez-vous, passez à une image de référence photographique. Si le mouvement de caméra ne correspond pas à votre intention, rendez l’instruction de caméra plus explicite dans votre prompt.
Étape 6 : Itérez et affinez
L’interface de PicassoIA vous permet de relancer le même prompt avec des modifications. Servez-vous-en pour explorer des variations de mouvement, puis combinez vos meilleures prises dans votre logiciel de montage. Si vous avez besoin d’une sortie upscalée en 4K pour la livraison, passez-la dans LTX 2.3 Pro ou un autre modèle de super-résolution en dernière étape.
💡 Astuce : Si vous voulez une génération plus rapide pour une itération en volume, Gen4 Turbo est également disponible sur PicassoIA. Il sacrifie un peu de qualité pour des temps de sortie nettement plus courts, ce qui le rend pratique pour explorer rapidement des idées avant de lancer un rendu final avec Gen-4.5.
À vous de créer

Gen-4.5 représente à ce jour la version la plus aboutie de l’architecture de Runway, et le pinceau de mouvement multiple seul ouvre des flux de production qui n’étaient tout simplement pas possibles avec les versions précédentes. Les améliorations de cohérence temporelle le rendent réellement utilisable pour les gros plans et les contenus face caméra, sans le travail de nettoyage manuel qu’exigeaient les versions antérieures.
L’avantage réel de travailler sur PicassoIA, c’est de ne pas être enfermé dans un seul modèle. Si votre scène exige de l’audio natif, Veo 3 est à un clic. Si vous avez besoin d’une sortie 4K native, LTX 2.3 Pro ou Kling v3 sont directement disponibles. Si vous avez besoin de volume et de vitesse, Seedance 2.0 Fast fait le travail. Et lorsque vous voulez le contrôle précis du mouvement et la qualité cinématographique pour lesquels Gen-4.5 est conçu, il est prêt à l’emploi, sans aucune configuration supplémentaire.
La meilleure façon de voir ce que ces modèles peuvent réellement faire pour votre contenu est de les tester sur vos propres éléments. Ouvrez Gen 4.5 sur PicassoIA, partez d’une image que vous avez déjà, rédigez un prompt de mouvement clair et regardez ce qui en ressort. La première génération est toujours surprenante.