Runway Gen-4.5 : nouveautés et mode d’emploi

Runway Gen-4.5 est la dernière version du modèle phare de texte vers vidéo de Runway : contrôle du mouvement, cohérence temporelle et respect des prompts progressent nettement. Cet article détaille chaque nouveauté, montre comment les utiliser concrètement et compare Gen-4.5 aux meilleurs générateurs de vidéos par IA disponibles en 2027.

Runway Gen-4.5 : nouveautés et mode d’emploi
Cristian Da Conceicao
Fondateur de Picasso IA

Runway fait évoluer son architecture Gen-4 par petites étapes, et avec Gen-4.5, le saut est nettement perceptible. Si vous utilisiez la version précédente et vous demandez si la mise à jour change vraiment quelque chose à votre flux de travail, la réponse courte est oui. Les changements ne sont pas cosmétiques. La qualité du mouvement, la cohérence d’une image à l’autre et la fidélité avec laquelle le modèle suit vos prompts ont tous connu de réelles améliorations. Cet article passe en revue chaque changement notable de Gen-4.5, vous montre comment utiliser le modèle étape par étape et le confronte aux principaux concurrents disponibles en 2027.

Mains tenant une caméra de qualité cinéma sur un plateau de tournage

Ce qui a réellement changé dans Gen-4.5

Le passage de Gen-4 à Gen-4.5 n’est pas un simple effet d’annonce. Trois domaines ont fait l’objet d’une attention particulière : la précision du contrôle du mouvement, la stabilité d’une image à l’autre et la fidélité au prompt. Chacun d’eux influe sur l’utilité du modèle pour un travail créatif professionnel, que vous produisiez des courts métrages, du contenu pour les réseaux sociaux ou des vidéos commerciales.

Le pinceau de mouvement multiple

Le pinceau de mouvement multiple est la fonctionnalité phare de cette version. Dans Gen-4, vous pouviez suggérer un mouvement général par des prompts textuels, mais le modèle décidait seul de la façon dont les objets se déplaçaient les uns par rapport aux autres. Gen-4.5 vous offre un contrôle précis : vous tracez des zones directement sur votre image source et attribuez à chaque zone un vecteur de mouvement indépendant.

Cela compte énormément pour les scènes à plusieurs sujets. Une personne qui marche vers la gauche pendant qu’une foule en arrière-plan se déplace vers la droite, ou une voiture qui s’éloigne pendant que la caméra effectue un panoramique dans la direction opposée. Avant cette mise à jour, obtenir ce type de chorégraphie demandait d’assembler plusieurs générations distinctes en post-production. Désormais, cela se fait en une seule passe de génération.

L’outil prend aussi en charge le mouvement en couches. Vous pouvez attribuer une lente dérive au ciel de l’arrière-plan, un mouvement modéré aux arbres du second plan et une trajectoire spécifique plus rapide à votre sujet au premier plan. Le résultat est un effet de profondeur par parallaxe qui nécessitait auparavant un logiciel dédié aux motion graphics.

💡 Astuce : Veillez à ce que les vecteurs de mouvement des régions adjacentes soient clairement différenciés. Des directions qui se chevauchent perturbent le modèle et produisent un mouvement mêlé et non voulu dans la zone de recouvrement. Un petit espace entre les régions tracées évite totalement ce problème.

Améliorations de la cohérence temporelle

L’un des problèmes récurrents des premiers modèles de vidéo par IA était le scintillement. Les visages se déplaçaient subtilement d’une image à l’autre. Les textures des vêtements ondulaient ou pulsaient. Les petits objets en arrière-plan apparaissaient et disparaissaient, ce qui brisait immédiatement l’immersion.

Gen-4.5 répond à ce problème grâce à une attention temporelle améliorée dans l’architecture du modèle. Concrètement, cela donne :

  • Des textures de peau et de surface qui restent stables sur toute la durée du clip
  • Des éléments d’arrière-plan qui ne scintillent plus et ne disparaissent plus d’une image à l’autre
  • Des cheveux et des tissus qui bougent avec une inertie physiquement plausible, au lieu de passer d’une position à l’autre
  • Un éclairage constant, même lorsque les sujets traversent différentes zones du cadre
  • Une identité des objets préservée : une tasse de café posée sur une table reste une tasse de café, avec la même forme et la même couleur du début à la fin

Pour quiconque génère des vidéos de type face caméra, des interviews ou des gros plans de produits, cette seule amélioration justifie de choisir Gen-4.5 plutôt que sa version précédente. La différence se voit dès le premier visionnage.

Un meilleur respect des prompts

Gen-4.5 est nettement meilleur pour suivre des consignes textuelles précises. La version précédente respectait souvent l’ambiance générale d’un prompt tout en ignorant les détails, notamment en ce qui concerne le mouvement de caméra et le comportement des petits objets dans le cadre.

Le modèle mis à jour gère désormais correctement des instructions comme « travelling lent vers le sujet » ou « des feuilles tombent depuis le haut à gauche pendant que le sujet reste immobile ». Un prompt précis donne maintenant un résultat tout aussi précis, au lieu d’une simple approximation. C’est particulièrement utile pour les créateurs qui ont constitué des bibliothèques de prompts détaillées et qui comptent sur une interprétation constante pour maintenir le style visuel d’un projet.

Réalisateur consultant des rushes sur un ordinateur portable dans une salle de montage

Gen-4 ou Gen-4.5 : les vraies différences

Voici une comparaison directe de ce qui a changé entre les deux versions, sur les fonctionnalités les plus importantes pour la production :

FonctionnalitéGen-4Gen-4.5
Contrôle du mouvementSuggestions textuelles uniquementZones du pinceau de mouvement multiple
Cohérence temporelleModérée, scintillement visibleScintillement nettement réduit
Respect du promptIntention générale respectéeConsignes précises suivies
Résolution maximale1280x7681280x768
Durée maximale10 secondes10 secondes
Contrôle de la caméraDe base (piloté par le texte)Directionnalité améliorée
Cohérence du sujetVariable d’un clip à l’autrePlus stable au sein du clip
Mouvement multicoucheNon disponibleDisponible via l’outil pinceau
TarificationBasée sur les créditsBasée sur les crédits (inchangée)

Le plafond de résolution n’a pas changé, ce qui mérite d’être signalé. Si une sortie en 4K est une exigence stricte pour votre projet, vous devrez toujours lancer une passe de super-résolution après la génération. C’est une limite réelle par rapport à plusieurs concurrents qui produisent désormais du 1080p natif, voire davantage, dans leur chaîne de base.

Comment fonctionne Gen-4.5 en pratique

Deux créatifs qui collaborent à un bureau partagé et examinent des rushes

Mode texte vers vidéo

La chaîne texte vers vidéo de Gen-4.5 prend un prompt écrit et produit un clip d’une durée maximale de 10 secondes. Le modèle est optimisé pour les contenus cinématographiques et gère particulièrement bien les environnements naturels, les intérieurs architecturaux et les sujets humains. Les prompts abstraits ou surréalistes peuvent donner des résultats saisissants, mais la cohérence y est plus difficile à anticiper et à contrôler d’une génération à l’autre.

La structure de prompt la plus fiable pour Gen-4.5 suit ce schéma :

[Description du sujet] + [Action et mouvement] + [Environnement] + [Instruction de caméra] + [Ambiance et éclairage]

Par exemple : « Une femme en manteau blanc traverse lentement un champ de blé baigné de soleil, la caméra la suit par l’arrière à faible hauteur, lumière dorée de fin de journée, léger mouvement du vent dans l’herbe. » Cette structure donne au modèle des instructions claires à chaque niveau : qui, ce qu’il fait, où il se trouve, comment se comporte la caméra et ce que la scène doit évoquer.

Évitez les qualificatifs émotionnels vagues comme « beau » ou « dramatique » utilisés seuls. Décrivez plutôt les conditions visuelles précises qui créent cette émotion. « Contre-jour de fin d’après-midi avec reflets de lentille » est plus utile que « éclairage magnifique ».

Mode image vers vidéo

C’est en mode image vers vidéo que Gen-4.5 devient un véritable outil de production. Vous fournissez une image fixe et un prompt de mouvement, et le modèle anime l’image tout en préservant le style visuel, l’éclairage et la composition de votre source.

Ce mode est particulièrement utile lorsque vous disposez :

  • De photos de produits que vous voulez animer avec un mouvement subtil
  • D’illustrations ou de concept art qui ont besoin d’animation
  • De portraits pour lesquels vous voulez une respiration, des clignements et des mouvements de regard naturels
  • D’images d’architecture que vous souhaitez animer avec des éléments d’environnement comme le vent, l’eau ou les variations de lumière
  • De visuels de marque ou de logos pour lesquels vous avez besoin d’un mouvement contrôlé et conforme à l’identité de marque

Le pinceau de mouvement multiple s’intègre directement à ce mode. Vous peignez des zones sur votre image source, attribuez des vecteurs de mouvement à chacune, puis laissez le modèle calculer la physique de l’interaction de ces mouvements entre eux et avec la géométrie de la scène.

5 conseils pour de meilleurs résultats

Bureau d’un réalisateur avec des storyboards annotés et des documents de préparation

Obtenir des résultats constamment bons avec Gen-4.5 suppose de comprendre la manière dont le modèle interprète ce qu’on lui donne. Ces cinq pratiques font une différence mesurable sur la qualité des sorties :

  1. Utilisez des images de référence dès que possible. Les sorties en image vers vidéo sont plus cohérentes que le texte vers vidéo pur, car le modèle dispose d’un point de départ visuel concret. L’identité du sujet, les conditions d’éclairage et la composition sont tous fixés à partir de la référence.
  2. Décrivez le mouvement au niveau de la phrase. Au lieu de « caméra en mouvement », écrivez « travelling latéral lent de la gauche vers la droite, le sujet reste centré dans le cadre tout du long ». Plus l’instruction de caméra est explicite, plus elle est exécutée fidèlement.
  3. Gardez des scènes simples sur le plan de la composition. Un sujet principal avec un arrière-plan bien défini donne de meilleurs résultats qu’une scène complexe à plusieurs éléments, en matière de cohérence et de stabilité temporelle.
  4. Séparez les régions du pinceau de mouvement multiple par des espaces clairs. Les définitions de mouvement débordent sur les régions voisines lorsque les attributions se chevauchent, ce qui produit un mouvement intermédiaire confus qui ne respecte aucune des deux consignes.
  5. Générez plusieurs variantes du même prompt. Gen-4.5 présente une variabilité notable d’une exécution à l’autre. Générer trois à cinq versions d’un même prompt vous donne un choix de résultats et augmente nettement les chances d’obtenir un bon rendu.

💡 Astuce : Pour les contenus de type face caméra en particulier, partez d’un portrait photographique en haute résolution plutôt que de générer un personnage à partir d’un texte. Les améliorations de cohérence temporelle de Gen-4.5 préservent bien plus fidèlement l’identité faciale lorsque la source est une vraie photographie.

Les limites de Gen-4.5

Aucun modèle n’est sans faiblesses. Voici les domaines dans lesquels Gen-4.5 peine encore, par rapport à ce dont les créatifs professionnels ont besoin et à ce que les modèles concurrents proposent désormais :

Plafond de résolution. Avec un maximum de 1280x768, tout ce qui est destiné à la diffusion, au cinéma ou à une livraison 4K pour les réseaux sociaux nécessite une étape distincte d’upscaling (augmentation de la résolution). Des concurrents comme LTX 2.3 Pro produisent de la 4K native, et Kling v3 gère le 1080p nativement, sans étape de post-traitement.

Durée maximale d’un clip. Avec 10 secondes par génération, vous ne pouvez pas produire de séquences longues en une seule passe. Assembler plusieurs clips introduit des problèmes de cohérence : faire correspondre l’éclairage, l’apparence des sujets et le comportement de la caméra d’une génération à l’autre demande un temps considérable et souvent des corrections manuelles.

Pas d’audio natif. Gen-4.5 produit des vidéos muettes. Des modèles comme Veo 3 et Seedance 2.0 génèrent désormais dans une seule passe un son d’ambiance, des dialogues et de la musique synchronisés avec la vidéo. Pour les créateurs qui veulent des clips entièrement finis sans travail de post-production supplémentaire, c’est un écart important.

Coût en crédits des flux de travail à forte itération. Runway fonctionne sur un système de crédits, et Gen-4.5 consomme des crédits à un rythme qui s’accumule vite lorsque vous enchaînez de nombreuses générations pour trouver la bonne prise. Les créatifs soucieux de leur budget et qui travaillent en volume ressentiront cette contrainte bien plus fortement que ceux qui produisent occasionnellement des pièces très travaillées.

Bureau créatif moderne avec de grandes fenêtres et une équipe devant des écrans

La concurrence en 2027

Gen-4.5 est un modèle solide, mais le paysage de la génération de vidéos par IA en 2027 est extrêmement concurrentiel. Plusieurs alternatives surpassent Gen-4.5 dans des catégories précises, qui comptent selon les types de production.

Kling v3

Kling v3 de Kuaishou est actuellement l’un des modèles de texte vers vidéo les plus performants disponibles. Il produit du 1080p natif, gère les scènes complexes à plusieurs sujets avec une forte cohérence temporelle et dispose de son propre système de contrôle du mouvement, via Kling v3 Motion Control. Pour les créatifs qui privilégient la résolution de sortie et la complexité des sujets, Kling v3 est aujourd’hui le choix le plus performant. La variante Kling v2.6 reste également une option fiable pour qui recherche un bon équilibre entre vitesse et qualité.

Sora 2 Pro

Sora 2 Pro d’OpenAI offre une qualité de simulation physique que Gen-4.5 ne peut pas égaler pour la dynamique des fluides, la simulation de tissus et les interactions complexes de particules. Si votre contenu fait intervenir de l’eau, du feu, de la fumée ou des tissus complexes soumis au vent, Sora 2 Pro produit des résultats nettement plus exacts sur le plan physique, qui tiennent à un examen attentif.

Veo 3

Veo 3 de Google est la référence actuelle pour la génération de vidéos synchronisées avec l’audio. Il produit un son d’ambiance, des dialogues et une musique atmosphérique en même temps que les images, en une seule passe de génération. Pour les créateurs de contenus sociaux et les spécialistes du marketing qui ont besoin de clips prêts à publier avec du son, cet avantage de flux de travail est considérable. Veo 3.1 va plus loin avec une meilleure fidélité audio et un rendu plus rapide.

Seedance 2.0

Seedance 2.0 de ByteDance est particulièrement performant pour une génération rapide en haute qualité. Seedance 2.0 Fast est le modèle à privilégier lorsque vous avez besoin d’itérer rapidement sans trop sacrifier la qualité visuelle. Pour les agences et les créatifs qui travaillent en gros volumes, le rapport vitesse-qualité est difficile à battre.

Réalisatrice assurée debout dans un studio de cinéma avec un éclairage professionnel

Voici comment ces modèles se comparent sur les critères qui comptent le plus pour les choix de production :

ModèleRésolution maximaleAudio natifContrôle du mouvementIdéal pour
Runway Gen-4.51280x768NonPinceau de mouvement multipleCourts métrages cinématographiques, mouvement précis
Kling v31080pNonContrôle du mouvement avancéContenus professionnels en haute résolution
Sora 2 Pro1080pOuiStandardScènes riches en physique
Veo 31080pOuiStandardContenus sociaux synchronisés avec l’audio
Seedance 2.01080pOuiStandardItération rapide, gros volumes
LTX 2.3 Pro4KNonStandardSortie en ultra-haute résolution

Comment utiliser Gen 4.5 sur PicassoIA

Gen 4.5 est disponible directement sur PicassoIA, ce qui vous permet de générer une vidéo de qualité Runway sans gérer un compte Runway distinct ni vous repérer dans son système de crédits autonome. Le flux de travail est simple et accessible aux débutants.

Gros plan d’une timeline de montage vidéo sur un moniteur 4K

Étape 1 : Ouvrez la page du modèle Gen 4.5

Rendez-vous sur la page du modèle Gen 4.5 sur PicassoIA. Vous y verrez le champ de saisie du prompt et l’option permettant d’importer une image de référence pour le mode image vers vidéo.

Étape 2 : Choisissez votre mode de génération

Si vous partez uniquement d’un texte, rédigez votre prompt directement dans le champ de saisie. Si vous disposez d’une image de référence, importez-la à l’aide du champ prévu à cet effet. Le mode image vers vidéo s’active automatiquement lorsqu’une image est détectée, et l’outil pinceau de mouvement multiple apparaît dans la barre d’outils.

Étape 3 : Rédigez un prompt structuré

Suivez la structure Sujet, Action, Environnement, Caméra, Ambiance décrite précédemment. Pour le pinceau de mouvement multiple : cliquez sur l’icône du pinceau, tracez vos zones sur l’image importée et attribuez une direction de mouvement à chacune à l’aide des commandes directionnelles. Gardez les zones séparées dans l’espace pour éviter les débordements de mouvement.

Étape 4 : Réglez vos paramètres

  • Durée : Commencez par 5 secondes pour une itération plus rapide et moins coûteuse. Passez à 10 secondes une fois que vous disposez d’une structure de prompt qui produit des résultats cohérents.
  • Format : 16:9 pour les contenus en paysage, 9:16 pour les formats verticaux des réseaux sociaux.
  • Intensité du mouvement : Les réglages modérés donnent les résultats les plus stables. Des réglages de mouvement élevés peuvent introduire des artefacts temporels, même avec les améliorations de Gen-4.5, en particulier autour des sujets qui bougent vite.

Étape 5 : Générez et évaluez

Lancez votre tâche. La génération prend généralement de 60 à 120 secondes, selon la charge actuelle des serveurs. Évaluez le résultat par rapport à votre brief de mouvement. Si la cohérence du visage n’est pas au rendez-vous, passez à une image de référence photographique. Si le mouvement de caméra ne correspond pas à votre intention, rendez l’instruction de caméra plus explicite dans votre prompt.

Étape 6 : Itérez et affinez

L’interface de PicassoIA vous permet de relancer le même prompt avec des modifications. Servez-vous-en pour explorer des variations de mouvement, puis combinez vos meilleures prises dans votre logiciel de montage. Si vous avez besoin d’une sortie upscalée en 4K pour la livraison, passez-la dans LTX 2.3 Pro ou un autre modèle de super-résolution en dernière étape.

💡 Astuce : Si vous voulez une génération plus rapide pour une itération en volume, Gen4 Turbo est également disponible sur PicassoIA. Il sacrifie un peu de qualité pour des temps de sortie nettement plus courts, ce qui le rend pratique pour explorer rapidement des idées avant de lancer un rendu final avec Gen-4.5.

À vous de créer

Femme travaillant en terrasse de café avec un ordinateur portable affichant une interface vidéo

Gen-4.5 représente à ce jour la version la plus aboutie de l’architecture de Runway, et le pinceau de mouvement multiple seul ouvre des flux de production qui n’étaient tout simplement pas possibles avec les versions précédentes. Les améliorations de cohérence temporelle le rendent réellement utilisable pour les gros plans et les contenus face caméra, sans le travail de nettoyage manuel qu’exigeaient les versions antérieures.

L’avantage réel de travailler sur PicassoIA, c’est de ne pas être enfermé dans un seul modèle. Si votre scène exige de l’audio natif, Veo 3 est à un clic. Si vous avez besoin d’une sortie 4K native, LTX 2.3 Pro ou Kling v3 sont directement disponibles. Si vous avez besoin de volume et de vitesse, Seedance 2.0 Fast fait le travail. Et lorsque vous voulez le contrôle précis du mouvement et la qualité cinématographique pour lesquels Gen-4.5 est conçu, il est prêt à l’emploi, sans aucune configuration supplémentaire.

La meilleure façon de voir ce que ces modèles peuvent réellement faire pour votre contenu est de les tester sur vos propres éléments. Ouvrez Gen 4.5 sur PicassoIA, partez d’une image que vous avez déjà, rédigez un prompt de mouvement clair et regardez ce qui en ressort. La première génération est toujours surprenante.

Partager cet article

Choisissez votre langue