API Veo 3 dans n8n : workflow de vidéos sans visage qui tourne en pilote automatique
Créez un workflow de vidéos sans visage : n8n lit une feuille de sujets, demande à un LLM de générer les scènes, envoie chaque prompt à l’API Veo 3, interroge le rendu de longue durée, ajoute la narration et importe le short terminé. Inclut les réglages des nœuds, les règles de nouvelle tentative et le suivi des coûts.
La plupart des chaînes sans visage bloquent au même endroit : les plans vidéo. Les scripts s’écrivent vite et une voix de synthèse coûte presque rien, mais trouver quarante secondes crédibles de vidéo pour chaque publication épuise toute la semaine. Brancher l’API Veo 3 dans n8n supprime ce goulot d’étranglement. Une ligne de tableur devient un script, le script devient des scènes de huit secondes, les scènes deviennent des clips avec le son déjà intégré, et une vidéo verticale finie arrive dans votre file d’import pendant que vous dormez.
Ce guide construit ce flux de travail de vidéos sans visage nœud par nœud. Vous verrez quels nœuds n8n portent la charge, comment gérer les réponses asynchrones lentes de Veo, où l’argent s’échappe, et comment tester vos prompts sur Veo 3 chez Picasso IA avant de les intégrer en dur dans une automatisation.
Pourquoi Veo 3 convient aux chaînes sans visage
Une chaîne sans visage repose sur le volume et la constance. Les spectateurs reviennent pour un format, pas pour un présentateur, donc la chaîne de production compte plus que n’importe quel clip isolé. C’est exactement le type de problème que l’automatisation de workflows gère bien : les mêmes étapes, dans le même ordre, avec un sujet différent à chaque exécution.
Veo 3 s’intègre bien à cette chaîne pour une raison pratique. C’est un modèle de texte vers vidéo qui génère l’image et le son ensemble à partir d’un seul prompt, et il accepte aussi une image fixe comme première image, ce qui vous permet de garder la même apparence sur toutes les scènes d’un épisode.
Les niches qui se prêtent bien à ce format incluent les explications sur les voyages et la nature, les teasers cuisine et recettes, les récits historiques illustrés par des images d’ambiance, les présentations de produits et les boucles d’ambiance pour le sommeil ou la concentration. Toutes reposent sur des objets, des lieux et des mains plutôt que sur une tête qui parle, ce qui permet au format de rester sans visage.
Le son natif supprime une branche
Les anciens pipelines comportaient trois branches : la vidéo, la musique et les effets sonores. Veo 3 génère les ambiances sonores, les effets et les répliques parlées directement dans le clip. Pour une explication sur la nature, un montage de cuisine de rue ou un teaser de produit, cela peut suffire comme bande-son finale. Vous n’ajoutez une voix off séparée que lorsque vous avez besoin de mots exacts ou d’un même narrateur sur toute une série.
De quoi une vidéo sans visage a vraiment besoin
Avant d’ouvrir n8n, notez le résultat que vous voulez. Une vidéo courte typique sans visage nécessite :
Une accroche dans les deux premières secondes, généralement une image saisissante plutôt qu’une phrase
Quatre à six scènes, chacune assez courte pour tenir dans un clip Veo
Un cadrage vertical en 9:16 pour Shorts, Reels et TikTok
Une voix de narrateur ou une musique de fond, jamais les deux en concurrence
Un titre, une description et des tags prêts pour l’étape d’import
💡 Astuce : Décidez d’abord du nombre de scènes. Chaque scène supplémentaire ajoute un appel API, une attente et une occasion de plus d’échec.
Le flux de travail en un coup d’œil
Le pipeline complet compte dix nœuds. Aucun n’est exotique, et il fonctionne sur n8n Cloud ou sur une installation auto-hébergée, avec une exception expliquée à l’étape d’assemblage.
Étape
Nœud n8n
Rôle
1
Schedule Trigger
Se déclenche une fois par jour à heure fixe
2
Google Sheets
Lit la prochaine ligne de sujet non utilisée
3
HTTP Request ou AI Agent
Demande à un LLM une liste de scènes en JSON
4
Code
Transforme chaque scène en prompt Veo
5
HTTP Request
Envoie le prompt au point d’accès Veo 3
6
Wait + IF
Interroge jusqu’à la fin du rendu
7
HTTP Request
Télécharge le MP4 terminé
8
Execute Command
Assemble les clips et ajoute la narration
9
YouTube
Importe la vidéo finale
10
Google Sheets
Consigne le statut, le lien et le coût
L’ordre compte plus que le choix des nœuds. Construisez de haut en bas, exécutez chaque nœud une fois avec des données de test épinglées, et seulement ensuite connectez le suivant. Un prompt de scène défectueux coûte beaucoup moins cher à détecter à l’étape quatre qu’après trois clips payés.
Construire les nœuds de déclenchement et de script
Schedule Trigger et feuille de sujets
Commencez par un Schedule Trigger réglé sur une exécution par jour. Ajoutez ensuite un nœud Google Sheets qui lit la première ligne dont la colonne de statut est vide. Gardez des colonnes simples : sujet, ton, statut, URL de la vidéo, coût. Cette feuille devient à la fois votre calendrier éditorial, votre file d’attente et votre journal d’audit.
Demander à un LLM les scènes
Ajoutez l’étape d’écriture. La voie la plus simple consiste à utiliser un nœud HTTP Request, ou le nœud AI Agent de n8n, pointé vers un modèle de chat comme Claude Sonnet 5, Gemini 3.5 Flash ou GPT 5.4. Demandez un JSON strict : un tableau de scènes, chacune avec une description visuelle, un mouvement de caméra et une courte note sonore sur une ligne.
La sortie structurée compte ici. Si le modèle renvoie une prose floue, votre nœud Code plantera à la troisième exécution, généralement à deux heures du matin.
Transformer chaque scène en prompt
Un nœud Code parcourt les scènes et construit le prompt final de chacune. Un bon prompt Veo suit toujours le même ordre :
Le sujet et ce qu’il fait
Le décor et le moment de la journée
Le mouvement de caméra et le rendu de l’objectif
La lumière et les couleurs
Le son souhaité dans le clip
Ajoutez une ligne de style fixe à chaque scène, par exemple « lumière naturelle, caméra à l’épaule, rendu pellicule 35 mm », pour que les clips correspondent lorsqu’ils sont assemblés. Ajoutez un prompt négatif qui écarte les textes superposés, les filigranes et les logos.
Voici un exemple finalisé pour un reportage sur la culture du café : Les mains usées d’un fermier cueillent des cerises rouges sur une colline escarpée au lever du soleil, travelling avant lent à hauteur de taille, brume qui monte entre les rangs, contre-jour chaud, feuilles qui bruissent et chant lointain d’oiseaux. Lumière naturelle, caméra à l’épaule, rendu pellicule 35 mm. Remarquez qu’aucun visage n’est demandé. Les mains, les paysages et les objets maintiennent le format sans visage, et évitent aussi le problème courant d’une personne dont le visage change d’une scène à l’autre.
Appeler l’API Veo 3 depuis n8n
C’est le cœur du workflow, et son comportement diffère d’un appel API classique.
Configurer le nœud HTTP Request
Veo est exposé via l’API Gemini de Google sous forme d’opération de longue durée. Votre première requête ne renvoie pas de vidéo. Elle renvoie un nom d’opération que vous vérifierez plus tard. Configurez le nœud ainsi :
Authentification : un identifiant Header Auth stocké dans le coffre d’identifiants de n8n, jamais collé dans le nœud lui-même
Type de corps : JSON
💡 Astuce : Les identifiants des modèles changent entre les versions preview et stables. Vérifiez l’identifiant exact dans la documentation Veo actuelle de Google avant de publier le workflow.
Envoyez un corps de requête structuré comme suit :
Encadrer le prompt avec JSON.stringify empêche un guillemet égaré dans une scène de casser la requête. Les clips sortent à huit secondes sur le point d’accès de Google, et le 1080p est lié au format horizontal, donc vérifiez quelle résolution votre format choisi prend en charge avant de vous engager sur un format vertical.
Interroger avec Wait et IF
La réponse contient un champ name. Stockez-le, puis construisez une petite boucle :
Un nœud Wait marque une pause de 60 secondes.
Un nœud HTTP Request envoie un GET vers https://generativelanguage.googleapis.com/v1beta/ suivi du nom stocké.
Un nœud IF vérifie si done est vrai.
Si c’est faux, le flux revient à un Wait plus court de 20 secondes. Si c’est vrai, le flux continue.
Sur la page PicassoIA de Veo 3, les rendus d’exemple se terminent en environ 68 à 145 secondes. Considérez cela comme une estimation de départ pour vos propres délais. Avec une attente initiale de 60 secondes et des interrogations toutes les 20 secondes, la plupart des rendus aboutissent en quatre ou cinq vérifications.
Ajoutez un compteur dans la boucle. Un nœud Code incrémente un numéro de tentative, et un second nœud IF arrête l’exécution après quinze vérifications. Sans ce plafond, un rendu bloqué peut tourner indéfiniment et saturer votre historique d’exécution.
Télécharger avant que le fichier ne disparaisse
Quand done devient vrai, l’adresse de la vidéo se trouve dans la réponse sous generateVideoResponse.generatedSamples. Ajoutez un nœud HTTP Request de plus, réglez le format de réponse sur File, envoyez le même identifiant et capturez les données binaires. Google ne conserve les fichiers générés que pendant une courte période, donc transférez le MP4 vers votre propre stockage (S3, R2 ou Drive) dans le nœud suivant. Ne stockez jamais le lien Google dans votre feuille en supposant qu’il fonctionnera encore la semaine prochaine.
Ajouter la voix et assembler la vidéo
Quand le son natif suffit
Testez une scène avec la piste intégrée avant d’ajouter quoi que ce soit. Si l’ambiance sonore convient et qu’aucune réplique parlée n’est nécessaire, supprimez entièrement la branche voix. Chaque branche retirée est un point de défaillance de moins pendant la nuit.
Ajouter un narrateur avec la synthèse vocale
Pour les formats narrés, envoyez le script à un modèle de synthèse vocale. ElevenLabs v3 gère bien les lectures expressives, Speech 2.8 HD de MiniMax offre une narration de studio propre, et Gemini 3.1 Flash TTS est le choix quand vous avez besoin de nombreuses langues. Chacun renvoie un fichier audio que vous pouvez enregistrer à côté des clips.
💡 Astuce : Ajoutez « pas de dialogue » au prompt Veo lorsque vous prévoyez de poser un narrateur par-dessus, pour que les voix propres au clip ne concurrencent jamais la vôtre.
Assembler les scènes
La jonction des clips relève de FFmpeg dans un nœud Execute Command. Une commande de base lit une liste de scènes, superpose la narration et écrit un seul fichier :
Voici le piège. Le nœud Execute Command ne fonctionne que sur n8n auto-hébergé. Sur n8n Cloud, envoyez plutôt les URL des clips à un service de rendu externe via un nœud HTTP Request. Dans les deux cas, le résultat est un MP4 par épisode, prêt pour l’étape d’import.
Publier et suivre les coûts
Importer sur Shorts, Reels et TikTok
n8n intègre un nœud YouTube qui importe un fichier binaire avec un titre, une description et un statut de confidentialité. Pour les autres plateformes, appelez l’API de publication officielle de chacune via un nœud HTTP Request, ou utilisez un service de planification qui propose un webhook. Réglez la confidentialité sur privé pour les premières exécutions et vérifiez chaque vidéo à la main jusqu’à ce que vous fassiez confiance au résultat.
Consigner chaque exécution dans la feuille
Reportez dans la feuille le statut, l’URL finale de la vidéo, le nombre de tentatives de rendu, le nombre de scènes et le coût estimé. Google facture Veo à la seconde de vidéo générée, et les tarifs ont changé plus d’une fois depuis le lancement ; stockez donc le prix par seconde dans une variable n8n ou dans une cellule de la feuille, plutôt que de le coder en dur dans six nœuds. Avec huit secondes par scène et cinq scènes, un seul épisode représente 40 secondes facturées avant même de compter une nouvelle tentative.
Des règles de nouvelle tentative qui protègent votre budget
Les échecs sont normaux avec la vidéo générative, donc définissez votre politique à l’avance :
Relancez un rendu échoué une fois avec le même prompt
Après un second échec, demandez au LLM de réécrire le prompt, puis tentez une dernière fois
Après cela, marquez la ligne « à vérifier » et arrêtez
Ajoutez un workflow Error Trigger qui vous prévient par e-mail ou dans votre messagerie
Limitez le nombre d’exécutions quotidiennes pour qu’un bug de boucle ne vide pas votre solde
Tester les prompts avec Veo 3 sur PicassoIA
Avant de dépenser de l’argent en API, prototypez chaque prompt de scène à la main. Veo 3 sur PicassoIA accepte un prompt, une résolution, un format, une image de départ facultative, un prompt négatif et un seed. Voici la routine :
Ouvrez la page Veo 3 et connectez-vous.
Collez un prompt de scène écrit dans le même ordre que votre nœud Code.
Réglez la résolution sur 720p pour les tests et passez en 1080p uniquement pour le rendu final.
Choisissez 9:16 pour les shorts verticaux ou 16:9 pour l’horizontal.
Importez éventuellement une image de départ. Les cadres idéaux font 1280x720.
Ajoutez un prompt négatif comme « texte, filigrane, logo ».
Une fois un rendu satisfaisant, figez le seed pour que les relances le reproduisent.
Générez et patientez. Les rendus d’exemple de la page ont pris d’une à deux minutes et demie.
D’autres modèles vidéo valent la peine d’être testés avec le même prompt :
💡 Astuce : PicassoIA propose aussi une API pour développeurs à https://api.picassoia.com/v1 avec des points d’accès de type Replicate : un POST vers /v1/models/{owner}/{name}/predictions, puis un GET sur /v1/predictions/{id} jusqu’à la fin de la tâche. Au moment de la rédaction, elle expose PicassoIA Video et Seedance 2.5 Lite pour la vidéo et autorise cinq prédictions simultanées par compte. Veo 3 ne figure pas dans cette liste, c’est pourquoi le workflow ci-dessus vise le point d’accès de Google. Le schéma création puis interrogation est identique, donc la même boucle Wait et IF fonctionne pour les deux.
Créez votre premier clip aujourd’hui
Vous n’avez pas besoin du pipeline complet de dix nœuds pour savoir si cette idée fonctionne dans votre niche. Choisissez un sujet, rédigez cinq prompts de scène dans l’ordre de la routine ci-dessus, et lancez-les sur Picasso IA. Comparez un brouillon en 720p avec un rendu en 1080p, essayez une version verticale et une version horizontale, et notez quels prompts tiennent sur l’ensemble des scènes.
Lorsque vous aurez trois prompts en lesquels vous avez confiance, copiez-les dans votre nœud Code et laissez n8n prendre en charge le travail répétitif. Commencez petit, consignez tout et ajoutez une branche à la fois. Ouvrez Picasso IA, lancez votre première scène et voyez jusqu’où un bon prompt peut porter une chaîne sans visage.