API Veo 3 dans n8n : workflow de vidéos sans visage qui tourne en pilote automatique

Créez un workflow de vidéos sans visage : n8n lit une feuille de sujets, demande à un LLM de générer les scènes, envoie chaque prompt à l’API Veo 3, interroge le rendu de longue durée, ajoute la narration et importe le short terminé. Inclut les réglages des nœuds, les règles de nouvelle tentative et le suivi des coûts.

API Veo 3 dans n8n : workflow de vidéos sans visage qui tourne en pilote automatique
Cristian Da Conceicao
Fondateur de Picasso IA

La plupart des chaînes sans visage bloquent au même endroit : les plans vidéo. Les scripts s’écrivent vite et une voix de synthèse coûte presque rien, mais trouver quarante secondes crédibles de vidéo pour chaque publication épuise toute la semaine. Brancher l’API Veo 3 dans n8n supprime ce goulot d’étranglement. Une ligne de tableur devient un script, le script devient des scènes de huit secondes, les scènes deviennent des clips avec le son déjà intégré, et une vidéo verticale finie arrive dans votre file d’import pendant que vous dormez.

Ce guide construit ce flux de travail de vidéos sans visage nœud par nœud. Vous verrez quels nœuds n8n portent la charge, comment gérer les réponses asynchrones lentes de Veo, où l’argent s’échappe, et comment tester vos prompts sur Veo 3 chez Picasso IA avant de les intégrer en dur dans une automatisation.

Pourquoi Veo 3 convient aux chaînes sans visage

Une chaîne sans visage repose sur le volume et la constance. Les spectateurs reviennent pour un format, pas pour un présentateur, donc la chaîne de production compte plus que n’importe quel clip isolé. C’est exactement le type de problème que l’automatisation de workflows gère bien : les mêmes étapes, dans le même ordre, avec un sujet différent à chaque exécution.

Veo 3 s’intègre bien à cette chaîne pour une raison pratique. C’est un modèle de texte vers vidéo qui génère l’image et le son ensemble à partir d’un seul prompt, et il accepte aussi une image fixe comme première image, ce qui vous permet de garder la même apparence sur toutes les scènes d’un épisode.

Les niches qui se prêtent bien à ce format incluent les explications sur les voyages et la nature, les teasers cuisine et recettes, les récits historiques illustrés par des images d’ambiance, les présentations de produits et les boucles d’ambiance pour le sommeil ou la concentration. Toutes reposent sur des objets, des lieux et des mains plutôt que sur une tête qui parle, ce qui permet au format de rester sans visage.

Le son natif supprime une branche

Les anciens pipelines comportaient trois branches : la vidéo, la musique et les effets sonores. Veo 3 génère les ambiances sonores, les effets et les répliques parlées directement dans le clip. Pour une explication sur la nature, un montage de cuisine de rue ou un teaser de produit, cela peut suffire comme bande-son finale. Vous n’ajoutez une voix off séparée que lorsque vous avez besoin de mots exacts ou d’un même narrateur sur toute une série.

De quoi une vidéo sans visage a vraiment besoin

Avant d’ouvrir n8n, notez le résultat que vous voulez. Une vidéo courte typique sans visage nécessite :

  • Une accroche dans les deux premières secondes, généralement une image saisissante plutôt qu’une phrase
  • Quatre à six scènes, chacune assez courte pour tenir dans un clip Veo
  • Un cadrage vertical en 9:16 pour Shorts, Reels et TikTok
  • Une voix de narrateur ou une musique de fond, jamais les deux en concurrence
  • Un titre, une description et des tags prêts pour l’étape d’import

💡 Astuce : Décidez d’abord du nombre de scènes. Chaque scène supplémentaire ajoute un appel API, une attente et une occasion de plus d’échec.

Organigramme dessiné à la main sur papier quadrillé pour planifier un workflow automatisé de vidéos sans visage

Le flux de travail en un coup d’œil

Le pipeline complet compte dix nœuds. Aucun n’est exotique, et il fonctionne sur n8n Cloud ou sur une installation auto-hébergée, avec une exception expliquée à l’étape d’assemblage.

ÉtapeNœud n8nRôle
1Schedule TriggerSe déclenche une fois par jour à heure fixe
2Google SheetsLit la prochaine ligne de sujet non utilisée
3HTTP Request ou AI AgentDemande à un LLM une liste de scènes en JSON
4CodeTransforme chaque scène en prompt Veo
5HTTP RequestEnvoie le prompt au point d’accès Veo 3
6Wait + IFInterroge jusqu’à la fin du rendu
7HTTP RequestTélécharge le MP4 terminé
8Execute CommandAssemble les clips et ajoute la narration
9YouTubeImporte la vidéo finale
10Google SheetsConsigne le statut, le lien et le coût

L’ordre compte plus que le choix des nœuds. Construisez de haut en bas, exécutez chaque nœud une fois avec des données de test épinglées, et seulement ensuite connectez le suivant. Un prompt de scène défectueux coûte beaucoup moins cher à détecter à l’étape quatre qu’après trois clips payés.

Construire les nœuds de déclenchement et de script

Schedule Trigger et feuille de sujets

Commencez par un Schedule Trigger réglé sur une exécution par jour. Ajoutez ensuite un nœud Google Sheets qui lit la première ligne dont la colonne de statut est vide. Gardez des colonnes simples : sujet, ton, statut, URL de la vidéo, coût. Cette feuille devient à la fois votre calendrier éditorial, votre file d’attente et votre journal d’audit.

Gros plan de mains tapant sur un clavier à un bureau pendant la création des premiers nœuds d’une automatisation

Demander à un LLM les scènes

Ajoutez l’étape d’écriture. La voie la plus simple consiste à utiliser un nœud HTTP Request, ou le nœud AI Agent de n8n, pointé vers un modèle de chat comme Claude Sonnet 5, Gemini 3.5 Flash ou GPT 5.4. Demandez un JSON strict : un tableau de scènes, chacune avec une description visuelle, un mouvement de caméra et une courte note sonore sur une ligne.

La sortie structurée compte ici. Si le modèle renvoie une prose floue, votre nœud Code plantera à la troisième exécution, généralement à deux heures du matin.

Rédacteur debout devant un bureau dans un loft lumineux, rédigeant un script vidéo sur un ordinateur portable

Transformer chaque scène en prompt

Un nœud Code parcourt les scènes et construit le prompt final de chacune. Un bon prompt Veo suit toujours le même ordre :

  1. Le sujet et ce qu’il fait
  2. Le décor et le moment de la journée
  3. Le mouvement de caméra et le rendu de l’objectif
  4. La lumière et les couleurs
  5. Le son souhaité dans le clip

Ajoutez une ligne de style fixe à chaque scène, par exemple « lumière naturelle, caméra à l’épaule, rendu pellicule 35 mm », pour que les clips correspondent lorsqu’ils sont assemblés. Ajoutez un prompt négatif qui écarte les textes superposés, les filigranes et les logos.

Voici un exemple finalisé pour un reportage sur la culture du café : Les mains usées d’un fermier cueillent des cerises rouges sur une colline escarpée au lever du soleil, travelling avant lent à hauteur de taille, brume qui monte entre les rangs, contre-jour chaud, feuilles qui bruissent et chant lointain d’oiseaux. Lumière naturelle, caméra à l’épaule, rendu pellicule 35 mm. Remarquez qu’aucun visage n’est demandé. Les mains, les paysages et les objets maintiennent le format sans visage, et évitent aussi le problème courant d’une personne dont le visage change d’une scène à l’autre.

Appeler l’API Veo 3 depuis n8n

C’est le cœur du workflow, et son comportement diffère d’un appel API classique.

Configurer le nœud HTTP Request

Veo est exposé via l’API Gemini de Google sous forme d’opération de longue durée. Votre première requête ne renvoie pas de vidéo. Elle renvoie un nom d’opération que vous vérifierez plus tard. Configurez le nœud ainsi :

  • Méthode : POST
  • URL : https://generativelanguage.googleapis.com/v1beta/models/veo-3.0-generate-001:predictLongRunning
  • Authentification : un identifiant Header Auth stocké dans le coffre d’identifiants de n8n, jamais collé dans le nœud lui-même
  • Type de corps : JSON

💡 Astuce : Les identifiants des modèles changent entre les versions preview et stables. Vérifiez l’identifiant exact dans la documentation Veo actuelle de Google avant de publier le workflow.

Envoyez un corps de requête structuré comme suit :

{
  "instances": [
    { "prompt": {{ JSON.stringify($json.veoPrompt) }} }
  ],
  "parameters": {
    "aspectRatio": "9:16",
    "resolution": "720p",
    "negativePrompt": "text overlay, watermark, logo, subtitles"
  }
}

Encadrer le prompt avec JSON.stringify empêche un guillemet égaré dans une scène de casser la requête. Les clips sortent à huit secondes sur le point d’accès de Google, et le 1080p est lié au format horizontal, donc vérifiez quelle résolution votre format choisi prend en charge avant de vous engager sur un format vertical.

Interroger avec Wait et IF

La réponse contient un champ name. Stockez-le, puis construisez une petite boucle :

  1. Un nœud Wait marque une pause de 60 secondes.
  2. Un nœud HTTP Request envoie un GET vers https://generativelanguage.googleapis.com/v1beta/ suivi du nom stocké.
  3. Un nœud IF vérifie si done est vrai.
  4. Si c’est faux, le flux revient à un Wait plus court de 20 secondes. Si c’est vrai, le flux continue.

Sur la page PicassoIA de Veo 3, les rendus d’exemple se terminent en environ 68 à 145 secondes. Considérez cela comme une estimation de départ pour vos propres délais. Avec une attente initiale de 60 secondes et des interrogations toutes les 20 secondes, la plupart des rendus aboutissent en quatre ou cinq vérifications.

Écran d’un développeur affichant une réponse JSON d’une requête de génération vidéo

Ajoutez un compteur dans la boucle. Un nœud Code incrémente un numéro de tentative, et un second nœud IF arrête l’exécution après quinze vérifications. Sans ce plafond, un rendu bloqué peut tourner indéfiniment et saturer votre historique d’exécution.

Télécharger avant que le fichier ne disparaisse

Quand done devient vrai, l’adresse de la vidéo se trouve dans la réponse sous generateVideoResponse.generatedSamples. Ajoutez un nœud HTTP Request de plus, réglez le format de réponse sur File, envoyez le même identifiant et capturez les données binaires. Google ne conserve les fichiers générés que pendant une courte période, donc transférez le MP4 vers votre propre stockage (S3, R2 ou Drive) dans le nœud suivant. Ne stockez jamais le lien Google dans votre feuille en supposant qu’il fonctionnera encore la semaine prochaine.

Sablier rouge sur un bureau en bois clair, illustrant l’attente pendant la fin d’un rendu

Ajouter la voix et assembler la vidéo

Quand le son natif suffit

Testez une scène avec la piste intégrée avant d’ajouter quoi que ce soit. Si l’ambiance sonore convient et qu’aucune réplique parlée n’est nécessaire, supprimez entièrement la branche voix. Chaque branche retirée est un point de défaillance de moins pendant la nuit.

Ajouter un narrateur avec la synthèse vocale

Pour les formats narrés, envoyez le script à un modèle de synthèse vocale. ElevenLabs v3 gère bien les lectures expressives, Speech 2.8 HD de MiniMax offre une narration de studio propre, et Gemini 3.1 Flash TTS est le choix quand vous avez besoin de nombreuses langues. Chacun renvoie un fichier audio que vous pouvez enregistrer à côté des clips.

💡 Astuce : Ajoutez « pas de dialogue » au prompt Veo lorsque vous prévoyez de poser un narrateur par-dessus, pour que les voix propres au clip ne concurrencent jamais la vôtre.

Microphone à condensateur avec filtre anti-pop dans un petit studio de voix off à domicile

Assembler les scènes

La jonction des clips relève de FFmpeg dans un nœud Execute Command. Une commande de base lit une liste de scènes, superpose la narration et écrit un seul fichier :

ffmpeg -f concat -safe 0 -i scenes.txt -i narration.mp3 \
  -map 0:v -map 1:a -c:v libx264 -c:a aac -shortest episode.mp4

Voici le piège. Le nœud Execute Command ne fonctionne que sur n8n auto-hébergé. Sur n8n Cloud, envoyez plutôt les URL des clips à un service de rendu externe via un nœud HTTP Request. Dans les deux cas, le résultat est un MP4 par épisode, prêt pour l’étape d’import.

Monteur vidéo à un bureau à deux écrans travaillant sur une timeline multipiste de courts clips

Publier et suivre les coûts

Importer sur Shorts, Reels et TikTok

n8n intègre un nœud YouTube qui importe un fichier binaire avec un titre, une description et un statut de confidentialité. Pour les autres plateformes, appelez l’API de publication officielle de chacune via un nœud HTTP Request, ou utilisez un service de planification qui propose un webhook. Réglez la confidentialité sur privé pour les premières exécutions et vérifiez chaque vidéo à la main jusqu’à ce que vous fassiez confiance au résultat.

Mains tenant un smartphone qui lit une courte vidéo verticale à une table de café ensoleillée

Consigner chaque exécution dans la feuille

Reportez dans la feuille le statut, l’URL finale de la vidéo, le nombre de tentatives de rendu, le nombre de scènes et le coût estimé. Google facture Veo à la seconde de vidéo générée, et les tarifs ont changé plus d’une fois depuis le lancement ; stockez donc le prix par seconde dans une variable n8n ou dans une cellule de la feuille, plutôt que de le coder en dur dans six nœuds. Avec huit secondes par scène et cinq scènes, un seul épisode représente 40 secondes facturées avant même de compter une nouvelle tentative.

Des règles de nouvelle tentative qui protègent votre budget

Les échecs sont normaux avec la vidéo générative, donc définissez votre politique à l’avance :

  • Relancez un rendu échoué une fois avec le même prompt
  • Après un second échec, demandez au LLM de réécrire le prompt, puis tentez une dernière fois
  • Après cela, marquez la ligne « à vérifier » et arrêtez
  • Ajoutez un workflow Error Trigger qui vous prévient par e-mail ou dans votre messagerie
  • Limitez le nombre d’exécutions quotidiennes pour qu’un bug de boucle ne vide pas votre solde

Journal d’exécution imprimé avec des lignes en échec entourées au stylo rouge, à côté d’une calculatrice et de factures

Tester les prompts avec Veo 3 sur PicassoIA

Avant de dépenser de l’argent en API, prototypez chaque prompt de scène à la main. Veo 3 sur PicassoIA accepte un prompt, une résolution, un format, une image de départ facultative, un prompt négatif et un seed. Voici la routine :

  1. Ouvrez la page Veo 3 et connectez-vous.
  2. Collez un prompt de scène écrit dans le même ordre que votre nœud Code.
  3. Réglez la résolution sur 720p pour les tests et passez en 1080p uniquement pour le rendu final.
  4. Choisissez 9:16 pour les shorts verticaux ou 16:9 pour l’horizontal.
  5. Importez éventuellement une image de départ. Les cadres idéaux font 1280x720.
  6. Ajoutez un prompt négatif comme « texte, filigrane, logo ».
  7. Une fois un rendu satisfaisant, figez le seed pour que les relances le reproduisent.
  8. Générez et patientez. Les rendus d’exemple de la page ont pris d’une à deux minutes et demie.

D’autres modèles vidéo valent la peine d’être testés avec le même prompt :

ModèleIdéal pour
Veo 3 FastDes brouillons plus rapides du même rendu
Veo 3.1La nouvelle génération jusqu’à 1080p
Veo 3.1 FastLa rapidité avec le modèle plus récent
Veo 3.1 LiteDes tests moins coûteux
Seedance 2.5 LiteVidéo avec audio, jusqu’à 10 secondes
PicassoIA VideoTexte ou image vers vidéo au même endroit

💡 Astuce : PicassoIA propose aussi une API pour développeurs à https://api.picassoia.com/v1 avec des points d’accès de type Replicate : un POST vers /v1/models/{owner}/{name}/predictions, puis un GET sur /v1/predictions/{id} jusqu’à la fin de la tâche. Au moment de la rédaction, elle expose PicassoIA Video et Seedance 2.5 Lite pour la vidéo et autorise cinq prédictions simultanées par compte. Veo 3 ne figure pas dans cette liste, c’est pourquoi le workflow ci-dessus vise le point d’accès de Google. Le schéma création puis interrogation est identique, donc la même boucle Wait et IF fonctionne pour les deux.

Créez votre premier clip aujourd’hui

Vous n’avez pas besoin du pipeline complet de dix nœuds pour savoir si cette idée fonctionne dans votre niche. Choisissez un sujet, rédigez cinq prompts de scène dans l’ordre de la routine ci-dessus, et lancez-les sur Picasso IA. Comparez un brouillon en 720p avec un rendu en 1080p, essayez une version verticale et une version horizontale, et notez quels prompts tiennent sur l’ensemble des scènes.

Lorsque vous aurez trois prompts en lesquels vous avez confiance, copiez-les dans votre nœud Code et laissez n8n prendre en charge le travail répétitif. Commencez petit, consignez tout et ajoutez une branche à la fois. Ouvrez Picasso IA, lancez votre première scène et voyez jusqu’où un bon prompt peut porter une chaîne sans visage.

Partager cet article

Choisissez votre langue