Configurer HeyGen MCP avec Claude : serveur MCP distant pour vidéos d’avatars

Ajoutez le serveur MCP distant de HeyGen à Claude en cinq minutes environ : collez une seule URL, approuvez la connexion OAuth, et laissez Claude écrire, générer et traduire des vidéos d’avatars à partir d’un seul prompt. Comprend les commandes Claude Code, des modèles de prompts, des informations sur les crédits et les limites de débit, un tableau de dépannage et un tutoriel pour utiliser Avatar V sur PicassoIA.

Configurer HeyGen MCP avec Claude : serveur MCP distant pour vidéos d’avatars
Cristian Da Conceicao
Fondateur de Picasso IA

Vous tapez une phrase dans Claude, vous allez prendre un café, et vous revenez avec une vidéo d’avatar terminée et un lien à envoyer à un client. C’est la promesse du serveur MCP distant de HeyGen, et la configuration prend environ cinq minutes, car il n’y a rien à installer. Pas de serveur local, pas de clé d’API collée dans un fichier de configuration, pas de facturation séparée. Vous vous connectez une fois via OAuth, et Claude peut travailler dans votre compte HeyGen.

Ce guide vous accompagne dans la configuration de HeyGen MCP avec Claude, pour les trois endroits où l’on utilise réellement Claude : l’application web, l’application de bureau et Claude Code. Vous obtenez le point de terminaison exact, la commande de terminal exacte, des prompts qui produisent des vidéos utilisables, les informations sur les crédits et les limites de débit issues de la documentation de HeyGen, ainsi qu’une liste de corrections pour les erreurs qui posent souci. Vers la fin, un court tutoriel explique comment utiliser directement le moteur Avatar V de HeyGen sur PicassoIA, pour les fois où vous voulez un présentateur parlant sans ouvrir d’assistant.

💡 Réponse rapide : le point de terminaison est https://mcp.heygen.com/mcp/v1/. Ajoutez-le à Claude comme connecteur personnalisé (ou lancez la commande claude mcp add dans Claude Code), approuvez la connexion OAuth, puis demandez une vidéo.

Ce que fait réellement le MCP distant

MCP signifie Model Context Protocol, le standard ouvert qui permet à un assistant d’IA d’appeler des outils dans d’autres applications. HeyGen fait tourner son serveur sur sa propre infrastructure, de sorte que Claude communique avec un point de terminaison hébergé plutôt qu’avec un programme installé sur votre ordinateur. Selon la documentation, l’usage est décompté des crédits déjà inclus dans votre forfait HeyGen, et le connecteur fonctionne avec tous les forfaits.

Vue à plat d’un bureau en bois avec un ordinateur portable ouvert, des croquis dans un carnet et une tasse d’espresso

Une fois connecté, Claude peut gérer de vrais travaux de production depuis une fenêtre de discussion :

  • Écrire et générer à partir d’un seul prompt. Le Video Agent de HeyGen choisit l’avatar, rédige le script, construit les scènes et génère le résultat.
  • Diriger un avatar. Un avatar HeyGen, ou une image que vous fournissez, prononce votre script exact avec une synchronisation labiale.
  • Traduire des vidéos finies dans d’autres langues tout en gardant les mouvements de bouche synchronisés.
  • Gérer la bibliothèque. Lister, récupérer et supprimer des vidéos, ainsi que travailler avec les modèles, les kits de marque et les dossiers.
  • Gérer les voix. Parcourir un catalogue de plus de 500 voix, en concevoir une nouvelle à partir d’une description textuelle, ou en cloner une à partir d’un fichier audio.

HeyGen annonce plus de 48 fonctions sur le serveur et indique la prise en charge de Claude (web, bureau et Code), Cursor, Gemini CLI, Codex CLI, Lovable, Manus, Superhuman et les agents basés sur OpenAI, ainsi que tout client MCP personnalisé.

Hébergé, pas installé

Les anciens serveurs HeyGen de la communauté fonctionnaient sur votre propre machine et nécessitaient une clé d’API stockée dans une variable d’environnement. Le serveur distant supprime ces deux contraintes. L’authentification se fait par OAuth, donc aucun secret ne se trouve dans un fichier de configuration, et HeyGen maintient les outils de son côté. Vous collez une URL et approuvez un seul écran de connexion.

Choisir votre mode de configuration

HeyGen documente trois façons de permettre à un agent de travailler avec la plateforme. Dans tous les cas, les crédits proviennent de votre forfait.

ModeComment vous vous connectezIdéal pourSource des coûts
MCP distantOAuth, une seule connexionTravail piloté par chat dans ClaudeCrédits du forfait existant
CLI HeyGenClé d’API dans une variable d’environnementScripts et agents sans interfaceCrédits du forfait existant
API bruteClé d’API dans une variable d’environnementBackends personnalisés, POST /v3/video-agents puis interrogation de GET /v3/videos/{video_id}Crédits du forfait existant

💡 Le conseil de HeyGen pour les agents est clair : essayez d’abord le serveur MCP, passez à la CLI en secours, et utilisez les appels d’API brute en dernier recours. Ne collez jamais une clé d’API dans une fenêtre de discussion.

Connecter HeyGen à Claude

Claude web et bureau

Les libellés des menus changent légèrement selon les versions de l’application, mais le parcours reste toujours le même.

  1. Ouvrez Claude et allez dans Paramètres, puis Connecteurs.
  2. Recherchez HeyGen. S’il apparaît, cliquez sur Connecter. Sinon, choisissez Ajouter un connecteur personnalisé.
  3. Nommez-le HeyGen et collez https://mcp.heygen.com/mcp/v1/.
  4. Cliquez sur Connecter. Un onglet de navigateur s’ouvre sur l’écran OAuth de HeyGen.
  5. Connectez-vous au compte HeyGen dont vous voulez utiliser les crédits, puis approuvez l’accès.
  6. Ouvrez une nouvelle discussion et vérifiez que le connecteur HeyGen est activé pour elle.

Homme en pull bleu marine travaillant debout dans un bureau lumineux à domicile

L’étape OAuth est la plus importante. Les crédits appartiennent au compte que vous approuvez, donc vérifiez bien que vous êtes connecté au bon espace de travail avant de valider.

Mains d’une femme tenant un smartphone à côté d’un ordinateur portable ouvert sur une table de cuisine

💡 Vous utilisez un agent personnalisé sur son propre domaine ? HeyGen demande de soumettre ce domaine via son formulaire d’intégration afin de le mettre sur liste blanche.

Claude Code en une commande

Lancez cette commande une fois dans votre terminal :

claude mcp add --transport http heygen https://mcp.heygen.com/mcp/v1/

Ouvrez ensuite Claude Code, tapez /mcp, choisissez heygen, et terminez la connexion OAuth dans votre navigateur. Ajoutez --scope user si vous voulez que le serveur soit disponible dans tous les projets et non seulement dans le projet actuel.

Les équipes qui partagent un dépôt peuvent plutôt enregistrer une configuration de projet :

{
  "mcpServers": {
    "heygen": {
      "type": "http",
      "url": "https://mcp.heygen.com/mcp/v1/"
    }
  }
}

Développeur barbu tapant sur son clavier dans une pièce calme au crépuscule, sous une lampe de bureau chaleureuse

Le fichier ne contient aucun identifiant, donc chaque membre de l’équipe s’authentifie de son côté, et les crédits restent liés à la personne qui a demandé la vidéo.

Vérifier la connexion

Demandez à Claude : « Appelez l’outil get_current_user de HeyGen et dites-moi quel compte est connecté. » La documentation de HeyGen utilise cet appel comme contrôle de bon fonctionnement. Dans Claude Code, l’outil apparaît sous le nom mcp__heygen__get_current_user. Si le nom du compte correspond à celui attendu, vous êtes prêt. Si Claude indique qu’il n’a aucun outil HeyGen, passez au tableau de dépannage plus bas.

Créer votre première vidéo d’avatar

Le rendu est asynchrone. HeyGen indique que les vidéos sont généralement prêtes en 1 à 5 minutes, et Claude doit appeler un outil de statut pour savoir quand. Indiquez-le dans votre prompt, sinon l’assistant pourrait vous donner un identifiant et s’arrêter là.

Des prompts qui fonctionnent

Le Video Agent est le chemin le plus court entre l’idée et la vidéo. Il propose deux modes : generate s’exécute en une seule fois, tandis que chat vous permet d’affiner sur plusieurs échanges. Un bon prompt précise six éléments :

  • Objectif : ce que le spectateur doit faire après avoir regardé la vidéo
  • Public : qui regarde la vidéo
  • Durée : 15, 30 ou 60 secondes
  • Ton : calme, enthousiaste ou formel
  • Format : 16:9 panoramique ou vertical 9:16
  • Style : un choix dans la liste des styles

« Utilisez HeyGen Video Agent pour créer une vidéo explicative de 30 secondes sur un bureau assis-debout. Présentatrice féminine et amicale, ton calme, format vertical 9:16, style bureau épuré. Vérifiez le statut jusqu’à ce que la vidéo soit prête, puis donnez-moi le lien. »

Avant la génération, demandez à Claude d’appeler list_video_agent_styles. Les styles sont des modèles sélectionnés qui contrôlent la composition des scènes, le rythme et l’apparence, et vous pouvez les filtrer par étiquettes comme « cinematic » ou « retro-tech ».

Petit studio vidéo avec une caméra sur trépied et deux lumières softbox

Diriger des vidéos d’avatars

Lorsque la formulation doit être exacte, comme une liste de prix ou une mention de conformité, passez outre l’agent et utilisez create_video. Un avatar choisi ou une image fixe prononce votre script ou votre audio avec une synchronisation labiale. Vous choisissez Avatar III, Avatar IV ou Avatar V comme moteur, Avatar IV étant la valeur par défaut. Avatar V ne fonctionne qu’avec les avatars qui le prennent en charge.

« Utilisez create_video avec mon avatar de marque et ce script exact. Moteur Avatar V, 1080p, 16:9. Renvoyez le video_url lorsqu’il est prêt. »

L’outil get_video renvoie le statut, video_url, thumbnail_url, la durée et les détails d’éventuelles erreurs. C’est donc celui à appeler lorsqu’une génération semble bloquée.

Femme souriante en blazer crème s’adressant directement à la caméra

Traduire avec synchronisation labiale

La traduction s’appuie sur trois outils : list_video_translate_languages pour les codes valides, create_video_translate pour lancer la tâche, et get_video_translate_caption pour récupérer ensuite les sous-titres. HeyGen propose des modes rapide et précis, de sorte qu’un brouillon rapide et une version finale soignée peuvent provenir de la même vidéo source. PicassoIA propose la même famille sous le nom Video Translate pour le doublage dans plus de 150 langues, ainsi que Lipsync Precision et Lipsync Speed.

Les traductions par lot acceptent jusqu’à 100 éléments par requête, ce qui permet de localiser une bibliothèque de formation complète en un après-midi.

Vue de dessus de cinq collègues autour d’une table ronde avec des ordinateurs portables et une carte papier

Ce que proposent les outils et leur coût

Groupes d’outils en un coup d’œil

GroupeCe qu’il faitExemple de requête
Video AgentVidéos en une seule fois ou sur plusieurs échanges, liste de styles, arrêt d’une exécution« Créez une vidéo d’intégration de 45 secondes »
Création de vidéosVidéos d’avatars avec synchronisation labiale, liste, récupération, suppression« Génère ce script avec mon avatar »
ModèlesCréer, mettre à jour, remplir des variables, générer à partir d’un modèle« Remplis mon modèle de webinaire avec ce titre »
VoixPlus de 500 voix du catalogue, conception de voix, clonage, parole avec horodatage« Conçois une voix chaude et grave pour la narration »
LotsJusqu’à 100 éléments pour les vidéos, traductions, synchronisations labiales et imports« Traduis ces 40 vidéos en espagnol »
ExtrasDécoupage par IA, recherche audio, création d’avatars, kits de marque, glossaires, suppression des mots parasites, dossiers« Découpe trois courts extraits de ce webinaire »

Crédits, délais et limites

  • Crédits : aucun frais supplémentaire en plus de votre forfait. L’usage est décompté de vos crédits, et les clones de voix professionnels coûtent 1 crédit par génération de voix.
  • Suppression des mots parasites : 0,30 $ par minute source, avec un minimum d’une minute.
  • Délais : la plupart des générations se terminent en 1 à 5 minutes. Interrogez le statut avec un backoff exponentiel et respectez tout en-tête Retry-After.
  • Limite de débit : 30 requêtes par minute et par membre de l’espace de travail sur le point de terminaison de synthèse vocale professionnelle.
  • Taille des lots : 100 éléments par requête, tous types de lots confondus.
  • Vidéos de référence : jusqu’à 12 en mode vidéo de référence, avec des formats allant de 1:4 à 4:1.
  • Modèles : la suppression d’un modèle est une suppression douce, et les vidéos déjà générées restent intactes.

Main écrivant une liste de budget dans un carnet à côté d’une petite calculatrice

Corriger les problèmes courants

Symptômes et solutions

SymptômeCause probableSolution
L’onglet OAuth s’ouvre mais Claude affiche toujours « déconnecté »Fenêtre bloquée ou mauvais compteAutorisez les fenêtres surgissantes, reconnectez-vous, puis lancez get_current_user
Outils HeyGen absents dans une discussionConnecteur non activé pour cette conversationActivez-le dans le menu des outils de la discussion
HTTP 409 sur un document de l’éditeur vidéoLe document est encore en préparationAttendez un moment puis réessayez
HTTP 403 sur une voix ElevenLabsLa politique du fournisseur de l’espace de travail bloque ce moteurChoisissez un autre moteur de voix ou demandez à l’administrateur de l’espace de travail
HTTP 404 sur un avatar ou une voixL’élément a été suppriméRelancez la liste et choisissez un nouvel identifiant
HTTP 429Limite de débit atteinteRalentissez et respectez Retry-After
Claude annonce un succès mais ne donne aucun lienLe statut n’a jamais été interrogéDemandez-lui d’appeler get_video et d’afficher video_url

Habitudes qui économisent des crédits

  • Demandez à Claude de reformuler le script, l’avatar et le format avant la génération, puis répondez « go ».
  • Testez un extrait de 10 à 15 secondes avant un long.
  • Corrigez d’abord le script. Régénérer à cause d’une coquille gaspille des crédits pour rien.
  • Lancez un lot seulement après l’approbation d’un échantillon.

Jeune homme penché vers un ordinateur portable dans la lumière chaude de la fin d’après-midi

Où se situe PicassoIA

Les moteurs de HeyGen ne sont pas enfermés dans l’application HeyGen. PicassoIA en propose plusieurs à côté d’autres modèles de vidéos parlantes, ce qui est pratique pour des tests A/B sur le même script.

ModèleCe qu’il faitLien
Avatar VAvatar parlant à partir d’un script saisi, jusqu’en 4KOuvrir Avatar V
Avatar IVAvatar parlant, moteur précédent de HeyGenOuvrir Avatar IV
Video AgentVidéo soignée à partir d’un prompt texteOuvrir Video Agent
Video TranslateDoubler une vidéo dans plus de 150 languesOuvrir Video Translate
Omni Human 1.5Vidéo à synchronisation labiale réaliste à partir d’une seule photoOuvrir Omni Human 1.5
P Video AvatarVidéos d’avatars parlants de PrunaOuvrir P Video Avatar
Kling Avatar v2Animer un visage pour en faire une vidéo parlanteOuvrir Kling Avatar v2

Les scripts comptent autant que les rendus. Les modèles de langage sur PicassoIA, comme Claude Sonnet 5, Claude Fable 5 et Claude Opus 4.7, peuvent rédiger et resserrer un script avant qu’il n’atteigne un outil d’avatar. Vous obtenez ainsi une répartition claire : écrire avec un modèle de langage, générer avec un modèle d’avatar, et garder chaque étape facile à reproduire.

Comment utiliser Avatar V sur PicassoIA

La voie MCP convient à ceux qui vivent dans Claude. Si vous préférez remplir un formulaire, Avatar V sur PicassoIA transforme un script saisi en vidéo de présentateur parlant, sans caméra, studio ni acteurs.

Étape par étape

  1. Ouvrez la page Avatar V sur PicassoIA.
  2. Collez votre script dans input_text. La limite est de moins de 5 000 caractères par exécution.
  3. Ajoutez un voice_id et un avatar_id. Les deux sont obligatoires, et l’avatar doit prendre en charge Avatar V. Ces identifiants proviennent des catalogues de HeyGen, et le connecteur distant peut lister les voix, donc Claude est un moyen pratique de présélectionner les options.
  4. Choisissez l’aspect_ratio : 16:9 pour le grand format ou 9:16 pour le vertical.
  5. Sélectionnez une resolution : 720p, 1080p (la valeur par défaut) ou 4k.
  6. Réglez voice_speed entre 0,5 et 1,5, et activez caption si vous voulez des sous-titres incrustés.
  7. Lancez la génération et téléchargez le fichier final. L’exemple présenté dans la galerie du modèle a pris environ 137 secondes en 1080p.

Réglages qui valent la peine d’être ajustés

RéglageOptionsPar défautConseil
resolution720p, 1080p, 4k1080pTestez en 720p, livrez en 1080p ou 4k
aspect_ratio16:9, 9:1616:9Utilisez 9:16 pour les courts formats sur les réseaux sociaux
voice_speed0,5 à 1,51Ralentissez à 0,9 pour les scripts techniques denses
captionactivé ou désactivédésactivéActivez-le pour les spectateurs qui regardent sans son
titletexte librevideNommez chaque version pour que vos tests restent faciles à trier

💡 Deux habitudes d’écriture de script qui rapportent : gardez des phrases assez courtes pour être dites d’un seul souffle, et écrivez les nombres et les sigles de la façon dont vous voulez qu’ils soient prononcés.

Essayez-le sur PicassoIA dès aujourd’hui

Vous disposez désormais de deux voies vers le même résultat. Connectez HeyGen à Claude lorsque vous voulez que la création vidéo se fasse dans une conversation, une seule phrase déclenchant une génération. Utilisez PicassoIA lorsque vous préférez choisir vous-même les réglages et comparer les moteurs côte à côte.

Choisissez un script court que vous possédez déjà, par exemple une présentation de produit ou une étape de formation, et passez-le dans Avatar V en 720p. Envoyez ensuite la même vidéo dans Video Translate pour l’entendre dans une seconde langue. Dix minutes d’expérimentation sur PicassoIA vous en apprendront plus sur votre propre flux de travail que n’importe quelle fiche technique. Ouvrez la plateforme, essayez un modèle et créez dès aujourd’hui votre première vidéo d’avatar.

Partager cet article

Choisissez votre langue