Skills, MCP et plugins dans Claude : différences et usage des tokens

Les skills se chargent par étapes, à environ 100 tokens chacun tant qu’ils ne sont pas utilisés. Les serveurs MCP connectent Claude à des outils en direct et peuvent saturer la fenêtre de contexte avec des définitions et des résultats. Les plugins regroupent les deux en une seule installation. Découvrez ce que chacun charge, quand il se charge et ce qu’il coûte à chaque tour.

Skills, MCP et plugins dans Claude : différences et usage des tokens
Cristian Da Conceicao
Fondateur de Picasso IA

Toute configuration de Claude finit par buter sur le même mur : la fenêtre de contexte se remplit de choses que vous avez installées et utilisez rarement. La cause tient le plus souvent à une confusion entre trois fonctionnalités aux noms proches. Skills, serveurs MCP et plugins étendent tous ce que Claude peut faire, mais chacun fonctionne différemment, se charge à un moment différent et consomme des tokens d’une autre manière. Choisissez la mauvaise, et vous le payez à chaque tour. Choisissez la bonne, et Claude gagne une nouvelle capacité pour presque rien.

Cet article présente ce que représente chacun, quand il entre dans la fenêtre de contexte, ce qu’il coûte et comment choisir entre eux. Les chiffres proviennent de la documentation d’Anthropic, et tout ce qui est estimé est signalé comme tel.

La réponse courte

Voici la comparaison complète dans un seul tableau. Les sections suivantes expliquent chaque ligne.

SkillServeur MCPPlugin
Ce que c’estUn dossier contenant un fichier SKILL.md, plus des scripts et des fichiers de référence facultatifsUn processus ou un service distant qui expose des outils à ClaudeUn paquet qui regroupe des skills, des subagents, des hooks et des serveurs MCP
Son rôleApprend à Claude comment faire quelque choseDonne à Claude accès à quelque choseDistribue une configuration prête à l’emploi
Toujours dans le contexteNom et description, environ 100 tokens par skillPeu avec la recherche d’outils, sinon chaque définition d’outilNom et description de chaque skill, agent et commande que Claude peut invoquer lui-même
Chargé à l’utilisationLe corps de SKILL.md (moins de 5k tokens), puis seulement les fichiers qu’il litL’appel d’outil et son résultatCe que chargent ses éléments inclus
Où il fonctionneClaude Code, claude.ai, API ClaudeClaude Code, ainsi que les connecteurs sur claude.aiClaude Code, ainsi que claude.ai et Cowork (ensemble de composants différent)

Un randonneur remplissant un sac à dos en toile à côté d’une balance à bagages dans un chalet en bois

Pensez à la fenêtre de contexte comme à un sac à dos. Tout ce que vous y mettez est porté à chaque tour, que vous l’utilisiez ou non. Les skills sont pliés à plat et ne pèsent presque rien tant que vous ne les ouvrez pas. Les serveurs MCP peuvent être lourds, selon le nombre d’outils qu’ils embarquent. Les plugins sont une boîte qui contient les deux, si bien que leur poids correspond à la somme de ce qu’elle renferme.

💡 Règle empirique : un skill est une recette, un serveur MCP est le fournisseur qui livre les ingrédients, et un plugin est la boîte de kit repas qui livre les deux ensemble.

Comment fonctionnent les skills

Un skill est le moyen le moins coûteux de modifier le comportement de Claude. C’est un répertoire qui contient des instructions, du code facultatif et de la documentation de référence, rédigés comme si vous briefiez un nouveau collègue. Claude ne le lit que lorsque la tâche l’exige. Contrairement à un prompt, qui vit dans une seule conversation, un skill réside sur le système de fichiers et reste disponible à chaque fois.

Trois niveaux de chargement

Anthropic appelle ce principe la divulgation progressive. Le contenu arrive par étapes au lieu d’un bloc :

NiveauMoment du chargementCoût en tokensCe qui se charge
1. MétadonnéesToujours, au démarrageEnviron 100 tokens par skillname et description du frontmatter
2. InstructionsLorsque le skill se déclencheMoins de 5k tokensLe corps de SKILL.md
3. RessourcesSeulement en cas de besoinZéro tant qu’elles ne sont pas consultéesFichiers de référence, modèles et scripts

Une main sortant à mi-hauteur une seule fiche d’un tiroir de catalogue en chêne d’une bibliothèque

Le catalogue de fiches de la photo est le bon modèle mental. Des centaines de fiches sont rangées dans le tiroir, mais vous n’en sortez que celle dont vous avez besoin. Un skill peut contenir des dizaines de fichiers de référence, et si la tâche ne touche que le schéma des ventes, c’est ce seul fichier qui se charge. Les autres ne coûtent rien.

Les scripts bénéficient d’un traitement encore meilleur. Lorsque Claude exécute validate_form.py, le code n’entre jamais dans la fenêtre de contexte. Seule la sortie y entre, quelque chose comme « Validation passed ». Un script fourni coûte donc bien moins cher que de demander à Claude d’écrire à chaque fois un code équivalent.

À quoi ressemble un SKILL.md

Le fichier nécessite deux champs de frontmatter, placés entre deux lignes de trois tirets en haut du fichier. Voici les champs pour un skill de notes de version :

name: release-notes
description: Draft release notes from merged pull requests in our house style. Use when the user asks for a changelog, release notes or a version summary.

Sous le frontmatter vient le corps, du markdown simple que Claude lit lorsque le skill se déclenche :

Steps:
1. List merged pull requests since the last tag.
2. Group them under Added, Changed and Fixed.
3. Write one plain sentence per item, no marketing language.

For the exact tone rules, see STYLE.md.

Les limites sont strictes. Un name accepte 64 caractères, lettres minuscules, chiffres et tirets, et ne peut pas contenir les mots réservés « anthropic » ou « claude ». Une description accepte 1 024 caractères et doit indiquer à la fois ce que fait le skill et quand l’utiliser, car c’est cette phrase que Claude compare à votre demande.

Deux mains ouvrant un classeur à anneaux avec des intercalaires et des fiches d’instructions sur un établi

💡 Pourquoi la description compte deux fois : une description vague signifie que le skill ne se déclenche jamais. Une description trop longue consomme des tokens permanents à chaque tour. Rédigez-la comme un extrait de recherche : ce qu’il fait, quand l’utiliser, rien d’autre.

Où fonctionnent les skills

Le même format fonctionne sur trois surfaces, avec des règles différentes selon la surface :

  • Claude Code : déposez un dossier dans ~/.claude/skills/ pour un usage personnel ou dans .claude/skills/ pour un projet. Les skills ont le même accès réseau que n’importe quel programme de votre machine.
  • claude.ai : importez un fichier zip dans Paramètres, puis Fonctionnalités. Les skills personnalisés sont propres à chaque utilisateur et nécessitent l’exécution de code activée sur un forfait Pro, Max, Team ou Enterprise.
  • API Claude : référencez un skill_id dans le paramètre container, à côté de l’outil d’exécution de code. Les skills s’exécutent dans un bac à sable sans accès réseau ni installation de paquets à l’exécution, et ils sont partagés à l’échelle de l’espace de travail.

Un piège à noter : les skills personnalisés ne se synchronisent pas entre les surfaces. Un skill importé dans claude.ai n’est pas visible par l’API, et aucune des deux ne voit votre dossier Claude Code.

Comment fonctionne MCP

Le Model Context Protocol est un standard ouvert qui connecte Claude à des systèmes externes. Un serveur MCP expose des outils, et Claude les appelle : interroger une base de données, ouvrir un ticket, lire un fichier de design, piloter un navigateur. Là où un skill dit « voici comment nous faisons », MCP dit « voici le système, allez-y et agissez dessus ».

Les outils sont le produit

Une main branchant un câble tressé dans un panneau de brassage numéroté, dans un petit local réseau

Chaque outil arrive sous forme de définition : un nom, une description et un schéma JSON décrivant ses entrées. Claude lit ces définitions pour décider quel outil convient à la demande. Vous enregistrez un serveur avec une seule commande, par exemple :

claude mcp add --transport http stripe https://mcp.stripe.com

La portée choisie détermine qui y a accès. Locale (par défaut) ne se charge que dans le projet en cours et reste privée. Projet écrit un fichier .mcp.json à la racine du dépôt, afin que toute l’équipe le partage. Utilisateur rend le serveur disponible dans tous vos projets.

Pourquoi les définitions d’outils coûtent si cher

Une seule définition représente généralement quelques centaines de tokens une fois le schéma inclus. C’est une estimation, pas un chiffre documenté : mesurez donc votre propre configuration avec /context dans Claude Code. Un serveur de 40 outils à environ 400 tokens chacun ajouterait environ 16 000 tokens avant que vous n’ayez tapé un seul mot, si toutes les définitions étaient chargées d’emblée.

Les résultats coûtent aussi des tokens, et ils peuvent être énormes. Claude Code affiche un avertissement lorsqu’un résultat d’outil dépasse 10 000 tokens et plafonne la sortie à 25 000 tokens par défaut. Vous pouvez relever ce plafond avec MAX_MCP_OUTPUT_TOKENS. Les résultats textuels trop volumineux sont enregistrés dans un fichier, et Claude reçoit une référence au lieu du texte brut.

La recherche d’outils change la donne

Sur Claude Code v2.1.232 et versions ultérieures, la recherche d’outils MCP est activée par défaut. Au lieu de charger chaque outil au démarrage, Claude lance un appel ToolSearch pour trouver les outils dont une demande a besoin. Il devient ainsi peu coûteux de garder de nombreux serveurs connectés.

La recherche d’outils ne s’applique pas partout. Elle est désactivée avec un ANTHROPIC_BASE_URL personnalisé, lorsque ENABLE_TOOL_SEARCH=false est défini, et pour les modèles antérieurs à la génération Claude 4.5 sur Agent Platform de Google Cloud. Dans ces configurations, l’ancienne règle s’applique : chaque serveur connecté pèse sur chaque tour.

Comment fonctionnent les plugins

Un plugin n’ajoute aucun nouveau type de capacité. C’est un répertoire de composants que Claude Code installe et charge comme une seule unité, généralement avec un manifeste situé à .claude-plugin/plugin.json. Les composants peuvent être des skills, des subagents, des hooks, des serveurs MCP, ou un module de hooks qui dessine des panneaux et ajoute des commandes.

Un paquet, pas une fonctionnalité

Un artisan remplissant des compartiments étiquetés d’une boîte à outils en bois à côté d’un carton d’expédition fermé

Un skill intégré à un plugin fonctionne sous l’espace de noms du plugin. Un plugin nommé my-plugin avec un skill review vous donne /my-plugin:review, si bien que deux plugins peuvent livrer des skills du même nom sans conflit.

La plupart des plugins passent par une place de marché, c’est-à-dire un catalogue qui liste les plugins et indique où les récupérer. Lancez /plugin pour parcourir le catalogue, puis installez par nom, par exemple commit-commands@claude-plugins-official. Les portées d’installation reprennent celles de MCP : utilisateur pour tous les projets de votre machine, projet pour toute personne travaillant dans le dépôt, et locale pour vous seul, dans un seul dépôt.

Les skills, subagents, hooks et serveurs MCP fonctionnent aussi seuls. Faites appel à un plugin lorsque vous voulez transmettre plusieurs d’entre eux à vos coéquipiers en une seule commande, ou publier des versions numérotées. Une session cloud sur claude.ai/code ne charge pas les plugins de vos paramètres locaux, à prendre en compte si votre équipe travaille là-bas.

Ce que coûte un plugin activé

Un plugin activé fait partie de chaque session, et pas seulement de celles où vous l’utilisez. Pour chaque skill, agent et commande que Claude peut invoquer seul, le nom et la description restent dans le contexte à chaque tour. Ces tokens comptent dans votre consommation et laissent moins de place dans la fenêtre, même lorsque rien du plugin ne s’exécute. Le texte complet ne se charge qu’à l’utilisation, et ses serveurs MCP suivent les règles de recherche d’outils décrites plus haut.

Les effets de bord vont au-delà des tokens : ses serveurs MCP tournent à côté de chaque session, ses hooks se déclenchent sur leurs événements, et tout ce qu’il exécute, il l’exécute en votre nom. Dans la vue /plugin, les plugins de la place de marché officielle d’Anthropic affichent une estimation de Context cost avant l’installation, et l’onglet Installed liste les plugins marqués « Not used recently » que vous pouvez désactiver avec claude plugin disable.

Consommation de tokens côte à côte

Une balance en laiton avec un mince morceau de papier plus léger qu’une pile de registres en cuir

La base par tour

Voici ce que coûte chaque option au repos, comparé à son coût lorsqu’elle se déclenche :

Coût au repos, à chaque tourCoût à l’utilisationPire cas
SkillEnviron 100 tokens chacunMoins de 5k pour le corps, plus toute lecture de fichierUn corps proche du plafond de 5k qui se déclenche trop souvent
Serveur MCPListe d’outils via la recherche, ou toutes les définitions sans elleAppel d’outil et résultat, plafonnés à 25k par défautDe nombreux outils verbeux avec la recherche désactivée
PluginNom et description par élément invocableIdentique à ses élémentsDes dizaines de plugins activés et inutilisés

Un exemple rapide avec le chiffre documenté : 40 skills à environ 100 tokens chacun ajoutent environ 4 000 tokens. Un serveur MCP de 40 outils, à l’estimation de 400 tokens chacun, en ajoute environ 16 000 lorsque la recherche d’outils est désactivée. Même nombre, quatre fois le poids, et les skills rapportent davantage par token, car le contenu lourd reste sur le disque jusqu’à son utilisation.

D’où viennent les économies

  • Gardez SKILL.md léger. Déplacez les détails rarement nécessaires dans des fichiers de référence, afin que seul le bon se charge.
  • Fournissez des scripts, pas des extraits de code. Seule la sortie d’un script entre dans le contexte.
  • Réduisez les descriptions. Ce que fait le skill et quand l’utiliser, en une ou deux phrases.
  • Filtrez côté serveur. Renvoyez dix lignes, pas dix mille.
  • Désactivez les plugins inutilisés. Chaque plugin activé ajoute des descriptions à chaque tour.
  • Utilisez la portée projet pour MCP. Ne chargez un serveur que là où il est utile.

Lequel choisir

Deux collègues examinant un organigramme de décision imprimé, avec des notes adhésives sur une table de réunion

Partez de la tâche, pas du nom de la fonctionnalité :

SituationMeilleur choixPourquoi
Claude continue de se tromper sur votre formatSkillDes instructions, sans accès en direct nécessaire
Claude doit lire votre base de données ou votre système de ticketsMCPNécessite une connexion en direct
Votre équipe a besoin de la même configuration dès le premier jourPluginUne seule installation, mises à jour versionnées
Une tâche répétitive avec un scriptSkillLa sortie du script coûte presque rien
Plusieurs étapes mêlant règles et données en directLes troisChacun remplit un rôle précis

Choisir un skill pour les tâches répétitives

Si vous avez déjà collé deux fois les mêmes instructions, c’est un skill. Règles de ton de marque, liste de contrôle pour une pull request, mise en page de rapport, script de nettoyage de données. Rien ne quitte votre machine, rien ne tourne en permanence, et le coût au repos est d’environ 100 tokens.

Choisir MCP pour un accès en direct

Optez pour MCP lorsque les données se trouvent ailleurs et évoluent : un CRM, un outil de suivi de tickets, une base de données de production, une session de navigateur. Un skill ne peut pas récupérer seul des données fraîches. Il peut seulement indiquer à Claude comment traiter les données une fois qu’il les a.

Choisir un plugin pour partager une configuration

Lorsque trois coéquipiers vous demandent « comment avez-vous configuré ça ? », empaquetez-la. Un plugin réunit un skill, un agent et un serveur MCP en une seule installation. Pour une configuration purement personnelle, c’est une charge inutile, donc il vaut mieux s’en passer.

Utiliser les trois ensemble

Vue en plongée d’une boîte de kit repas ouverte avec une fiche recette, des légumes et des pots d’épices

Imaginons que votre équipe support veuille que Claude trie les tickets. Un serveur MCP pour le helpdesk donne à Claude accès aux tickets ouverts. Un skill contient la grille de tri, les règles d’escalade et le ton des réponses. Un plugin livre les deux à vingt coéquipiers d’une seule commande. En bref : MCP pour y accéder, un skill pour bien faire, un plugin pour le distribuer.

Les erreurs qui gaspillent des tokens

Un tiroir de cuisine débordant de câbles emmêlés et de chargeurs

  1. Envelopper une simple instruction dans un serveur MCP. Si aucun système en direct n’est impliqué, un skill fait le même travail pour une fraction du poids.
  2. Tout entasser dans SKILL.md. Au-delà de 5k, vous payez un texte dont Claude a rarement besoin. Découpez-le en fichiers de référence.
  3. Rédiger des descriptions de plusieurs paragraphes. La limite de 1 024 caractères est un plafond, pas un objectif.
  4. Laisser des serveurs inutilisés connectés avec la recherche d’outils désactivée. Le tiroir de câbles emmêlés de la photo, c’est votre fenêtre de contexte.
  5. Renvoyer des tableaux entiers depuis les outils. Une seule requête mal conçue peut atteindre le plafond de 25 000 tokens en un seul tour.
  6. Installer des plugins « au cas où ». Chacun ajoute des descriptions à chaque tour, même dans les sessions où il ne s’exécute jamais.
  7. Négliger la relecture du code tiers. Les skills et les plugins peuvent exécuter du code avec vos privilèges, lisez donc ce que vous installez.

💡 Audit rapide : lancez /context pour voir ce qui occupe votre fenêtre, puis /plugin pour désactiver tout ce qui figure sous « Not used recently ».

Essayez-le vous-même sur Picasso IA

Skills, MCP et plugins vivent dans les applications propres à Claude et dans Claude Code. Picasso IA héberge Claude sous forme de modèle de texte que vous pouvez utiliser directement dans le navigateur, pratique pour rédiger un SKILL.md, resserrer une description ou esquisser un schéma d’outil avant de vous engager.

Utiliser Claude Sonnet 5 sur PicassoIA

  1. Ouvrez Claude Sonnet 5 sur Picasso IA.
  2. Collez votre brouillon dans le champ Prompt, par exemple « Réécrivez cette description de skill en moins de 40 mots. »
  3. Réglez l’Effort. La valeur par défaut, low, désactive la réflexion pour obtenir la réponse la plus rapide et la moins chère. Montez à high ou max pour un problème complexe impliquant plusieurs fichiers.
  4. Ajoutez un System Prompt pour fixer le rôle une seule fois, par exemple « Vous examinez les fichiers SKILL.md pour repérer le gaspillage de tokens. »
  5. Joignez une Image si vous voulez qu’il lise une capture d’écran d’erreur ou un schéma, et utilisez Max Tokens (8 192 par défaut) pour plafonner la longueur de la réponse.
  6. Lancez-le, copiez le résultat et testez-le dans Claude Code.

La documentation a aussi besoin de visuels. Pour une bannière de README, un en-tête de tutoriel ou une illustration de schéma, essayez Seedream 4.5, GPT Image 2 ou Flux 2 Pro sur Picasso IA, et parcourez tous les autres modèles sur picassoia.com/en/all-models. Décrivez votre scène, choisissez un modèle et commencez dès aujourd’hui à créer vos propres images.

Partager cet article

Choisissez votre langue