Skills, MCP ou plugins no Claude: diferenças e uso de tokens

Skills carregam em etapas, com cerca de 100 tokens cada até serem usadas. Servidores MCP conectam o Claude a ferramentas ao vivo e podem encher a janela de contexto com definições e resultados. Plugins reúnem os dois em uma única instalação. Veja o que cada um carrega, quando carrega e quanto custa por turno.

Skills, MCP ou plugins no Claude: diferenças e uso de tokens
Cristian Da Conceicao
Fundador do Picasso IA

Toda configuração do Claude acaba batendo no mesmo muro: a janela de contexto enche com coisas que você instalou e quase não usa. A causa costuma ser a confusão entre três recursos com nomes parecidos. Skills, servidores MCP e plugins ampliam o que o Claude pode fazer, mas cada um funciona de um jeito, carrega em um momento diferente e consome tokens de outra forma. Escolher o errado custa caro em todo turno. Escolher o certo dá ao Claude uma nova habilidade por quase nada.

Este artigo explica o que é cada um, quando entra na janela de contexto, quanto custa e como escolher entre eles. Os números vêm da própria documentação da Anthropic, e tudo o que é estimativa está identificado como tal.

A resposta curta

Aqui está a comparação completa em uma tabela. As seções seguintes explicam cada linha.

SkillServidor MCPPlugin
O que éUma pasta com um arquivo SKILL.md, além de scripts e arquivos de referência opcionaisUm processo ou serviço remoto que expõe ferramentas ao ClaudeUm pacote que reúne skills, subagentes, hooks e servidores MCP
Para que serveEnsina o Claude como fazer algoDá ao Claude acesso a algoDistribui uma configuração pronta
Sempre no contextoNome e descrição, cerca de 100 tokens por skillPouco com a busca de ferramentas; sem ela, a definição de cada ferramentaNome e descrição de cada skill, agente e comando que o Claude pode invocar sozinho
Carregado quando usadoCorpo de SKILL.md (abaixo de 5 mil tokens), depois apenas os arquivos que ele lêA chamada da ferramenta e seu resultadoO que as partes incluídas carregarem
Onde rodaClaude Code, claude.ai, API do ClaudeClaude Code, além de conectores no claude.aiClaude Code, além de claude.ai e Cowork (conjunto de componentes diferente)

Um excursionista arrumando uma mochila de lona ao lado de uma balança de bagagem em uma cabana de madeira

Pense na janela de contexto como uma mochila. Tudo o que você coloca é carregado em cada turno, use ou não. As skills são dobradas e quase não pesam até você abri-las. Servidores MCP podem ser pesados, dependendo de quantas ferramentas trazem. Plugins são uma caixa que guarda os dois, então o peso é a soma do que há dentro.

💡 Regra prática: uma skill é uma receita, um servidor MCP é o fornecedor que entrega os ingredientes, e um plugin é a caixa de kit de refeição que envia os dois juntos.

Como as skills funcionam

Uma skill é a forma mais barata de mudar como o Claude se comporta. É um diretório com instruções, código opcional e material de referência, escrito como você explicaria a tarefa a um novo colega de equipe. O Claude lê a skill apenas quando a tarefa pede. Diferente de um prompt, que vive dentro de uma conversa, a skill fica no sistema de arquivos e está disponível sempre.

Três níveis de carregamento

A Anthropic chama esse desenho de divulgação progressiva. O conteúdo chega em etapas, e não tudo de uma vez:

NívelQuando carregaCusto em tokensO que carrega
1. MetadadosSempre, na inicializaçãoCerca de 100 tokens por skillname e description do frontmatter
2. InstruçõesQuando a skill é acionadaAbaixo de 5 mil tokensO corpo de SKILL.md
3. RecursosSó quando necessárioZero até ser acessadoArquivos de referência, modelos e scripts

Uma mão puxando, pela metade, uma ficha de uma gaveta de catálogo de carvalho de biblioteca

O catálogo de fichas da foto é o modelo mental certo. Centenas de fichas ficam na gaveta, mas você puxa só a que precisa. Uma skill pode ter dezenas de arquivos de referência, e se a tarefa só mexe no esquema de vendas, é esse único arquivo que carrega. O resto não custa nada.

Os scripts recebem um tratamento ainda melhor. Quando o Claude executa validate_form.py, o código nunca entra na janela de contexto. Só entra a saída, algo como "Validação aprovada". Isso torna um script incluído bem mais barato do que pedir ao Claude que escreva um código equivalente do zero a cada vez.

Como é um SKILL.md

O arquivo precisa de dois campos no frontmatter, que ficam entre duas linhas de três hífens no topo do arquivo. Aqui estão os campos de uma skill de notas de lançamento:

name: release-notes
description: Draft release notes from merged pull requests in our house style. Use when the user asks for a changelog, release notes or a version summary.

Abaixo do frontmatter vem o corpo, markdown simples que o Claude lê quando a skill é acionada:

Steps:
1. List merged pull requests since the last tag.
2. Group them under Added, Changed and Fixed.
3. Write one plain sentence per item, no marketing language.

For the exact tone rules, see STYLE.md.

Os limites são rígidos. Um name aceita 64 caracteres de letras minúsculas, números e hífens, e não pode incluir as palavras reservadas "anthropic" ou "claude". Uma description aceita 1.024 caracteres e precisa dizer tanto o que a skill faz quanto quando usá-la, porque essa frase é o que o Claude compara com o seu pedido.

Duas mãos abrindo um fichário de argolas com separadores de abas e folhas de instruções sobre uma bancada de trabalho

💡 Por que a descrição importa duas vezes: uma descrição vaga faz a skill nunca ser acionada. Uma descrição inchada consome tokens permanentes em todo turno. Escreva como um trecho de busca: o que faz, quando usar, nada além disso.

Onde as skills rodam

O mesmo formato funciona em três superfícies, com regras diferentes em cada uma:

  • Claude Code: coloque uma pasta em ~/.claude/skills/ para uso pessoal ou em .claude/skills/ para um projeto. As skills têm o mesmo acesso à rede que qualquer programa na sua máquina.
  • claude.ai: envie um zip em Configurações e depois em Recursos. As skills personalizadas são por usuário e exigem execução de código ativada em um plano Pro, Max, Team ou Enterprise.
  • API do Claude: referencie um skill_id no parâmetro container, ao lado da ferramenta de execução de código. As skills rodam em sandbox, sem acesso à rede e sem instalação de pacotes em tempo de execução, e são compartilhadas por todo o workspace.

Um detalhe importante: as skills personalizadas não sincronizam entre superfícies. Uma skill enviada ao claude.ai não fica visível para a API, e nenhuma das duas enxerga a sua pasta do Claude Code.

Como o MCP funciona

O Model Context Protocol é um padrão aberto para conectar o Claude a sistemas externos. Um servidor MCP expõe ferramentas, e o Claude as chama: consultar um banco de dados, abrir um chamado, ler um arquivo de design, controlar um navegador. Onde uma skill diz "é assim que fazemos", o MCP diz "aqui está o sistema, vá e mexa nele".

As ferramentas são o produto

Uma mão encaixando um cabo trançado em um painel de conexões numerado em um pequeno armário de rede

Cada ferramenta chega como uma definição: um nome, uma descrição e um JSON schema que descreve suas entradas. O Claude lê essas definições para decidir qual ferramenta serve ao pedido. Você registra um servidor com um comando, por exemplo:

claude mcp add --transport http stripe https://mcp.stripe.com

O escopo escolhido define quem tem acesso. Local (o padrão) carrega apenas no projeto atual e fica privado para você. Projeto grava um .mcp.json na raiz do repositório para que a equipe inteira compartilhe. Usuário deixa o servidor disponível em todos os seus projetos.

Por que as definições de ferramentas custam tanto

Uma única definição costuma ocupar algumas centenas de tokens quando o schema é incluído. Isso é uma estimativa, não um número documentado, então meça o seu próprio setup com /context no Claude Code. Um servidor com 40 ferramentas a cerca de 400 tokens cada acrescentaria cerca de 16.000 tokens antes de você digitar qualquer coisa, se todas as definições carregassem logo no início.

Os resultados também custam tokens, e podem ser enormes. O Claude Code avisa quando o resultado de uma ferramenta passa de 10.000 tokens e limita a saída a 25.000 tokens por padrão. Você pode aumentar esse limite com MAX_MCP_OUTPUT_TOKENS. Textos de resultado muito grandes são salvos em um arquivo, e o Claude recebe uma referência em vez do texto bruto.

A busca de ferramentas muda a conta

No Claude Code v2.1.232 e versões posteriores, a busca de ferramentas MCP vem ativada por padrão. Em vez de carregar todas as ferramentas na inicialização, o Claude executa uma chamada ToolSearch para encontrar as ferramentas de que um pedido precisa. Isso torna barato manter muitos servidores conectados.

A busca de ferramentas não se aplica em todos os casos. Ela fica desativada com um ANTHROPIC_BASE_URL personalizado, quando ENABLE_TOOL_SEARCH=false está definido, e para modelos anteriores à geração Claude 4.5 na Agent Platform do Google Cloud. Nesses setups vale a regra antiga: cada servidor conectado pesa em todo turno.

Como os plugins funcionam

Um plugin não adiciona um novo tipo de capacidade. É um diretório de componentes que o Claude Code instala e carrega como uma unidade só, geralmente com um manifesto em .claude-plugin/plugin.json. Os componentes podem ser skills, subagentes, hooks, servidores MCP ou um módulo de hooks que desenha painéis e adiciona comandos.

Um pacote, não um recurso

Um artesão preenchendo compartimentos identificados de uma caixa de ferramentas de madeira ao lado de uma caixa de envio fechada

Uma skill dentro de um plugin roda sob o namespace do plugin. Um plugin chamado my-plugin com uma skill review gera /my-plugin:review, então dois plugins podem trazer skills com o mesmo nome sem entrar em conflito.

A maioria dos plugins chega por um marketplace, que é um catálogo com a lista de plugins e de onde baixá-los. Execute /plugin para navegar e depois instale pelo nome, como commit-commands@claude-plugins-official. Os escopos de instalação espelham o MCP: usuário para todos os projetos da sua máquina, projeto para quem trabalha no repositório e local só para você, em um único repositório.

Skills, subagentes, hooks e servidores MCP funcionam sozinhos. Recorra a um plugin quando quiser entregar vários deles a colegas com um único comando, ou publicar versões controladas. Uma sessão na nuvem em claude.ai/code não carrega os plugins das suas configurações locais, então planeje isso se sua equipe trabalha por lá.

Quanto custa um plugin ativado

Um plugin ativado faz parte de toda sessão, não só daquelas em que você o usa. Para cada skill, agente e comando que o Claude pode invocar sozinho, o nome e a descrição ficam no contexto em todo turno. Esses tokens contam no seu uso e deixam menos espaço na janela, mesmo quando nada do plugin é executado. O texto completo só carrega quando usado, e os servidores MCP dele seguem as regras de busca de ferramentas acima.

Os efeitos colaterais vão além dos tokens: seus servidores MCP rodam junto de cada sessão, seus hooks disparam nos próprios eventos e, o que quer que executem, executam como você. Na tela /plugin, os plugins do marketplace oficial da Anthropic mostram uma estimativa de Custo de contexto antes da instalação, e a aba Instalados lista os plugins marcados como "Não usados recentemente", que você pode desativar com claude plugin disable.

Uso de tokens lado a lado

Uma balança de latão com uma tira fina de papel mais pesada que uma pilha de livros-razão de couro

A linha de base por turno

Veja quanto cada opção custa parada e quando é acionada:

Custo ocioso, em todo turnoCusto quando usadoPior cenário
SkillCerca de 100 tokens cadaAbaixo de 5 mil para o corpo, mais qualquer arquivo lidoUm corpo perto do teto de 5 mil que é acionado com frequência demais
Servidor MCPLista de ferramentas via busca, ou todas as definições sem elaChamada da ferramenta mais resultado, limitado a 25 mil por padrãoMuitas ferramentas verbosas com a busca desativada
PluginNome e descrição por parte invocávelO mesmo que as partesDezenas de plugins ativados e sem uso

Um exemplo rápido com o número documentado: 40 skills a cerca de 100 tokens cada somam aproximadamente 4.000 tokens. Um servidor MCP com 40 ferramentas a 400 tokens estimados cada soma cerca de 16.000 com a busca de ferramentas desativada. A mesma quantidade, quatro vezes o peso, e as skills rendem mais por token porque o conteúdo pesado fica no disco até ser necessário.

De onde vem a economia

  • Mantenha SKILL.md enxuto. Mova detalhes raramente necessários para arquivos de referência, para que só o relevante carregue.
  • Envie scripts, não trechos de código. Só a saída de um script entra no contexto.
  • Reduza as descrições. O que e quando, em uma ou duas frases.
  • Filtre no servidor. Retorne dez linhas, não dez mil.
  • Desative plugins sem uso. Cada um ativado adiciona descrições em todo turno.
  • Use o escopo de projeto para o MCP. Carregue um servidor só onde ele se justifica.

Qual escolher

Dois colegas revisando um fluxograma de decisão impresso com notas adesivas sobre uma mesa de reunião

Comece pelo trabalho, não pelo nome do recurso:

SituaçãoMelhor opçãoPor quê
O Claude erra seu formato o tempo todoSkillInstruções, sem precisar de acesso ao vivo
O Claude precisa ler seu banco de dados ou sistema de chamadosMCPPrecisa de uma conexão ao vivo
Sua equipe precisa da mesma configuração no primeiro diaPluginUma instalação, atualizações versionadas
Uma tarefa repetitiva com um scriptSkillA saída do script é quase grátis
Vários passos misturando regras e dados ao vivoOs trêsCada um faz um trabalho

Escolha uma skill para trabalho repetitivo

Se você já colou as mesmas instruções duas vezes, isso pede uma skill. Regras de tom da marca, uma lista de verificação de pull request, um layout de relatório, um script de limpeza de dados. Nada sai da sua máquina, nada fica rodando, e o custo parado é de cerca de 100 tokens.

Escolha MCP para acesso ao vivo

Escolha MCP quando os dados estão em outro lugar e mudam: um CRM, um rastreador de problemas, um banco de dados de produção, uma sessão de navegador. Uma skill não consegue buscar dados novos sozinha. Ela só diz ao Claude como tratar os dados depois que ele já os tem.

Escolha um plugin para compartilhar uma configuração

Quando três colegas perguntarem "como você configurou isso?", empacote. Um plugin transforma uma skill, um agente e um servidor MCP em uma instalação só. Para uma configuração puramente pessoal, ele é sobrecarga, então dispense.

Usando os três juntos

Vista de cima de uma caixa aberta de kit de refeição com um cartão de receita, legumes e potes de temperos

Digamos que sua equipe de suporte queira que o Claude faça a triagem de chamados. Um servidor MCP para a central de atendimento dá ao Claude acesso aos chamados abertos. Uma skill guarda a rubrica de triagem, as regras de escalonamento e o tom das respostas. Um plugin entrega os dois a vinte colegas com um único comando. Resumindo: MCP para alcançar, skill para fazer direito, plugin para distribuir.

Erros que desperdiçam tokens

Uma gaveta de cozinha transbordando de cabos emaranhados e carregadores

  1. Embrulhar uma instrução simples em um servidor MCP. Se nenhum sistema ao vivo está envolvido, uma skill faz o mesmo trabalho por uma fração do peso.
  2. Enfiar tudo no SKILL.md. Passando de 5 mil, você paga por texto que o Claude raramente precisa. Divida em arquivos de referência.
  3. Escrever descrições do tamanho de um parágrafo. O limite de 1.024 caracteres é um teto, não uma meta.
  4. Deixar servidores sem uso conectados com a busca de ferramentas desativada. A gaveta de cabos emaranhados da foto é a sua janela de contexto.
  5. Devolver tabelas inteiras a partir das ferramentas. Uma consulta descuidada pode bater no limite de 25.000 tokens em um único turno.
  6. Instalar plugins "por precaução". Cada um adiciona descrições em todo turno, mesmo em sessões em que nunca roda.
  7. Pular a revisão de código de terceiros. Skills e plugins podem executar código com os seus privilégios, então leia o que instala.

💡 Auditoria rápida: execute /context para ver o que está consumindo sua janela, depois /plugin para desativar qualquer coisa listada em "Não usados recentemente".

Experimente você mesmo no Picasso IA

Skills, MCP e plugins vivem dentro dos próprios aplicativos do Claude e do Claude Code. O Picasso IA hospeda o Claude como um modelo de texto que você usa direto no navegador, o que ajuda a rascunhar um SKILL.md, enxugar uma descrição ou esboçar um schema de ferramenta antes de você se comprometer com ele.

Use o Claude Sonnet 5 no PicassoIA

  1. Abra o Claude Sonnet 5 no Picasso IA.
  2. Cole seu rascunho no campo Prompt, por exemplo "Reescreva esta descrição de skill em menos de 40 palavras."
  3. Defina o Effort. O padrão, low, desliga o raciocínio para a resposta mais rápida e barata. Suba para high ou max em um problema confuso com vários arquivos.
  4. Adicione um System Prompt para fixar o papel de uma vez, como "Você revisa arquivos SKILL.md em busca de desperdício de tokens."
  5. Anexe uma Image se quiser que ele leia uma captura de erro ou um diagrama, e use Max Tokens (padrão 8.192) para limitar o tamanho da resposta.
  6. Execute, copie o resultado e teste no Claude Code.

A documentação também precisa de imagens. Para um banner de README, um cabeçalho de tutorial ou a ilustração de um diagrama, experimente o Seedream 4.5, o GPT Image 2 ou o Flux 2 Pro no Picasso IA, e navegue por todos os outros modelos em picassoia.com/en/all-models. Descreva sua cena, escolha um modelo e comece a criar suas próprias imagens hoje.

Compartilhe este artigo

Escolha seu idioma