Preços do Claude Agent SDK: assinatura, créditos e custos

O uso do Claude Agent SDK pode consumir os limites do plano, os créditos mensais de API adicionados aos planos Max e Team em 7 de outubro ou a cobrança por token. Este artigo apresenta cada preço, os valores dos créditos, a economia com cache e o custo calculado de uma execução de agente.

Preços do Claude Agent SDK: assinatura, créditos e custos
Cristian Da Conceicao
Fundador do Picasso IA

O Claude Agent SDK não tem preço próprio. A conta vem do modelo por trás dele, e, a partir de 8 de outubro de 2026, essa conta pode chegar a você de três formas diferentes: pelos limites da sua assinatura, pelos novos créditos mensais de API dos planos Max e Team ou pela cobrança simples por token. Se você escolher a rota errada, ou trava no meio de uma execução ou paga mais do que precisava. Este artigo apresenta cada opção com os números das páginas de preços e de ajuda da própria Anthropic e, em seguida, calcula quanto custa uma única execução de agente em três modelos diferentes.

Um desenvolvedor de moletom cinza trabalhando em uma mesa em pé em um home office silencioso

Como o SDK é cobrado

O Agent SDK é uma biblioteca em Python e TypeScript que coloca o loop de agente, as ferramentas integradas, as sessões e os hooks do Claude Code dentro do seu próprio programa. A documentação da Anthropic a descreve como uma biblioteca que executa o binário do Claude Code em um processo que você opera. A página de preços não lista nenhuma taxa do SDK, então o que você paga é o uso do modelo: tokens de entrada, tokens de saída e atividade de cache.

Três formas de pagar

Onde esses tokens são cobrados depende de como o SDK faz o login:

  • Limites da assinatura. O SDK usa o seu login do Claude e consome a mesma cota das suas conversas e da programação interativa. Não há medidor em dólares, apenas limites que são reiniciados.
  • Créditos mensais de API. Os planos Max e Team agora incluem um valor em dólares a cada ciclo de cobrança, que o SDK gasta aos preços normais da API.
  • API por token. Você compra créditos no Claude Console, cria uma credencial de API e cada token é cobrado pelo preço de tabela.
RotaCobrado emIdeal paraAtenção a
Limites da assinaturaCota do planoScripts pessoais e tarefas noturnasCompartilhar um único pool com suas conversas
Créditos mensaisDólares que expiramProtótipos e projetos paralelosSem acúmulo ao final do ciclo
Cobrança por tokenDólares que você compraProdutos com usuários reaisSem limite, a menos que você defina um

💡 Provedores de nuvem são uma quarta rota. O SDK pode rodar no Amazon Bedrock, no Google Cloud ou no Microsoft Foundry. Essas faturas vêm do provedor de nuvem, e os créditos Max e Team não se aplicam ali.

Por que artigos antigos se contradizem

Os resultados de busca estão cheios de afirmações conflitantes porque as regras mudaram três vezes este ano:

  • 13 de maio: a Anthropic anunciou que, a partir de 15 de junho, o Agent SDK, claude -p, o Claude Code GitHub Actions e os apps de terceiros construídos sobre o SDK passariam para um crédito mensal separado, cobrado às tarifas cheias da API: US$ 20 no Pro, US$ 100 no Max 5x e US$ 200 no Max 20x.
  • 15 de junho: a Anthropic suspendeu essa mudança no dia em que ela entraria em vigor. O uso do Agent SDK continuou consumindo os limites da assinatura, e não havia crédito a resgatar.
  • 7 de outubro: os planos Max e Team ganharam créditos mensais de API que incluem o SDK. O Pro não recebeu nenhum.

Se um artigo diz que assinantes do Pro recebem um crédito de US$ 20 para o SDK, ele está descrevendo o plano que foi suspenso.

Limites do plano ou créditos mensais

Rodando com os limites do plano

O artigo de ajuda da Anthropic sobre o SDK diz que o uso feito pelo seu login do Claude continua contando nos limites da assinatura, da mesma forma que claude -p. Essa é a rota certa para automação pessoal: um script no seu notebook, uma tarefa noturna na sua própria máquina. Uma assinatura custa US$ 20 por mês no Pro, US$ 100 no Max 5x e US$ 200 no Max 20x, e você não paga nada por token.

A pegadinha é o compartilhamento. O SDK usa o mesmo pool de cada conversa e de cada sessão de programação interativa que você faz, então um loop de agente longo pode deixar você sem cota para o resto do dia.

Três cartões de papel creme em branco de alturas crescentes sobre uma mesa de nogueira

Os créditos Max e Team

Em 7 de outubro de 2026, a Anthropic adicionou créditos mensais de API aos planos Max e Team. Eles se aplicam à Claude API, aos Claude Managed Agents, ao Claude Agent SDK e ao playground do Console.

PlanoCrédito mensal
Max 5xUS$ 100
Max 20xUS$ 200
Team, assento StandardUS$ 20 por assento
Team, assento PremiumUS$ 100 por assento
Free, Pro e EnterpriseNão elegíveis

Um crédito é gasto aos preços de API da próxima seção, então US$ 100 significam US$ 100 em tokens. O Claude Code interativo e o uso extra dentro dos apps do Claude estão excluídos, e os créditos não alteram os seus limites de plano.

Uma ampulheta de latão com os últimos grãos de areia caindo ao lado de um calendário de papel em branco

Resgatando e gastando créditos

Os créditos não são automáticos. Siga estes passos:

  1. Em claude.ai, abra Configurações > Faturamento em um plano Max, ou Configurações da organização > Faturamento em um plano Team.
  2. Na seção Créditos de API, escolha a organização do Claude Console que deve recebê-los e aceite os termos do programa.
  3. Encontre o saldo no Console em Configurações > Faturamento, na seção Créditos promocionais.
  4. Crie uma credencial de API nessa organização e aponte o SDK para ela.

Algumas regras definem até onde o dinheiro vai:

  • Novos assinantes podem resgatar após 7 dias em um plano elegível.
  • Cada plano está vinculado a uma organização do Console, e você não pode alterar esse vínculo depois, então escolha a organização onde você vai construir.
  • Os créditos incluídos são gastos antes de quaisquer créditos que você tenha comprado, e nenhum método de pagamento é necessário na Claude Platform.
  • Os créditos não usados expiram ao final de cada ciclo de cobrança (mensal nos planos anuais) e nunca são transferidos para o ciclo seguinte.
  • Quando o saldo chega a zero e nada mais está disponível, as requisições param até o próximo lote chegar. O uso nunca é cobrado do seu plano Claude. O erro exibido é Your credit balance is too low to access the Anthropic API.

Preços de token modelo a modelo

A tabela de preços atual

Estes são os preços de tabela por milhão de tokens na página de preços da Anthropic, conferidos em 8 de outubro de 2026.

ModeloEntradaSaídaLeitura de cache
Claude Fable 5.1US$ 10US$ 50US$ 0,25
Claude Opus 5.5US$ 4US$ 20US$ 0,20
Claude Sonnet 5.5US$ 2US$ 10US$ 0,10
Claude Sonnet 5US$ 2US$ 10US$ 0,20
Claude Haiku 5.5 (prompts de até 100.000 tokens)US$ 0,10US$ 0,50US$ 0,01
Claude Haiku 4.5US$ 1US$ 5US$ 0,10

O Claude Haiku 5.5 custa mais quando um prompt ultrapassa 100.000 tokens: US$ 0,50 na entrada e US$ 2,50 na saída.

💡 O Claude Sonnet 5 foi lançado com US$ 2 e US$ 10 como preço de introdução até 31 de agosto de 2026. A página da Anthropic agora diz que esse é o preço padrão e que o aumento previsto para 1º de setembro, para US$ 3 e US$ 15, não vai acontecer. Qualquer página que ainda mostre esse aumento está desatualizada.

Os modelos a partir da versão 4.7 usam um tokenizador mais novo, que gera cerca de 30% mais tokens para o mesmo texto do que a geração 4.6 e as anteriores. Compare o custo de uma tarefa concluída, e não apenas o preço por token.

Três peças de xadrez de madeira de tamanhos crescentes sobre uma mesa escura de nogueira ao lado de um notebook

Leituras de cache custam menos

O SDK usa cache de prompt por conta própria. Uma escrita de cache de 5 minutos custa 1,25 vez o preço base de entrada, uma escrita de 1 hora custa 2 vezes, e uma leitura de cache custa 0,1 vez. Opus 5.5 e Sonnet 5.5 leem a 0,05 vez, e Fable 5.1 a 0,025 vez. Um loop de agente reenvia um prefixo longo e estável a cada passo, então a maior parte dos seus tokens de entrada acaba como leituras baratas.

Com uma credencial de API, o cache dura 5 minutos por padrão. Se suas execuções estiverem mais espaçadas do que isso, defina a variável de ambiente ENABLE_PROMPT_CACHING_1H. A opção de 1 hora custa mais para escrever e compensa quando execuções posteriores leem o mesmo prefixo.

Uma mão puxando uma gaveta de madeira de um catálogo de fichas de biblioteca

Multiplicadores ocultos a observar

Tokens não são a conta toda. Verifique estes pontos antes de montar seu orçamento:

  • Busca na web: US$ 10 por 1.000 buscas na Claude API, além dos tokens. O web fetch não adiciona nada além dos tokens que ele traz.
  • Inferência somente nos EUA: um multiplicador de 1,1x em todas as categorias de token quando você define inference_geo: "us" nos modelos Claude 4.6 e posteriores.
  • Endpoints regionais de nuvem: no Bedrock e no Google Cloud, endpoints regionais e multirregionais têm um acréscimo de 10% em relação aos globais.
  • Modo rápido: o Opus 5.5 roda a US$ 8 de entrada e US$ 40 de saída por milhão de tokens em prévia de pesquisa, o dobro da tarifa padrão.
  • Batch API: 50% de desconto na entrada e na saída, mas serve para tarefas offline enviadas diretamente à API, e não para um loop interativo do SDK.

Quanto custa uma execução de agente

A configuração

Imagine uma execução de correção de bug: o agente lê alguns arquivos, edita o código, roda os testes e repete por cerca de 30 passos. Considere 600.000 tokens de entrada ao longo desses passos, formados por 20.000 tokens sem cache, 40.000 escritos no cache de 5 minutos e 540.000 lidos de volta dele, mais 30.000 tokens de saída. São números ilustrativos, não uma medição, mas têm o formato de um loop de agente com cache.

Vista de cima de uma mão desenhando barras em papel quadriculado ao lado de uma calculadora gasta

O resultado

No Sonnet 5.5, a conta fica assim:

  • 20.000 tokens de entrada sem cache × US$ 2 por milhão = US$ 0,04
  • 40.000 tokens de escrita em cache × US$ 2,50 por milhão = US$ 0,10
  • 540.000 tokens de leitura de cache × US$ 0,10 por milhão = US$ 0,054
  • 30.000 tokens de saída × US$ 10 por milhão = US$ 0,30

A soma dá US$ 0,494. Rode o mesmo formato em três modelos e um crédito de US$ 100 compra quantidades muito diferentes de trabalho:

ModeloCusto por execuçãoExecuções com um crédito de US$ 100
Claude Haiku 5.5cerca de US$ 0,03mais de 3.600
Claude Sonnet 5.5cerca de US$ 0,49cerca de 200
Claude Opus 5.5cerca de US$ 0,99cerca de 100

Duas lições se destacam. Primeiro, o cache economiza cerca de dois terços: a mesma execução no Sonnet 5.5 sem cache custaria US$ 1,50. Segundo, a saída é a parte cara. Esses 30.000 tokens de saída representam cerca de 5% do volume e 61% do custo. Um crédito Max 20x simplesmente dobra cada número da última coluna.

Acompanhando os gastos dentro do SDK

Lendo a estimativa de custo

Cada chamada de query() termina com uma mensagem de resultado que traz total_cost_usd, o custo estimado daquela chamada. O campo modelUsage detalha isso por modelo, incluindo leituras e escritas de cache. Três detalhes pegam as pessoas de surpresa:

  • total_cost_usd e modelUsage incluem o trabalho dos subagentes, mas usage o deixa de fora, então usage subconta assim que os subagentes rodam.
  • Chamadas de ferramentas em paralelo produzem várias mensagens do assistente que compartilham um mesmo ID. Conte cada ID uma vez.
  • O output_tokens em cada passo é um valor provisório. Leia a contagem real de saída na mensagem de resultado.

💡 total_cost_usd é uma estimativa do lado do cliente, feita com base em uma tabela de preços incluída no SDK. A Anthropic recomenda usar a Usage and Cost API ou a página de uso do Console para a cobrança oficial, e nunca faturar seus próprios clientes com base na estimativa.

import { query } from "@anthropic-ai/claude-agent-sdk";

for await (const message of query({
  prompt: "Fix the failing test in src/auth.ts",
  options: { maxBudgetUsd: 2 },
})) {
  if (message.type === "result") {
    console.log(message.subtype, message.total_cost_usd);
  }
}

Um medidor de eletricidade analógico desgastado em uma parede de tijolos vermelhos

Limitando uma execução

A opção maxBudgetUsd em TypeScript, ou max_budget_usd em Python, interrompe uma chamada assim que o gasto dela ultrapassa o limite. Ela conta apenas essa chamada: o gasto restaurado de uma sessão retomada não entra na conta, e um /clear reinicia o orçamento. O resultado então chega com o subtipo error_max_budget_usd.

Para um teto que valha para o projeto inteiro, dê a ele um workspace próprio no Console e defina o limite de gasto desse workspace. Cada credencial e workspace de uma organização vinculada consome do mesmo saldo de créditos, então um limite de workspace impede que uma tarefa pesada esgote toda a cota do mês.

Equipes, produtos e agentes gerenciados

Como funcionam os pools de equipe

Os créditos de Team são de US$ 20 por assento Standard e US$ 100 por assento Premium, reunidos em um único saldo limitado a US$ 500 por mês. Uma equipe com três assentos Standard e dois Premium recebe US$ 260 por mês, e adicionar um assento Premium eleva o crédito do mês seguinte para US$ 360. O valor é definido pelos assentos do plano no início de cada mês de cobrança. Vincular uma organização também a coloca em pelo menos o nível de uso Start, ou no nível Build quando o crédito mensal está acima de US$ 200.

Quatro colegas em volta de uma mesa de madeira em um estúdio de coworking iluminado

Criando para clientes

Se você lança um produto, planeje a cobrança por API. A Anthropic não permite que desenvolvedores terceiros ofereçam o login do claude.ai ou seus limites de requisições em seus produtos, incluindo agentes construídos sobre o SDK, a menos que a Anthropic tenha aprovado isso antecipadamente. Os créditos mensais são feitos para construir e rodar as suas próprias aplicações e agentes, então mantenha o tráfego de clientes na cobrança por token, em que você controla os limites de gasto por workspace.

Comparando os Managed Agents

O Claude Managed Agents é a alternativa hospedada: a Anthropic roda o loop de agente em um sandbox de nuvem que ela gerencia. Ele cobra as mesmas tarifas de token, mais US$ 0,08 por hora de sessão, contadas apenas enquanto a sessão está rodando. Tempo ocioso não conta. Uma sessão de uma hora no Sonnet 5.5 com 50.000 tokens de entrada e 15.000 de saída custa US$ 0,10 + US$ 0,15 + US$ 0,08, ou US$ 0,33. Com o SDK não há cobrança por tempo de execução, mas a máquina onde ele roda fica por sua conta. Os créditos Max e Team funcionam nos dois casos.

Use o Claude Sonnet 5 no PicassoIA

Antes de gastar créditos ajustando um agente, rascunhe e teste o prompt de sistema dele em um modelo de chat. O Claude Sonnet 5 está no PicassoIA, feito para tarefas de programação em várias etapas e uso de ferramentas, o que o torna um lugar prático para testar um prompt antes de conectá-lo ao SDK.

Uma jovem digitando em um notebook em uma poltrona junto à janela de um café silencioso

  1. Abra a página do Claude Sonnet 5 na coleção de Large Language Models.
  2. Cole a tarefa em Prompt e depois coloque o papel e as regras em System Prompt.
  3. Defina o Effort. O padrão, low, desliga o raciocínio para as respostas mais rápidas e baratas. Suba por medium, high, xhigh e max para um bug que toque em vários arquivos.
  4. Deixe Max Tokens em 8.192, a menos que você espere uma resposta mais longa.
  5. Anexe um print em Image se a tarefa começar a partir de uma tela de erro. Max Image Resolution tem como padrão 0,5 megapixel, e uma imagem conta como largura × altura ÷ 750 tokens de entrada.
  6. Execute, ajuste o texto e copie a versão que funciona para as opções do seu SDK.

💡 A escada de esforço também mexe na sua conta do SDK. Mais esforço significa mais tokens de saída, e a saída é o lado caro de toda tabela de preços acima.

Para comparar como um modelo mais leve ou mais pesado responde ao mesmo prompt, o Claude Haiku 4.5, o Claude Opus 4.7 e o Claude Fable 5 estão na mesma coleção.

Crie suas próprias imagens no PicassoIA

Cada foto deste artigo saiu do P Image, um modelo de texto para imagem do PicassoIA que devolve uma imagem pronta em menos de um segundo. Ele aceita 16:9, 1:1, 9:16 e tamanhos personalizados, oferece upsampling de prompt para ideias curtas e aceita um seed, para que um resultado de que você goste possa ser reproduzido exatamente.

Experimente agora. Descreva uma cena em uma única frase, como uma mesa, uma janela e a luz do fim da tarde. Rode, mude um único detalhe e rode de novo. Dez tentativas levam alguns minutos, e no fim você já terá uma noção de como as palavras sobre câmera, luz e textura moldam uma foto.

O PicassoIA também oferece 91 modelos de texto para imagem e 87 modelos de texto para vídeo, além de modelos de música, fala e linguagem, tudo na lista completa de modelos. Escolha um, digite um prompt e crie algo seu hoje mesmo.

Compartilhe este artigo

Escolha seu idioma