Preço da API do Claude ou assinatura: custos por token explicados

O preço da API do Claude cobra por cada token de entrada e de saída, enquanto Claude Pro e Max cobram uma mensalidade fixa. Este artigo compara as taxas por token de Haiku, Sonnet, Opus e Fable, mostra o custo real por requisição e encontra o ponto de equilíbrio para uso leve no chat, agentes de programação e equipes.

Preço da API do Claude ou assinatura: custos por token explicados
Cristian Da Conceicao
Fundador do Picasso IA

O Claude tem duas formas de cobrança, e elas não medem a mesma coisa. A API cobra por cada token que você envia e recebe. Uma assinatura do Claude cobra uma mensalidade fixa por uma quantidade limitada de uso de chat e programação. Escolher a errada significa pagar por tokens que você quase não usa ou bater no limite de uso no meio de um prazo. Este artigo coloca números reais dos dois lados, usando as taxas publicadas pela Anthropic em outubro de 2026, para você ver onde o medidor por token vence e onde um plano fixo sai na frente.

Um desenvolvedor digitando em um notebook junto à janela de um café, ao lado de um latte e um caderno

Como funciona a cobrança por token

Cada requisição à API é medida. Você paga pelo texto que entra, pelo texto que sai e por alguns extras opcionais, tudo medido em tokens. Os preços são cotados por milhão de tokens, escritos MTok, então $2 / MTok significa $2 para cada milhão de tokens. Não há mensalidade, número de assentos nem limite: a conta acompanha o tráfego.

O que conta como token

Um token é um pedaço de texto, normalmente uma palavra curta ou parte de uma mais longa. A regra prática da Anthropic é cerca de 4 caracteres ou 0,75 palavra em inglês por token, então um artigo de 2.500 palavras equivale a aproximadamente 3.300 tokens. Código, textos em outros idiomas e formatação pesada costumam consumir mais.

Cubos de madeira simples sendo separados em pequenos grupos sobre uma mesa de nogueira escura

Um detalhe importa quando você compara tabelas de preços antigas e novas. Os modelos Claude 4.7 e posteriores usam um tokenizador mais novo, que gera cerca de 30% mais tokens para o mesmo texto do que o Sonnet 4.6 e modelos anteriores. Um preço menor por token nem sempre significa uma conta menor se o seu prompt agora se divide em mais tokens.

Por que a saída custa mais

Os tokens de saída custam cinco vezes mais que os tokens de entrada em toda a linha atual. O Sonnet 5.5 cobra $2 por milhão de tokens de entrada e $10 por milhão de tokens de saída. O Opus 5.5 cobra $4 e $20. Gerar texto é a etapa cara, enquanto ler um prompt é barato.

Essa proporção define como você economiza. Documentos longos enviados custam pouco. Respostas longas que voltam custam muito. Um prompt que pede três tópicos sai mais barato do que um que convida a um ensaio de 2.000 palavras.

Como o histórico do chat infla a conta

A API não guarda estado, então cada novo turno reenvia a conversa inteira, e você paga por tudo isso como entrada de novo. Imagine um chat em que você digita 500 tokens e o modelo responde com 500 tokens, por dez turnos. Você escreveu apenas 5.000 tokens de texto novo, mas o medidor de entrada soma 50.000 tokens nas dez chamadas, porque o turno 10 reenvia tudo o que veio dos turnos 1 a 9.

No Sonnet 5.5, essa conversa custa $0,10 de entrada mais $0,05 pelos 5.000 tokens de saída, ou seja, $0,15 no total. Pouco isoladamente. Multiplique por cem conversas por dia e o histórico vira a maior linha da fatura, exatamente onde o cache ajuda.

Um longo cupom de papel saindo de uma caixa registradora de latão sobre um balcão de madeira

Preços da API do Claude por modelo

Taxas atuais por milhão de tokens

Estas são as taxas da página de preços da Anthropic, em dólares americanos por milhão de tokens. A última coluna é o preço de uma leitura do cache de prompt, a forma mais barata de reenviar um texto que você já enviou.

Vista de cima de uma mesa com um livro-razão aberto, uma calculadora e cupons de papel

ModeloEntradaSaídaLeitura do cache
Claude Haiku 5.5 (prompts de até 100K tokens)$0,10$0,50$0,01
Claude Haiku 4.5$1$5$0,10
Claude Sonnet 5.5$2$10$0,10
Claude Sonnet 4.6$3$15$0,30
Claude Opus 5.5$4$20$0,20
Claude Fable 5.1$10$50$0,25

O Haiku 5.5 tem preço pelo tamanho do prompt: prompts acima de 100.000 tokens pagam $0,50 de entrada e $2,50 de saída.

💡 Mais novo nem sempre é mais caro. O Opus 5.5 a $4 / $20 fica abaixo da geração Opus 5 e Opus 4.8, a $5 / $25, e o Sonnet 5.5 a $2 / $10 fica abaixo do Claude Sonnet 4.6 a $3 / $15. Confira a tabela de preços antes de presumir que o número maior pertence ao modelo mais novo.

O que uma requisição realmente custa

Considere uma requisição típica: 3.000 tokens de entrada (um prompt de sistema mais um documento colado) e 800 tokens de saída (uma resposta sólida). Aqui está a conta por requisição e por mil requisições, usando as mesmas contagens de tokens em todas as linhas para manter a comparação simples.

ModeloCusto por requisiçãoCusto por 1.000 requisições
Claude Haiku 5.5$0,0007$0,70
Claude Haiku 4.5$0,007$7,00
Claude Sonnet 5.5$0,014$14,00
Claude Sonnet 4.6$0,021$21,00
Claude Opus 5.5$0,028$28,00
Claude Fable 5.1$0,070$70,00

A diferença entre a linha mais barata e a mais cara é de 100 vezes. A escolha do modelo mexe na conta mais do que qualquer decisão sobre plano. Como os modelos mais novos transformam o mesmo texto em mais tokens, some até 30% às linhas do 4.7 em diante no uso real.

Descontos de cache e de lote

Uma mulher empurrando um carrinho de caixas idênticas por um corredor de armazém

Dois descontos fazem a maior parte da economia, e eles se acumulam:

  • Cache de prompt. Gravar um prefixo de prompt no cache de 5 minutos custa 1,25x o preço base de entrada, e o cache de 1 hora custa 2x. Cada leitura depois disso custa 0,1x. No Opus 5.5 e no Sonnet 5.5, uma leitura custa apenas 0,05x, e no Fable 5.1 custa 0,025x. O cache de 5 minutos se paga já na primeira leitura.
  • API em lote. Tarefas assíncronas recebem 50% de desconto em tokens de entrada e de saída. O Sonnet 5.5 cai para $1 / $5 e o Opus 5.5 cai para $2 / $10.

O cache ajuda menos do que muita gente espera quando as respostas são longas, porque a saída não tem desconto. Uma sessão de programação com 50.000 tokens de entrada e 15.000 tokens de saída custa $0,50 no Opus 5.5. Se 40.000 desses tokens de entrada vierem do cache, o custo cai para cerca de $0,35, uma economia de 30%, porque os $0,30 de saída continuam iguais.

Quanto custam as assinaturas

Free, Pro e Max

Uma assinatura troca o medidor por um teto. Você paga um preço fixo, e o Claude limita o quanto você pode usar em janelas móveis de cinco horas, com o número exato de mensagens dependendo de quão longa e complexa é cada uma.

Um passageiro segurando um passe mensal de transporte diante de um leitor de catraca em uma estação de trem

PlanoPreçoO que você recebe
Free$0Chat na web, no desktop e no celular, com busca na web, criação de arquivos, execução de código e memória
Pro$20 por mês, ou $17 por mês com cobrança anualMais uso que o Free, além do Claude Code, Projects e modelos adicionais
Max 5x$100 por mêsCinco vezes o uso do Pro, limites de saída maiores e acesso antecipado a novos recursos
Max 20x$200 por mêsVinte vezes o uso do Pro

Assentos de Team e Enterprise

Quatro colegas revisando uma planilha impressa ao redor de uma mesa de reunião

Os assentos Team padrão custam $20 por assento por mês com cobrança anual, ou $25 com cobrança mensal. Os assentos Premium custam $100 por assento por mês com cobrança anual ($125 no mensal) e dão cinco vezes o uso de um assento padrão. O Enterprise começa em $20 por assento por mês com cobrança anual, com o uso cobrado pelas taxas da API, e acrescenta SCIM, registros de auditoria, retenção de dados personalizada e controle de acesso baseado em funções.

Por que a API é cobrada à parte

Uma assinatura do Claude não inclui créditos de API. A Anthropic cobra a API separadamente dos seus planos, então uma assinatura Pro de $20 não paga por um aplicativo que você entrega a clientes. Isso exige acesso à API com cobrança própria. Assinantes Individual e Team podem comprar créditos de uso extra pelas taxas padrão da API quando os limites do plano acabam, o que funciona como uma válvula de segurança para semanas movimentadas.

Onde fica o ponto de equilíbrio

O teste mais simples é dividir o preço do plano pelo seu custo por requisição. Com $20 do Pro e a requisição de 3.000 tokens de entrada e 800 de saída vista antes, o ponto de equilíbrio fica assim:

Uma balança de latão com moedas em um prato e um passe de papel dobrado no outro

ModeloCusto por requisiçãoRequisições para chegar a $20Por dia em 30 dias
Claude Haiku 5.5$0,000728.571cerca de 952
Claude Sonnet 5.5$0,0141.429cerca de 48
Claude Opus 5.5$0,028714cerca de 24
Claude Fable 5.1$0,070286cerca de 10

Isso compara apenas o custo. Um plano também inclui uma interface de chat, Projects e conexões com aplicativos, enquanto a API oferece acesso bruto e nada mais. Você precisa de um aplicativo ou ferramenta que a chame.

Usuários de chat leve

Se você faz algumas perguntas por dia, pagar por token quase sempre sai mais barato. Trinta requisições por dia no Sonnet 5.5 durante um mês dão cerca de $12,60, e o mesmo hábito no Haiku 5.5 custa centavos. O plano fixo só vence no preço quando seu volume passa do ponto de equilíbrio, ou quando você valoriza mais a interface e os extras do que a conta mais baixa.

Agentes de programação intensivos

Um desenvolvedor de barba em uma mesa em pé com dois monitores sob o sol do fim da tarde

A programação com agentes inverte a resposta. Use as contagens de tokens do exemplo de sessão de uma hora da própria Anthropic: 50.000 tokens de entrada e 15.000 de saída. No Opus 5.5, isso dá $0,50 por sessão sem cache. Vinte sessões em um dia útil custam $10, ou cerca de $220 em 22 dias úteis, mais que o plano Max 20x, de $200.

O cache reduz a diferença. Com cerca de $0,35 por sessão, as mesmas vinte sessões por dia custam por volta de $153 por mês. De qualquer forma, um usuário intensivo fica bem acima do plano Max 5x, de $100, que é a carga de trabalho para a qual os planos fixos foram criados. A contrapartida é que os limites de uso do plano continuam valendo.

Custos ocultos que vale orçar

A conta de tokens não é a fatura inteira. Estes extras são fáceis de esquecer:

  • Busca na web: $10 por 1.000 buscas, mais os tokens que os resultados acrescentam ao seu prompt. A busca de páginas não tem cobrança extra além dos tokens.
  • Inferência somente nos EUA: Definir inference_geo como "us" aplica um multiplicador de 1,1x a todas as categorias de token nos modelos Claude 4.6 e posteriores.
  • Modo rápido: O Opus 5.5 no modo rápido custa $8 de entrada e $40 de saída por MTok, o dobro da taxa padrão.
  • Managed Agents: Os tokens são cobrados pelas taxas normais, mais $0,08 por hora de sessão enquanto a sessão estiver em execução.
  • Sobrecarga de ferramentas: Qualquer requisição com ferramentas acrescenta um prompt de ferramenta embutido, cerca de 286 tokens na geração 5.5, antes das suas próprias definições de ferramenta.
  • Mudança no tokenizador: Até 30% mais tokens para o mesmo texto nos modelos Claude 4.7 e posteriores.

💡 Dica de orçamento: Acompanhe cache_read_input_tokens nas respostas da API. Se ele ficar em zero em requisições repetidas, algo no prefixo do seu prompt muda a cada chamada, e você paga preço cheio por um texto que poderia estar sendo lido do cache.

Use o Claude Sonnet 5 no PicassoIA

Se você quer experimentar o Claude sem abrir uma conta de API nem acompanhar um medidor de tokens, o Claude Sonnet 5 está disponível no Picasso IA. É a geração Sonnet anterior, com preço na API igual aos $2 / $10 do Sonnet 5.5, e a página dele lista entre seus recursos a programação em várias etapas, o uso de ferramentas e a entrada de imagens.

Configuração passo a passo

  1. Abra a página do modelo. Acesse o Claude Sonnet 5 no Picasso IA.
  2. Escreva seu prompt. O campo Prompt é a única entrada obrigatória. Cole o stack trace, o documento ou a pergunta.
  3. Defina o nível de esforço. O padrão é low, que desliga o pensamento para respostas mais rápidas e baratas. Passe para medium ou high em trabalhos de programação mais difíceis, e para xhigh ou max em bugs que tocam vários arquivos.
  4. Limite a saída. Max Tokens vem em 8.192 por padrão. Reduza quando quiser respostas curtas, já que a saída é o lado caro de qualquer tabela de preços do Claude.
  5. Adicione um prompt de sistema. Isso é opcional. Fixe um papel ou um estilo de código uma vez e reutilize em todo o projeto.
  6. Anexe uma imagem. Isso também é opcional. Uma captura de tela de um erro ou um esboço de wireframe funciona como contexto.
  7. Execute e refine. Leia a resposta, ajuste o prompt e execute de novo.

Dicas de parâmetros

ParâmetroPadrãoMude quando
EsforçobaixoA resposta perde detalhes, ou o bug se espalha por vários arquivos
Max Tokens8192Você quer respostas mais curtas ou blocos de código mais longos
Prompt de sistemavazioVocê precisa de um papel, tom ou estilo de código fixo
Resolução máxima da imagem0,5 megapixelTexto pequeno em uma captura de tela se perde após o redimensionamento

💡 Execute o mesmo prompt no Claude Sonnet 4.6 e no Claude 4.5 Haiku para ver a diferença de qualidade antes de escolher um modelo para o seu orçamento de API. Para os problemas de programação mais difíceis, experimente o Claude Fable 5.

Escolhendo a configuração certa

Combine a opção com a carga de trabalho:

  • Chat, escrita e pesquisa para uso próprio: Comece no Free. Passe para o Pro, de $20, quando bater nos limites.
  • Agentes de programação diários: Max 5x ou Max 20x, porque sessões intensas custam mais no medidor do que o preço fixo.
  • Um produto ou automação: A API, usando Haiku 5.5 ou Sonnet 5.5, com cache de prompt e tarefas em lote sempre que a latência permitir.
  • Uma equipe: Assentos Team para as pessoas, mais a API para tudo o que você entregar.
  • Os dois: Muitas pessoas mantêm um plano para uso pessoal e acesso à API para automação, já que as duas coisas são cobradas separadamente.

A escolha mais barata é a que combina com a forma como você trabalha de fato, então passe uma semana contando requisições antes de se comprometer.

Seu próximo passo no Picasso IA

A conta de preços fica mais fácil quando você tem algo para construir, e o Picasso IA é um lugar rápido para testar texto e imagens. Abra o Claude Sonnet 5 para rascunhar prompts, depois transforme esses prompts em imagens com um modelo de imagem como o GPT Image 2, o Flux 2 Pro ou o P-Image, o modelo por trás das fotos deste artigo.

Escolha uma cena, descreva a luz e a lente e clique em gerar. Depois mude um detalhe e execute de novo. Experimentar custa alguns minutos, e isso mostra o quanto um bom prompt muda o resultado. Explore o catálogo completo em picassoia.com/en/all-models e crie sua primeira imagem hoje.

Compartilhe este artigo

Escolha seu idioma