Preço do Claude Opus 5.5: custo da API e acesso gratuito

O Claude Opus 5.5 custa US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída, com leitura de cache a US$ 0,20 e 50% de desconto na Batch API. Veja quanto custam de verdade o chat, a revisão de código e as cargas de trabalho de agentes, como ele se compara com o Opus 5, o Sonnet 5.5 e o Haiku 4.5, quais planos o incluem e até onde vai o acesso gratuito.

Preço do Claude Opus 5.5: custo da API e acesso gratuito
Cristian Da Conceicao
Fundador do Picasso IA

O Claude Opus 5.5 custa US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída na API da Anthropic. Isso é 20% abaixo do Claude Opus 5, que cobra US$ 5 e US$ 25, e todas as outras linhas da sua conta são construídas a partir desses dois números. Uma resposta curta de chat custa perto de dois centavos. Uma central de suporte movimentada chega perto de quatrocentos dólares por mês. E a rota gratuita que as pessoas continuam pesquisando vem com um limite rígido que a maioria das páginas de "Opus grátis" deixa de fora. Aqui estão números reais para as três situações, para você estimar sua própria conta antes de escrever uma única linha de código.

Um desenvolvedor freelancer estudando uma folha impressa em uma mesa de café ao lado de uma janela com chuva

O preço em uma tabela

A Anthropic cobra o Claude por token, e cada tarifa abaixo é por um milhão de tokens (MTok). Um token equivale a cerca de quatro caracteres em inglês, então 1.000 tokens são aproximadamente 750 palavras, e um relatório de 10 páginas tem cerca de 7.000 tokens.

Tarifas por milhão de tokens

ItemPreço por milhão de tokens
Entrada, padrãoUS$ 4,00
Saída, padrãoUS$ 20,00
Leitura de cacheUS$ 0,20
Escrita de cache, 5 minutosUS$ 5,00
Escrita de cache, 1 horaUS$ 8,00
Entrada em loteUS$ 2,00
Saída em loteUS$ 10,00
Modo rápido, entrada e saídaUS$ 8,00 e US$ 40,00

Quatro outros fatos moldam a conta:

  • ID do modelo: claude-opus-5-5
  • Janela de contexto: 1 milhão de tokens
  • Saída máxima: 128.000 tokens por resposta
  • Priority Tier: não oferecido para este modelo

A fórmula é simples: (tokens de entrada × 4 + tokens de saída × 20) ÷ 1.000.000 dá o custo em dólares. Uma requisição com 10.000 tokens de entrada e 1.000 de saída custa US$ 0,04 mais US$ 0,02, ou seja, seis centavos. Toda resposta da API informa a contagem exata de tokens de entrada e saída nos dados de uso, então registre esses números a cada requisição e multiplique. Equipes que pulam essa etapa tendem a subestimar a saída, que é o lado caro.

💡 A saída custa cinco vezes mais que a entrada. Uma resposta longa pesa muito mais na conta do que um prompt longo, então defina um max_tokens sensato em cada requisição.

Vista de cima de uma mesa com calculadora, moedas, caderno e café

Os tokens de raciocínio também são cobrados

O Opus 5.5 sempre raciocina antes de responder. Você não pode desligar o raciocínio, e os tokens de raciocínio são cobrados à tarifa de saída de US$ 20 por milhão. O nível de esforço padrão é médio. Uma pergunta difícil de programação em esforço alto pode gastar milhares de tokens de raciocínio antes da primeira palavra visível, então uma resposta de 500 palavras pode gerar cobrança por muito mais tokens de saída do que você consegue ver.

Dois outros detalhes mudam estimativas antigas. O Opus 5.5 usa o tokenizador introduzido com o Opus 4.7, que pode gerar até cerca de 35% mais tokens do que os modelos Claude anteriores para o mesmo texto. Se seu orçamento foi feito com números do Claude 4.6, refaça a medição com o endpoint de contagem de tokens antes de confiar nele.

Quanto custam as cargas de trabalho reais

As tarifas significam pouco até você aplicá-las a uma tarefa. Todos os valores desta seção usam as tarifas padrão de US$ 4 e US$ 20, sem cache e sem desconto de lote.

Chat, rascunhos e revisões de código

TarefaTokens de entradaTokens de saídaCusto
Uma resposta de chat2.000800US$ 0,024
Rascunho de artigo de 2.500 palavras1.5003.300US$ 0,072
Revisão de pull request30.0003.000US$ 0,18
Revisão de contrato longo200.0004.000US$ 0,88

Até a revisão de contrato, com 200.000 tokens de entrada, fica abaixo de um dólar. A surpresa raramente vem de uma única chamada. Ela vem das mil chamadas que ninguém contou, e dos tokens de raciocínio que vêm junto com cada uma.

Sessões de agentes somam rápido

Um agente que edita arquivos e roda testes relê seu contexto crescente a cada passo. Imagine uma sessão de 40 passos que consome 500.000 tokens de entrada no total e gera 40.000 tokens de saída:

  • Entrada: 500.000 tokens × US$ 4 por milhão = US$ 2,00
  • Saída: 40.000 tokens × US$ 20 por milhão = US$ 0,80
  • Total: US$ 2,80

Agora coloque o contexto repetido em cache, de forma que 90% da entrada seja lida do cache. Os 450.000 tokens em cache custam US$ 0,09, os 50.000 tokens novos custam US$ 0,20, e a saída continua em US$ 0,80. A sessão cai para cerca de US$ 1,09, mais uma escrita de cache única na primeira requisição.

Planeje o orçamento do mês antes de começar

Um método rápido mantém as surpresas pequenas:

  1. Faça 50 requisições reais e registre a média de tokens de entrada e saída.
  2. Multiplique pelo seu volume mensal esperado.
  3. Acrescente 30% para novas tentativas, conversas mais longas e variação do raciocínio.
  4. Aplique descontos de cache ou de lote apenas ao tráfego que realmente se qualifica.

Experimente com um app que faz 20.000 requisições por mês, com 3.000 tokens de entrada e 700 de saída cada uma. A entrada são 60 milhões de tokens, que custam US$ 240. A saída são 14 milhões de tokens, que custam US$ 280. A conta-base é US$ 520, e a margem de 30% leva o número de planejamento para US$ 676.

Três potes de vidro com quantidades bem diferentes de moedas de cobre

Opus 5.5 frente aos demais

Mais barato que o Opus 5

O Opus 5.5 cobra US$ 4 e US$ 20 onde o Opus 5 cobra US$ 5 e US$ 25, um corte de 20% nos dois lados. A leitura de cache cai de US$ 0,50 para US$ 0,20 por milhão de tokens, um corte de 60%. A janela de contexto, o teto de saída e o tokenizador continuam os mesmos, então, para uma equipe que já usa o Opus 5, a queda de preço por si só é motivo para testar a troca. Uma equipe que gasta US$ 5.000 por mês no Opus 5 pagaria cerca de US$ 4.000 pelo mesmo volume de tokens no Opus 5.5, uma economia de US$ 1.000 por mês ou US$ 12.000 por ano, antes de qualquer desconto de cache ou de lote.

Antes de tudo, verifique duas mudanças que quebram compatibilidade: o raciocínio não pode ser desativado no Opus 5.5, e forçar uma ferramenta específica com tool_choice retorna um erro. Código escrito para modelos Opus mais antigos pode precisar de pequenas edições.

Para comparar a família de forma justa, considere uma carga de trabalho: uma central de suporte que responde 1.000 chamados por dia, com 1.500 tokens de entrada e 400 de saída cada um, ao longo de 30 dias.

ModeloEntrada e saída por MTokConta mensal
Claude Fable 5.1US$ 10 e US$ 50US$ 1.050
Claude Opus 5US$ 5 e US$ 25US$ 525
Claude Opus 5.5US$ 4 e US$ 20US$ 420
Claude Sonnet 5.5US$ 2 e US$ 10US$ 210
Claude Haiku 4.5US$ 1 e US$ 5US$ 105

Nessa carga de trabalho, o Opus 5.5 fica US$ 105 abaixo do Opus 5 todo mês, e uma execução em lote reduziria a conta pela metade, para US$ 210.

Quando o Sonnet ou o Haiku ganham

Preço por chamada não é preço por tarefa concluída. Um modelo mais barato que precisa de duas novas tentativas custa mais do que um modelo mais forte que acerta de primeira. Ainda assim, a divisão é clara na prática:

  • Opus 5.5: execuções longas de agentes, depuração difícil, raciocínio em nível de contrato.
  • Claude Sonnet 5.5 a US$ 2 e US$ 10: programação do dia a dia, rascunhos e chat pela metade do preço do Opus.
  • Claude Haiku 4.5 a US$ 1 e US$ 5: classificação, roteamento e marcação em volume.

Teste seus próprios prompts nos três e compare custo por resultado correto em vez de custo por requisição.

Dois desenvolvedores programando em par em uma mesa compartilhada em pé

Três formas de reduzir a conta

O cache de prompt se paga rápido

Suponha que você faça dez perguntas sobre o mesmo contrato de 100.000 tokens. Sem cache, cada requisição paga US$ 0,40 por essa entrada: US$ 4,00 no total das dez. Com um cache de 5 minutos, a primeira requisição grava o contrato a US$ 5 por milhão (US$ 0,50) e as nove seguintes leem a US$ 0,20 por milhão (US$ 0,02 cada). O total de entrada fica em US$ 0,68.

Coloque primeiro o material estável (instruções, documentos, definições de ferramentas) e a pergunta que muda por último, porque o cache funciona sobre um prefixo exato. Uma palavra editada perto do início invalida tudo o que vem depois.

Lotes custam metade

A Batch API recebe requisições em massa e devolve os resultados de forma assíncrona, normalmente em até um dia, a 50% dos preços padrão: US$ 2 de entrada e US$ 10 de saída por milhão de tokens. Entra qualquer coisa que ninguém esteja esperando: resumos noturnos, descrições de catálogo, rotulagem de conjuntos de dados, avaliações. O exemplo da central de suporte cai de US$ 420 para US$ 210 por mês se as respostas puderem esperar, e o lote pode ser combinado com cache para um corte maior.

Uma sala de triagem de encomendas ao amanhecer com fileiras de carrinhos carregados

Reduza a configuração de esforço

O esforço é a alavanca mais barata porque reduz os tokens de raciocínio sem mexer no prompt. O padrão do Opus 5.5 é médio. Chat, reescritas curtas e extração simples raramente precisam de mais do que low, enquanto refatorações de vários arquivos e depurações complicadas merecem high. Meça com uma amostra de suas requisições reais antes de mudar um padrão, e combine a configuração com um teto de max_tokens.

💡 O modo rápido dobra o preço. Ele roda o mesmo modelo com até 2,5 vezes a velocidade de saída, por US$ 8 de entrada e US$ 40 de saída por milhão de tokens. É uma prévia de pesquisa disponível apenas na API da Anthropic e não pode ser combinado com a Batch API. Use-o somente onde há uma pessoa esperando na tela.

Acesso gratuito: o que é real

Vamos direto ao ponto. Até o início de outubro de 2026, não existe camada gratuita para o Opus 5.5 na API, e o plano gratuito do claude.ai não o inclui. Todo caminho que funciona tem um preço ou uma pegadinha que vale conhecer.

O limite do plano gratuito

O plano gratuito do Claude oferece chat com modelos da classe Sonnet e Haiku, dentro de limites diários de uso. O Opus 5.5 fica atrás de um plano pago. Isso corresponde ao funcionamento da API: pague conforme usa desde a primeira requisição, com créditos pré-pagos e sem uma cota gratuita permanente. Planos e limites mudam com frequência, então leia a página de planos no site do Claude antes de pagar por qualquer coisa.

Um estudante trabalhando em um notebook numa biblioteca antiga e silenciosa

Planos pagos que incluem o Opus

O Claude Pro custa US$ 20 por mês e o Claude Max começa em US$ 100 por mês. Ambos abrem os modelos Opus dentro do app de chat, com limites de uso em vez de cobrança por token. Uma comparação aproximada: pelas tarifas da API, US$ 20 compram cerca de 830 respostas de chat do tamanho calculado antes (2.000 tokens de entrada e 800 de saída). Um usuário casual geralmente sai ganhando com um plano, enquanto um app que faz milhares de chamadas precisa da API.

Os créditos de nuvem são o outro desconto legítimo. Amazon Bedrock, Google Cloud Vertex AI e Microsoft Foundry oferecem o Claude, e uma empresa que já tem créditos com algum deles pode conseguir gastá-los ali. Bedrock e Vertex AI publicam tarifas próprias, então confira essas tarifas em vez de presumir que os valores deste artigo se aplicam.

Uma mulher lendo em um notebook em uma mesa de cozinha iluminada pelo sol

Sites que prometem Opus grátis

Pesquise por Opus 5.5 grátis e você vai encontrar páginas que prometem acesso ilimitado sem cadastro. Desconfie delas. Muitas são intermediários que revendem uma pequena cota, algumas direcionam você a um modelo mais barato sem avisar, e outras coletam tudo o que você colar. Nunca envie contratos, código-fonte ou dados de clientes por um site que você não consegue verificar. Alguns centavos por requisição na API oficial custam menos do que um vazamento.

Se você só precisa de respostas em nível Opus algumas vezes por semana, o caminho honesto mais barato é um pequeno saldo pré-pago na API. Com cerca de 2,4 centavos por resposta de chat, cada US$ 10 compram aproximadamente 400 respostas do tamanho calculado antes.

Resumo rápido:

  • Camada gratuita do Opus 5.5 na API: não
  • Opus 5.5 no plano gratuito do claude.ai: não, até o início de outubro de 2026
  • Preço mensal fixo para acesso ao chat: a partir de US$ 20
  • Maiores descontos na API: cache e lote
  • Modelos de texto gratuitos para testar no lugar: modelos abertos no catálogo da PicassoIA

Como usar o Claude na PicassoIA

O próprio Opus 5.5 não está no catálogo da PicassoIA no momento em que escrevemos. O modelo Opus mais próximo é o Claude Opus 4.7, e a mesma coleção lista o Claude Fable 5, o Claude Sonnet 5, o Claude Sonnet 4.6 e o Claude 4.5 Haiku. Você abre uma página, digita e lê a resposta. Não há conta de desenvolvedor para configurar nem painel de cobrança para acompanhar.

Abra a página do modelo

  1. Abra a página do Claude Opus 4.7 na coleção de modelos de linguagem (LLM).
  2. Digite sua pergunta na caixa Prompt. Cole código, um rascunho ou um documento longo.
  3. Se quiser, envie uma imagem, como uma captura de tela de uma conta ou um diagrama.
  4. Execute o modelo e leia a resposta.

Defina o prompt e os limites

ConfiguraçãoPadrãoO que faz
PromptObrigatórioSua pergunta ou tarefa
System PromptVazioDefine papel, tom e regras de formato
Max Tokens8.192Limita o tamanho da resposta
ImageNenhumaAdiciona uma captura de tela ou foto
Max Image Resolution0,5 megapixelReduz a imagem antes do envio, economizando tempo e dinheiro

Três hábitos melhoram as respostas. Dê um papel no system prompt, como "Você é um revisor cuidadoso de páginas de preços." Peça uma tabela quando quiser uma comparação. Reduza Max Tokens quando precisar apenas de uma resposta curta.

💡 Quer custo zero? O catálogo também lista modelos abertos como o GPT OSS 120B e o Llama 4 Maverick Instruct, ambos listados como gratuitos para testar. Qualidade e limites são diferentes do Opus, então teste-os com seus próprios prompts.

Close de mãos digitando em um notebook sobre uma mesa de madeira

Combine Claude com imagens e vídeo

Um modelo de linguagem também ganha seu lugar num fluxo de trabalho visual. Peça ao Claude vinte prompts de imagem detalhados de cerca de 120 palavras cada. Isso dá aproximadamente 3.200 tokens de saída, ou cerca de 6 centavos pela tarifa de saída do Opus 5.5, e os prompts trazem os detalhes de lente, iluminação e textura que fazem as fotos geradas parecerem reais.

Uma requisição que funciona bem fica assim: "Escreva um prompt fotográfico de 70 palavras para uma cena de cozinha pela manhã. Inclua o assunto, o ambiente, a direção da luz, a lente da câmera e duas texturas de superfície. Sem texto na imagem." O Claude devolve um parágrafo denso que você pode colar direto em um modelo de imagem, e uma segunda passada custa só mais alguns centavos.

Depois, vá para os modelos de imagem e vídeo da PicassoIA:

  • Imagens: cole o prompt no Seedream 4.5 ou no P-Image para imagens fotorrealistas.
  • Vídeo: use uma imagem como quadro inicial no Seedance 2.5 Lite ou no PicassoIA Video. A página do Seedance 2.5 Lite o descreve como um gerador gratuito e ilimitado de clipes de até 10 segundos.
  • Iteração: envie o resultado de volta ao Claude, pergunte o que mudar e gere de novo.

Usar uma ferramenta para palavras e outra para imagens mantém cada custo visível. Você paga centavos pelo prompt e deixa o modelo de imagem ou vídeo fazer o trabalho pesado.

Um diretor criativo em um estúdio loft de frente para um monitor com uma foto de lago de montanha

Crie suas primeiras imagens na PicassoIA

Agora você tem o preço do Opus 5.5, o ponto em que as rotas gratuitas terminam e três formas de fazer cada token render mais. A forma mais rápida de colocar isso em prática é mão na massa. Abra a PicassoIA, peça a um modelo Claude que escreva um prompt fotográfico para uma cena que você preza e rode-o no Seedream 4.5. Depois, leve o melhor quadro para um modelo de vídeo e veja-o se mexer. Explore todo o resto em todos os modelos da PicassoIA e continue experimentando até os prompts parecerem seus.

Compartilhe este artigo

Escolha seu idioma