O Claude Opus 5.5 custa US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída na API da Anthropic. Isso é 20% abaixo do Claude Opus 5, que cobra US$ 5 e US$ 25, e todas as outras linhas da sua conta são construídas a partir desses dois números. Uma resposta curta de chat custa perto de dois centavos. Uma central de suporte movimentada chega perto de quatrocentos dólares por mês. E a rota gratuita que as pessoas continuam pesquisando vem com um limite rígido que a maioria das páginas de "Opus grátis" deixa de fora. Aqui estão números reais para as três situações, para você estimar sua própria conta antes de escrever uma única linha de código.

O preço em uma tabela
A Anthropic cobra o Claude por token, e cada tarifa abaixo é por um milhão de tokens (MTok). Um token equivale a cerca de quatro caracteres em inglês, então 1.000 tokens são aproximadamente 750 palavras, e um relatório de 10 páginas tem cerca de 7.000 tokens.
Tarifas por milhão de tokens
| Item | Preço por milhão de tokens |
|---|
| Entrada, padrão | US$ 4,00 |
| Saída, padrão | US$ 20,00 |
| Leitura de cache | US$ 0,20 |
| Escrita de cache, 5 minutos | US$ 5,00 |
| Escrita de cache, 1 hora | US$ 8,00 |
| Entrada em lote | US$ 2,00 |
| Saída em lote | US$ 10,00 |
| Modo rápido, entrada e saída | US$ 8,00 e US$ 40,00 |
Quatro outros fatos moldam a conta:
- ID do modelo:
claude-opus-5-5
- Janela de contexto: 1 milhão de tokens
- Saída máxima: 128.000 tokens por resposta
- Priority Tier: não oferecido para este modelo
A fórmula é simples: (tokens de entrada × 4 + tokens de saída × 20) ÷ 1.000.000 dá o custo em dólares. Uma requisição com 10.000 tokens de entrada e 1.000 de saída custa US$ 0,04 mais US$ 0,02, ou seja, seis centavos. Toda resposta da API informa a contagem exata de tokens de entrada e saída nos dados de uso, então registre esses números a cada requisição e multiplique. Equipes que pulam essa etapa tendem a subestimar a saída, que é o lado caro.
💡 A saída custa cinco vezes mais que a entrada. Uma resposta longa pesa muito mais na conta do que um prompt longo, então defina um max_tokens sensato em cada requisição.

Os tokens de raciocínio também são cobrados
O Opus 5.5 sempre raciocina antes de responder. Você não pode desligar o raciocínio, e os tokens de raciocínio são cobrados à tarifa de saída de US$ 20 por milhão. O nível de esforço padrão é médio. Uma pergunta difícil de programação em esforço alto pode gastar milhares de tokens de raciocínio antes da primeira palavra visível, então uma resposta de 500 palavras pode gerar cobrança por muito mais tokens de saída do que você consegue ver.
Dois outros detalhes mudam estimativas antigas. O Opus 5.5 usa o tokenizador introduzido com o Opus 4.7, que pode gerar até cerca de 35% mais tokens do que os modelos Claude anteriores para o mesmo texto. Se seu orçamento foi feito com números do Claude 4.6, refaça a medição com o endpoint de contagem de tokens antes de confiar nele.
Quanto custam as cargas de trabalho reais
As tarifas significam pouco até você aplicá-las a uma tarefa. Todos os valores desta seção usam as tarifas padrão de US$ 4 e US$ 20, sem cache e sem desconto de lote.
Chat, rascunhos e revisões de código
| Tarefa | Tokens de entrada | Tokens de saída | Custo |
|---|
| Uma resposta de chat | 2.000 | 800 | US$ 0,024 |
| Rascunho de artigo de 2.500 palavras | 1.500 | 3.300 | US$ 0,072 |
| Revisão de pull request | 30.000 | 3.000 | US$ 0,18 |
| Revisão de contrato longo | 200.000 | 4.000 | US$ 0,88 |
Até a revisão de contrato, com 200.000 tokens de entrada, fica abaixo de um dólar. A surpresa raramente vem de uma única chamada. Ela vem das mil chamadas que ninguém contou, e dos tokens de raciocínio que vêm junto com cada uma.
Sessões de agentes somam rápido
Um agente que edita arquivos e roda testes relê seu contexto crescente a cada passo. Imagine uma sessão de 40 passos que consome 500.000 tokens de entrada no total e gera 40.000 tokens de saída:
- Entrada: 500.000 tokens × US$ 4 por milhão = US$ 2,00
- Saída: 40.000 tokens × US$ 20 por milhão = US$ 0,80
- Total: US$ 2,80
Agora coloque o contexto repetido em cache, de forma que 90% da entrada seja lida do cache. Os 450.000 tokens em cache custam US$ 0,09, os 50.000 tokens novos custam US$ 0,20, e a saída continua em US$ 0,80. A sessão cai para cerca de US$ 1,09, mais uma escrita de cache única na primeira requisição.
Planeje o orçamento do mês antes de começar
Um método rápido mantém as surpresas pequenas:
- Faça 50 requisições reais e registre a média de tokens de entrada e saída.
- Multiplique pelo seu volume mensal esperado.
- Acrescente 30% para novas tentativas, conversas mais longas e variação do raciocínio.
- Aplique descontos de cache ou de lote apenas ao tráfego que realmente se qualifica.
Experimente com um app que faz 20.000 requisições por mês, com 3.000 tokens de entrada e 700 de saída cada uma. A entrada são 60 milhões de tokens, que custam US$ 240. A saída são 14 milhões de tokens, que custam US$ 280. A conta-base é US$ 520, e a margem de 30% leva o número de planejamento para US$ 676.

Opus 5.5 frente aos demais
Mais barato que o Opus 5
O Opus 5.5 cobra US$ 4 e US$ 20 onde o Opus 5 cobra US$ 5 e US$ 25, um corte de 20% nos dois lados. A leitura de cache cai de US$ 0,50 para US$ 0,20 por milhão de tokens, um corte de 60%. A janela de contexto, o teto de saída e o tokenizador continuam os mesmos, então, para uma equipe que já usa o Opus 5, a queda de preço por si só é motivo para testar a troca. Uma equipe que gasta US$ 5.000 por mês no Opus 5 pagaria cerca de US$ 4.000 pelo mesmo volume de tokens no Opus 5.5, uma economia de US$ 1.000 por mês ou US$ 12.000 por ano, antes de qualquer desconto de cache ou de lote.
Antes de tudo, verifique duas mudanças que quebram compatibilidade: o raciocínio não pode ser desativado no Opus 5.5, e forçar uma ferramenta específica com tool_choice retorna um erro. Código escrito para modelos Opus mais antigos pode precisar de pequenas edições.
Para comparar a família de forma justa, considere uma carga de trabalho: uma central de suporte que responde 1.000 chamados por dia, com 1.500 tokens de entrada e 400 de saída cada um, ao longo de 30 dias.
| Modelo | Entrada e saída por MTok | Conta mensal |
|---|
| Claude Fable 5.1 | US$ 10 e US$ 50 | US$ 1.050 |
| Claude Opus 5 | US$ 5 e US$ 25 | US$ 525 |
| Claude Opus 5.5 | US$ 4 e US$ 20 | US$ 420 |
| Claude Sonnet 5.5 | US$ 2 e US$ 10 | US$ 210 |
| Claude Haiku 4.5 | US$ 1 e US$ 5 | US$ 105 |
Nessa carga de trabalho, o Opus 5.5 fica US$ 105 abaixo do Opus 5 todo mês, e uma execução em lote reduziria a conta pela metade, para US$ 210.
Quando o Sonnet ou o Haiku ganham
Preço por chamada não é preço por tarefa concluída. Um modelo mais barato que precisa de duas novas tentativas custa mais do que um modelo mais forte que acerta de primeira. Ainda assim, a divisão é clara na prática:
- Opus 5.5: execuções longas de agentes, depuração difícil, raciocínio em nível de contrato.
- Claude Sonnet 5.5 a US$ 2 e US$ 10: programação do dia a dia, rascunhos e chat pela metade do preço do Opus.
- Claude Haiku 4.5 a US$ 1 e US$ 5: classificação, roteamento e marcação em volume.
Teste seus próprios prompts nos três e compare custo por resultado correto em vez de custo por requisição.

O cache de prompt se paga rápido
Suponha que você faça dez perguntas sobre o mesmo contrato de 100.000 tokens. Sem cache, cada requisição paga US$ 0,40 por essa entrada: US$ 4,00 no total das dez. Com um cache de 5 minutos, a primeira requisição grava o contrato a US$ 5 por milhão (US$ 0,50) e as nove seguintes leem a US$ 0,20 por milhão (US$ 0,02 cada). O total de entrada fica em US$ 0,68.
Coloque primeiro o material estável (instruções, documentos, definições de ferramentas) e a pergunta que muda por último, porque o cache funciona sobre um prefixo exato. Uma palavra editada perto do início invalida tudo o que vem depois.
Lotes custam metade
A Batch API recebe requisições em massa e devolve os resultados de forma assíncrona, normalmente em até um dia, a 50% dos preços padrão: US$ 2 de entrada e US$ 10 de saída por milhão de tokens. Entra qualquer coisa que ninguém esteja esperando: resumos noturnos, descrições de catálogo, rotulagem de conjuntos de dados, avaliações. O exemplo da central de suporte cai de US$ 420 para US$ 210 por mês se as respostas puderem esperar, e o lote pode ser combinado com cache para um corte maior.

Reduza a configuração de esforço
O esforço é a alavanca mais barata porque reduz os tokens de raciocínio sem mexer no prompt. O padrão do Opus 5.5 é médio. Chat, reescritas curtas e extração simples raramente precisam de mais do que low, enquanto refatorações de vários arquivos e depurações complicadas merecem high. Meça com uma amostra de suas requisições reais antes de mudar um padrão, e combine a configuração com um teto de max_tokens.
💡 O modo rápido dobra o preço. Ele roda o mesmo modelo com até 2,5 vezes a velocidade de saída, por US$ 8 de entrada e US$ 40 de saída por milhão de tokens. É uma prévia de pesquisa disponível apenas na API da Anthropic e não pode ser combinado com a Batch API. Use-o somente onde há uma pessoa esperando na tela.
Acesso gratuito: o que é real
Vamos direto ao ponto. Até o início de outubro de 2026, não existe camada gratuita para o Opus 5.5 na API, e o plano gratuito do claude.ai não o inclui. Todo caminho que funciona tem um preço ou uma pegadinha que vale conhecer.
O limite do plano gratuito
O plano gratuito do Claude oferece chat com modelos da classe Sonnet e Haiku, dentro de limites diários de uso. O Opus 5.5 fica atrás de um plano pago. Isso corresponde ao funcionamento da API: pague conforme usa desde a primeira requisição, com créditos pré-pagos e sem uma cota gratuita permanente. Planos e limites mudam com frequência, então leia a página de planos no site do Claude antes de pagar por qualquer coisa.

Planos pagos que incluem o Opus
O Claude Pro custa US$ 20 por mês e o Claude Max começa em US$ 100 por mês. Ambos abrem os modelos Opus dentro do app de chat, com limites de uso em vez de cobrança por token. Uma comparação aproximada: pelas tarifas da API, US$ 20 compram cerca de 830 respostas de chat do tamanho calculado antes (2.000 tokens de entrada e 800 de saída). Um usuário casual geralmente sai ganhando com um plano, enquanto um app que faz milhares de chamadas precisa da API.
Os créditos de nuvem são o outro desconto legítimo. Amazon Bedrock, Google Cloud Vertex AI e Microsoft Foundry oferecem o Claude, e uma empresa que já tem créditos com algum deles pode conseguir gastá-los ali. Bedrock e Vertex AI publicam tarifas próprias, então confira essas tarifas em vez de presumir que os valores deste artigo se aplicam.

Sites que prometem Opus grátis
Pesquise por Opus 5.5 grátis e você vai encontrar páginas que prometem acesso ilimitado sem cadastro. Desconfie delas. Muitas são intermediários que revendem uma pequena cota, algumas direcionam você a um modelo mais barato sem avisar, e outras coletam tudo o que você colar. Nunca envie contratos, código-fonte ou dados de clientes por um site que você não consegue verificar. Alguns centavos por requisição na API oficial custam menos do que um vazamento.
Se você só precisa de respostas em nível Opus algumas vezes por semana, o caminho honesto mais barato é um pequeno saldo pré-pago na API. Com cerca de 2,4 centavos por resposta de chat, cada US$ 10 compram aproximadamente 400 respostas do tamanho calculado antes.
Resumo rápido:
- Camada gratuita do Opus 5.5 na API: não
- Opus 5.5 no plano gratuito do claude.ai: não, até o início de outubro de 2026
- Preço mensal fixo para acesso ao chat: a partir de US$ 20
- Maiores descontos na API: cache e lote
- Modelos de texto gratuitos para testar no lugar: modelos abertos no catálogo da PicassoIA
Como usar o Claude na PicassoIA
O próprio Opus 5.5 não está no catálogo da PicassoIA no momento em que escrevemos. O modelo Opus mais próximo é o Claude Opus 4.7, e a mesma coleção lista o Claude Fable 5, o Claude Sonnet 5, o Claude Sonnet 4.6 e o Claude 4.5 Haiku. Você abre uma página, digita e lê a resposta. Não há conta de desenvolvedor para configurar nem painel de cobrança para acompanhar.
Abra a página do modelo
- Abra a página do Claude Opus 4.7 na coleção de modelos de linguagem (LLM).
- Digite sua pergunta na caixa Prompt. Cole código, um rascunho ou um documento longo.
- Se quiser, envie uma imagem, como uma captura de tela de uma conta ou um diagrama.
- Execute o modelo e leia a resposta.
Defina o prompt e os limites
| Configuração | Padrão | O que faz |
|---|
| Prompt | Obrigatório | Sua pergunta ou tarefa |
| System Prompt | Vazio | Define papel, tom e regras de formato |
| Max Tokens | 8.192 | Limita o tamanho da resposta |
| Image | Nenhuma | Adiciona uma captura de tela ou foto |
| Max Image Resolution | 0,5 megapixel | Reduz a imagem antes do envio, economizando tempo e dinheiro |
Três hábitos melhoram as respostas. Dê um papel no system prompt, como "Você é um revisor cuidadoso de páginas de preços." Peça uma tabela quando quiser uma comparação. Reduza Max Tokens quando precisar apenas de uma resposta curta.
💡 Quer custo zero? O catálogo também lista modelos abertos como o GPT OSS 120B e o Llama 4 Maverick Instruct, ambos listados como gratuitos para testar. Qualidade e limites são diferentes do Opus, então teste-os com seus próprios prompts.

Um modelo de linguagem também ganha seu lugar num fluxo de trabalho visual. Peça ao Claude vinte prompts de imagem detalhados de cerca de 120 palavras cada. Isso dá aproximadamente 3.200 tokens de saída, ou cerca de 6 centavos pela tarifa de saída do Opus 5.5, e os prompts trazem os detalhes de lente, iluminação e textura que fazem as fotos geradas parecerem reais.
Uma requisição que funciona bem fica assim: "Escreva um prompt fotográfico de 70 palavras para uma cena de cozinha pela manhã. Inclua o assunto, o ambiente, a direção da luz, a lente da câmera e duas texturas de superfície. Sem texto na imagem." O Claude devolve um parágrafo denso que você pode colar direto em um modelo de imagem, e uma segunda passada custa só mais alguns centavos.
Depois, vá para os modelos de imagem e vídeo da PicassoIA:
- Imagens: cole o prompt no Seedream 4.5 ou no P-Image para imagens fotorrealistas.
- Vídeo: use uma imagem como quadro inicial no Seedance 2.5 Lite ou no PicassoIA Video. A página do Seedance 2.5 Lite o descreve como um gerador gratuito e ilimitado de clipes de até 10 segundos.
- Iteração: envie o resultado de volta ao Claude, pergunte o que mudar e gere de novo.
Usar uma ferramenta para palavras e outra para imagens mantém cada custo visível. Você paga centavos pelo prompt e deixa o modelo de imagem ou vídeo fazer o trabalho pesado.

Crie suas primeiras imagens na PicassoIA
Agora você tem o preço do Opus 5.5, o ponto em que as rotas gratuitas terminam e três formas de fazer cada token render mais. A forma mais rápida de colocar isso em prática é mão na massa. Abra a PicassoIA, peça a um modelo Claude que escreva um prompt fotográfico para uma cena que você preza e rode-o no Seedream 4.5. Depois, leve o melhor quadro para um modelo de vídeo e veja-o se mexer. Explore todo o resto em todos os modelos da PicassoIA e continue experimentando até os prompts parecerem seus.