Claude Opus 5.5 ou Opus 4.7: o que mudou e vale a pena?

O Claude Opus 5.5 foi lançado em 22 de setembro de 2026 a US$ 4 e US$ 20 por milhão de tokens, 20% abaixo do Opus 4.7. Esta comparação mostra as mudanças de preço, cache, modo rápido e ferramentas, as notas de benchmarks de terceiros e as chamadas de API que passam a falhar, para você saber antes de trocar de modelo.

Claude Opus 5.5 ou Opus 4.7: o que mudou e vale a pena?
Cristian Da Conceicao
Fundador do Picasso IA

A Anthropic lançou o Claude Opus 5.5 em 22 de setembro de 2026, cinco meses depois de o Claude Opus 4.7 chegar em 16 de abril. A surpresa está no preço: ele caiu. O Opus 5.5 custa US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída, enquanto o Opus 4.7 continua em US$ 5 e US$ 25. Um modelo mais barato, com data de corte de conhecimento mais recente, transforma a decisão de atualizar em uma questão prática.

Atualizações ainda têm custos que nunca aparecem na fatura. Algumas chamadas de API que funcionavam bem no 4.7 agora retornam um erro 400 no 5.5, e seus testes de avaliação merecem ser refeitos antes de você trocar um ID de modelo em produção. Esta comparação se atém às páginas oficiais de preços e de modelos da Anthropic, além de índices de benchmark de terceiros, e diz com clareza onde as evidências são fracas.

Mãos de desenvolvedor digitando em uma mesa com dois monitores desfocados ao fundo

💡 Resumo rápido: se você paga contas de API todo mês, o Opus 5.5 representa um desconto de 20% a 31% nas mesmas cargas de trabalho, com algumas quebras de compatibilidade para verificar antes. Se você usa o Claude por uma página de chat hospedada, não há conta para cortar nem código para migrar, então a decisão é mais simples.

O veredito rápido

Eis a resposta antes dos detalhes. O Opus 5.5 é o melhor modelo no papel e o mais barato na fatura. A própria visão geral de modelos da Anthropic agora orienta os desenvolvedores a começar com o Opus 5.5 para a maioria das cargas de trabalho e a reservar o Fable 5.1 para raciocínio exigente e trabalho de agentes de longo prazo. O único motivo sólido para esperar é a compatibilidade.

Vista aérea de uma estrada de cascalho que se divide em duas direções ao redor de um poste de madeira

Troque agora se este for o seu caso

  • Você roda loops de agentes com muito prompt caching. As leituras de cache caem de US$ 0,50 para US$ 0,20 por milhão de tokens, a maior economia de toda a comparação.
  • Você envia requisições com muitas ferramentas. O prompt de sistema embutido de uso de ferramentas cai de 675 para 286 tokens por requisição.
  • Você quer o modo rápido. O Opus 5.5 o suporta com preço premium, enquanto o Opus 4.7 rejeita a requisição por completo.
  • Você precisa de conhecimento mais atualizado. O Opus 5.5 lista um corte de conhecimento confiável em junho de 2026.
  • Você está começando um projeto novo. Nada precisa ser migrado, então há pouca razão para começar pelo modelo mais antigo.

Espere se este for o seu caso

Adie a troca se o seu código depender de qualquer um dos itens a seguir, porque o Opus 5.5 retorna um erro 400 para cada um deles:

  • Desligar o pensamento com thinking: {"type": "disabled"}, ou definir um budget_tokens manual.
  • Forçar uma ferramenta específica com tool_choice.
  • Usar a ferramenta de uso de computador computer_20251124.
  • Editar blocos de pensamento entre as rodadas.

Equipes em fluxos auditados ou regulados que não conseguem refazer suas avaliações neste trimestre também devem ficar onde estão. O Opus 4.7 continua disponível como modelo legado, e uma migração tranquila é melhor do que uma apressada.

Opus 4.7 e 5.5 lado a lado

A maior parte das especificações é igual, e é isso que torna as diferenças fáceis de identificar. Os dois modelos oferecem uma janela de contexto de 1M de tokens e até 128K tokens de saída máxima. Os dois também suportam até 300K tokens de saída na Batch API, com um cabeçalho beta. O dinheiro e as ferramentas são onde eles se separam.

EspecificaçãoOpus 4.7Opus 5.5
Data de lançamento16 de abril de 202622 de setembro de 2026
Preço de entrada por 1M de tokensUS$ 5US$ 4
Preço de saída por 1M de tokensUS$ 25US$ 20
Leitura de cache por 1M de tokensUS$ 0,50US$ 0,20
Escrita de cache de 5 minutosUS$ 6,25US$ 5
Escrita de cache de 1 horaUS$ 10US$ 8
Entrada / saída em loteUS$ 2,50 / US$ 12,50US$ 2 / US$ 10
Janela de contexto1M de tokens1M de tokens
Saída máxima128K tokens128K tokens
Modo rápidoIndisponívelUS$ 8 entrada / US$ 40 saída
Prompt de sistema de uso de ferramentas675 tokens286 tokens

Dois cadernos abertos lado a lado sobre uma mesa de carvalho, um gasto e outro novo

Onde cada versão se posiciona

Opus 4.7 e 5.5 não são vizinhos. O Opus 4.8 e o Opus 5 foram lançados no meio do caminho, e os dois mantiveram o preço de US$ 5 e US$ 25. Passar do 4.7 para o 5.5 reúne, portanto, várias gerações de mudanças em uma única migração, e é por isso que as quebras de compatibilidade mencionadas mais adiante neste artigo importam.

A linha atual da Anthropic tem quatro níveis: Fable 5.1 a US$ 10 e US$ 50, Opus 5.5 a US$ 4 e US$ 20, Sonnet 5.5 a US$ 2 e US$ 10, e Haiku 5.5 a partir de US$ 0,10 e US$ 0,50. O Opus 5.5 também é o Opus mais barato desde o início da geração de US$ 5 e US$ 25. Se você quer testar os vizinhos da família hoje, a PicassoIA hospeda o Claude Opus 4.7, o Claude Opus 4.6, o Claude Sonnet 5 e o Claude Fable 5.

O que mudou no Opus 5.5

Quatro mudanças carregam a maior parte do peso. Três delas economizam dinheiro. Uma pode quebrar um build.

Preços menores, leituras de cache mais baratas

O corte de 20% no preço base é a principal manchete, mas a mudança no cache importa mais para cargas de trabalho reais. As leituras de cache no Opus 5.5 são cobradas a 5% do preço de entrada, em vez de 10%, o que dá US$ 0,20 por milhão de tokens contra US$ 0,50 no Opus 4.7. É uma queda de 60%. Agentes que releem um prompt de sistema longo e uma transcrição crescente a cada passo gastam a maior parte do orçamento de entrada com leituras de cache, então sentem a mudança primeiro.

Duas pilhas de moedas sobre uma mesa de nogueira, a da esquerda mais alta

Pensamento adaptativo, padrão médio

O Opus 5.5 usa pensamento adaptativo que está sempre ligado, guiado por uma configuração de esforço cujo padrão é médio. O modelo decide quanto tempo pensar, e você o orienta com o esforço, em vez de um orçamento manual de tokens. O Opus 4.7 introduziu o nível de esforço xhigh entre alto e máximo, então os controles de esforço não são novidade. O que é novo é que o 5.5 remove a opção de desligar o pensamento.

O padrão médio é tanto uma decisão de custo quanto de qualidade. Relatos de lançamento dizem que o Opus 5.5 no esforço padrão superou o Opus 5 no esforço máximo no Terminal-Bench 4.0, custando cerca de um quinto por tentativa. Essa comparação é com o Opus 5, não com o 4.7, então trate-a como uma direção, e não como uma promessa para a sua carga de trabalho.

Na prática, defina o esforço explicitamente em vez de confiar no padrão. Comece no médio, passe para o alto apenas em tarefas nas quais uma resposta errada é cara, como revisões de segurança ou refatorações de vários arquivos, e registre a contagem de tokens em cada nível para ver quanto custa o pensamento extra.

Botão giratório de latão virado para a marca do meio em um amplificador vintage

Chega o modo rápido

O modo rápido é uma opção em versão de pré-visualização para pesquisa que troca dinheiro por velocidade. No Opus 5.5 ele custa US$ 8 por milhão de tokens de entrada e US$ 40 por milhão de tokens de saída, exatamente o dobro da tarifa padrão. O Opus 4.7 não o suporta de jeito nenhum, e uma requisição com speed: "fast" retorna um erro. O modo rápido está disponível apenas na API do Claude, não nas plataformas de nuvem parceiras, e não pode ser combinado com a Batch API.

Menos sobrecarga com ferramentas

Toda requisição que inclui ferramentas carrega um prompt de sistema oculto. No Opus 4.7 ele custa 675 tokens com escolha automática de ferramenta. No Opus 5.5, custa 286. Em 1.000 requisições com ferramentas, são 675.000 tokens contra 286.000, ou cerca de US$ 3,38 contra US$ 1,14 com o preço de entrada de cada modelo. É pouco dinheiro por chamada, mas um agente movimentado faz muitas chamadas.

Benchmarks: ganhos reais ou ruído?

Benchmarks são onde os textos sobre atualizações escorregam, então aqui vai a versão honesta. Os números de lançamento da Anthropic para o Opus 5.5 o comparam com o Opus 5, e os resultados publicados para o Opus 4.7 em abril vêm de versões mais antigas dos conjuntos de teste. Não conseguimos verificar um confronto direto e limpo, na mesma versão. A melhor evidência neutra é um índice de terceiros que avalia os dois modelos com a mesma metodologia.

Velocista agachado nos blocos de largada em uma pista vermelha ao nascer do sol

Notas de índices de terceiros

A página de comparação do LLM Stats avalia os dois modelos assim:

ÍndiceOpus 4.7Opus 5.5Diferença
Pontuação geral43,560,4+16,9
Raciocínio45,259,0+13,8
Programação35,251,0+15,8
Visão32,841,3+8,5
Uso de ferramentas24,732,8+8,1
Multimodal31,440,9+9,5
Matemática39,041,8+2,8

Essa página coloca o Opus 5.5 em primeiro lugar no geral e o Opus 4.7 em quadragésimo oitavo. A diferença é maior em programação e raciocínio, enquanto a matemática quase não se mexe. Os números de agregadores mudam conforme chegam novos resultados, então leia-os como uma tendência, e não como casas decimais.

O que os números de lançamento medem

No lançamento, o Opus 4.7 foi reportado com 64,3% no SWE-bench Pro, acima dos 53,4% do Opus 4.6, e com 87,6% no SWE-bench Verified. Ele também elevou a entrada de imagem de 1,15 para 3,75 megapixels. O Opus 5.5, no esforço máximo, foi reportado com 66,4% no Terminal-Bench 4.0, 81,8% no OSWorld 2.0, 57,8% no CursorBench 4.0 e 1.846 de Elo no GDPval-AA v2.1.

São conjuntos diferentes, versões diferentes e configurações de esforço diferentes. Não subtraia um do outro.

💡 Teste você mesmo: escolha 20 tarefas reais da sua própria fila, rode-as nos dois modelos e avalie os resultados às cegas. O modelo que vencer nas suas tarefas é o melhor para você, independentemente do que um ranking diga.

O custo real da troca

O preço por token é fácil de comparar. O preço por tarefa concluída é o que você de fato paga. Os dois modelos usam o mesmo tokenizador, então um texto idêntico gera contagens de tokens idênticas. O tamanho da saída ainda pode variar, porque o pensamento adaptativo decide quanto escrever, então meça uma amostra antes de confiar em qualquer projeção.

Quatro cargas de trabalho de exemplo

Estes números usam as tarifas publicadas e pressupõem contagens de tokens iguais. Deixam de fora os custos de escrita de cache para manter a conta legível.

Carga de trabalhoOpus 4.7Opus 5.5Economia
10M de entrada, 2M de saída, sem cacheUS$ 100US$ 8020%
50M de entrada (40M de leituras de cache), 5M de saídaUS$ 195US$ 14824%
Lote: 20M de entrada, 4M de saídaUS$ 100US$ 8020%
Loop de agente: 200M de entrada (190M de leituras de cache), 8M de saídaUS$ 345US$ 23831%

O padrão é claro. Tráfego comum economiza os 20% da manchete. Quanto mais da sua entrada chegar como leitura de cache, maior fica o desconto, porque a tarifa de cache caiu 60% enquanto a tarifa base caiu 20%.

Para ler a tabela com o seu próprio tráfego, pegue o relatório de uso do mês passado, separe os tokens de entrada em novos e leituras de cache, e aplique a mesma fórmula: entrada nova vezes a tarifa de entrada, mais leituras de cache vezes a tarifa de cache, mais saída vezes a tarifa de saída. Se você nunca ativou o cache, faça isso primeiro. Uma leitura de cache no Opus 4.7 já custa 90% menos que um token de entrada novo, então a economia do cache pode eclipsar a economia de trocar de modelo.

Operador de depósito escaneando caixas idênticas em estantes metálicas altas

Lotes e modo rápido

A Batch API dá 50% de desconto nos dois modelos, então os preços em lote ficam em US$ 2 e US$ 10 no Opus 5.5, contra US$ 2,50 e US$ 12,50 no Opus 4.7. Isso mantém a diferença de 20% para tarefas noturnas. O modo rápido funciona ao contrário. A US$ 8 e US$ 40, ele custa 60% a mais que a tarifa padrão do Opus 4.7, então use-o só na parcela do tráfego em que uma pessoa está esperando a resposta.

Armadilhas de migração para checar primeiro

A maioria das atualizações falha em pequenas coisas que ninguém testou. Rode esta lista de verificação em uma cópia de homologação do seu app antes de trocar um ID de modelo.

Técnico conectando um cabo Ethernet azul a um painel de distribuição

Chamadas que agora falham

  1. Pensamento desligado ou orçamento manual. thinking: {"type": "disabled"} e budget_tokens retornam ambos um 400 invalid_request_error.
  2. Escolha forçada de ferramenta. Um tool_choice que force qualquer ferramenta ou uma ferramenta nomeada retorna um 400.
  3. Blocos de pensamento editados. Os blocos de pensamento ficam vinculados ao estado da conversa, então edições retornam um 400.
  4. A antiga ferramenta de uso de computador. computer_20251124 é rejeitada. Troque para computer_toolset_20260801.

Cada uma delas é uma correção de uma linha, mas cada uma derruba um caminho de requisição se você a encontrar pela primeira vez em produção.

Tokenizador e blocos de pensamento

A boa notícia primeiro: não há mudança no tokenizador. O tokenizador atual chegou com o Opus 4.7 e gera cerca de 30% mais tokens que os modelos anteriores ao 4.7 para o mesmo texto. O Opus 5.5 usa o mesmo. Se você já passou do 4.6 para o 4.7, suas contagens de tokens se mantêm estáveis. Se ainda estiver no 4.6, reserve esses 30% no orçamento, somados a tudo o que foi dito acima.

O problema mais discreto é de comportamento. O texto que o modelo escreve entre chamadas de ferramenta agora chega dentro de blocos de pensamento, em vez de blocos de texto, então uma interface que transmite notas de progresso a partir dos blocos de texto pode ficar em branco até você ajustar a configuração thinking.display. Além disso, os blocos de pensamento só podem ser lidos pelo Opus 5.5, pelo Fable 5.1 e pelo Mythos 5.1, então um retorno no meio da conversa para outro modelo exige um plano próprio.

Uma implantação segura tem quatro etapas. Primeiro, reproduza um dia de tráfego real contra o Opus 5.5 na homologação e registre cada erro 400. Segundo, compare o custo por tarefa concluída, não o custo por token, em pelo menos 200 requisições. Terceiro, envie 5% do tráfego real ao novo modelo por uma semana enquanto o Opus 4.7 cuida do restante. Quarto, aumente a parcela apenas se as taxas de erro e o feedback dos usuários se mantiverem. Se algo regredir, o ID do modelo é a única linha que você precisa mudar de volta.

Como usar o Opus 4.7 na PicassoIA

Você pode testar o lado mais antigo desta comparação sem escrever uma linha de código. O Claude Opus 4.7 roda direto da sua página de modelo, sem credenciais de API, instalações ou configuração. No momento em que escrevemos, o catálogo lista o Opus 4.7, o Opus 4.6, o Sonnet 5 e o Fable 5, da Anthropic, mas não o Opus 5.5, então esta seção percorre a metade do 4.7 do seu teste.

Homem digitando em um notebook em uma mesa de cafeteria, com um caderno ao lado

Passo a passo

  1. Abra a página do Claude Opus 4.7 na coleção de modelos de linguagem (LLM).
  2. Digite sua tarefa no campo Prompt. Cole código, uma cláusula contratual ou um relatório longo.
  3. Adicione um System Prompt se quiser um papel fixo, como "Você é um revisor sênior. Responda em tópicos curtos."
  4. Opcionalmente, envie uma Imagem, como uma captura de tela, um gráfico ou um diagrama. O modelo a lê junto com o seu texto. Max Image Resolution começa em 0,5 megapixel, então aumente-o para capturas de tela densas.
  5. Defina Max Tokens. O padrão é 8.192, e você pode reduzi-lo quando quiser respostas mais curtas.
  6. Rode o prompt, leia a resposta e continue a conversa no mesmo tópico.

Prompts que testam a diferença

Monte um pequeno conjunto de testes e reutilize-o em cada modelo que você comparar. Três prompts cobrem a maior parte do terreno:

  • Caça a um bug. Cole um arquivo real com um defeito conhecido e peça uma revisão linha por linha.
  • Um resumo longo. Cole um documento de 5.000 palavras e peça os dez pontos de que um gerente ocupado precisa.
  • Uma pergunta sobre captura de tela. Envie um painel denso e pergunte o que mudou entre dois gráficos.

Anote o tempo, o custo e uma nota de 1 a 5 para cada um. Dez minutos disso valem mais do que uma hora lendo discussões sobre benchmarks.

Crie suas próprias imagens em seguida

Modelos de linguagem escrevem o plano. A Picasso IA transforma o plano em imagens. Peça ao Opus cinco prompts fotorrealistas de imagem com lente, iluminação e composição detalhadas, depois cole-os em um modelo de texto para imagem e compare os resultados lado a lado. Bons pontos de partida são o Seedream 4.5, o Flux 2 Pro e o PicassoIA Image.

Quando um quadro fixo estiver do jeito certo, você pode colocá-lo em movimento com o Seedance 2.0 ou o Kling v3 Video. Escolha um prompt, rode-o e fique com a versão de que mais gostar. Sua primeira imagem está a poucos segundos de distância, então experimente a Picasso IA hoje e veja como ficam as suas próprias ideias.

Compartilhe este artigo

Escolha seu idioma