Preços da API Claude ou da API OpenAI: qual é mais barata?

Os preços de tabela da Claude e da OpenAI coincidem centavo por centavo em quatro faixas, então a API mais barata depende de cache, lotes, tamanho do prompt e tokens de raciocínio. Esta análise calcula cargas de trabalho reais nas duas para você escolher a conta menor com números, não com palpites.

Preços da API Claude ou da API OpenAI: qual é mais barata?
Cristian Da Conceicao
Fundador do Picasso IA

Duas páginas de preços de API podem parecer quase idênticas e, mesmo assim, gerar contas que diferem em milhares de dólares. É esse o cenário atual da Claude e da OpenAI. Nos preços de tabela, os dois fornecedores coincidem centavo por centavo em quatro faixas, então a opção mais barata depende de como você chama o modelo, e não da marca que aparece na fatura. Esta análise de preços das APIs Claude e OpenAI coloca lado a lado as tarifas por milhão de tokens e calcula o que cache, trabalhos em lote, prompts longos e tokens de raciocínio fazem em uma conta mensal real.

💡 Todos os preços estão em USD por milhão de tokens (MTok), retirados das páginas oficiais de preços de cada fornecedor na data de redação. As tarifas mudam com frequência, então confira as páginas atualizadas antes de fechar um orçamento.

Um desenvolvedor analisando planilhas de custos impressas em uma mesa em pé

A resposta curta

Nenhum dos dois fornecedores é mais barato em tudo. Faixa por faixa, os preços de tabela são iguais ou muito próximos, e a diferença real aparece principalmente em três pontos: entrada em cache, prompts muito longos e os modelos pequenos mais baratos. Se você compara só a tarifa de entrada anunciada, deixa de fora a maior parte da história.

Onde os preços coincidem exatamente

Quatro faixas batem centavo por centavo:

  • Claude Haiku 5.5 e GPT-6 Luna: US$ 0,10 de entrada, US$ 0,50 de saída (Haiku 5.5 para prompts de até 100K tokens).
  • Claude Sonnet 5.5 e GPT-6 Sol: US$ 2 de entrada, US$ 10 de saída.
  • Claude Opus 5.5 e GPT 5.6 Sol: US$ 4 de entrada, US$ 20 de saída.
  • Claude Fable 5.1 e GPT-6 Astra: US$ 10 de entrada, US$ 50 de saída.

A tabela da OpenAI lista tanto uma geração GPT 5.6 quanto uma geração GPT-6, e os nomes Luna e Sol aparecem nas duas com preços diferentes. Confira o número da geração antes de comparar duas linhas. Quando os preços de tabela batem tão de perto, a economia está nos detalhes abaixo.

Onde cada lado leva vantagem

A Claude sai na frente em:

  • Leituras de cache. Claude Opus 5.5 e Claude Sonnet 5.5 cobram acertos de cache a 5% do preço de entrada. A OpenAI lista a entrada em cache a 10% do preço de entrada na maioria dos modelos.
  • Prompts longos. Os modelos da Claude a partir da geração 4.6, exceto o Haiku 5.5, cobram uma única tarifa por token em toda a janela de 1M de tokens. A OpenAI aumenta suas tarifas quando a entrada passa de 272K tokens.
  • Modelos de raciocínio de ponta. Claude Opus 5.5 (US$ 4 e US$ 20) fica abaixo do GPT-5.5 (US$ 5 e US$ 30).

A OpenAI sai na frente em:

  • O degrau mais barato. GPT 5 Nano, com US$ 0,05 de entrada e US$ 0,40 de saída, tem as menores tarifas das tabelas abaixo.
  • Mais degraus pequenos. GPT 5 Mini e GPT 5 Nano permitem casar o tamanho do modelo com a tarefa com mais precisão do que a faixa pequena da Claude.

Faixas de preço lado a lado

As tabelas agrupam os modelos por função, e não por fornecedor, para que você possa ler uma faixa de ponta a ponta. Todos os valores são por milhão de tokens.

Vista de cima de uma calculadora, moedas e um caderno sobre uma mesa de carvalho

Modelos econômicos

ModeloEntradaEntrada em cacheSaída
Claude Haiku 5.5 (prompts de até 100K)$0,10$0,01$0,50
GPT-6 Luna$0,10$0,01$0,50
GPT 5.6 Luna$0,20$0,02$1,20
GPT 5 Mini$0,25$0,025$2,00
GPT 5 Nano$0,05$0,005$0,40
Claude 4.5 Haiku$1,00$0,10$5,00

O Claude Haiku 5.5 é o único modelo da Claude com preço variável por tamanho: prompts acima de 100K tokens são cobrados a US$ 0,50 de entrada e US$ 2,50 de saída. O Claude 4.5 Haiku, mais antigo, custa dez vezes mais que o Haiku 5.5 tanto na entrada quanto na saída.

Para um classificador ou roteador de alto volume, a disputa é entre o GPT 5 Nano, o Haiku 5.5 e o GPT-6 Luna. O Nano é o mais barato por token, mas os outros dois são gerações mais novas, então faça um teste de qualidade antes de presumir que a menor tarifa vence.

Modelos intermediários

ModeloEntradaEntrada em cacheSaída
Claude Sonnet 5.5$2,00$0,10$10,00
Claude Sonnet 5$2,00$0,20$10,00
GPT-6 Sol$2,00$0,20$10,00
GPT 5.6 Terra$2,00$0,20$12,00
GPT 5.4$2,50$0,25$15,00
Claude Sonnet 4.6$3,00$0,30$15,00

A saída é o número que decide essa faixa, porque tarefas de chat e escrita produzem respostas longas. O GPT 5.6 Terra cobra 20% a mais por token de saída que o Claude Sonnet 5.5, com a mesma tarifa de entrada de US$ 2. O GPT 5.4 custa 25% a mais que o Sonnet 5.5 na entrada e 50% a mais na saída.

Migrar do Claude Sonnet 4.6 para o Sonnet 5.5 reduz a tarifa em um terço no papel. A seção sobre tokenizador, mais abaixo, mostra por que a economia real é menor.

Modelos de ponta

ModeloEntradaEntrada em cacheSaída
Claude Opus 5.5$4,00$0,20$20,00
GPT 5.6 Sol$4,00$0,40$20,00
Claude Opus 4.7$5,00$0,50$25,00
GPT-5.5$5,00$0,50$30,00
Claude Fable 5.1$10,00$0,25$50,00
GPT-6 Astra$10,00$1,00$50,00

Claude Opus 5.5 e o GPT 5.6 Sol empatam na entrada e na saída. A diferença está na coluna de entrada em cache: $0,20 contra $0,40. O GPT-5.5 custa 25% a mais que o Opus 5.5 na entrada e 50% a mais na saída. O Claude Opus 4.7 e o Claude Opus 4.6 têm preço de tabela de US$ 5 e US$ 25, então o Opus mais novo também é o mais barato.

No topo absoluto, Claude Fable 5.1 e GPT-6 Astra são idênticos no preço de tabela. A tarifa de acerto de cache da Claude, de $0,25 contra $1,00, a torna quatro vezes mais barata para contexto repetido. O Claude Fable 5 tem o mesmo preço de tabela de US$ 10 e US$ 50, mas cobra acertos de cache a $1, quatro vezes a tarifa do Fable 5.1.

Vista de baixo ângulo de um corredor de data center com um técnico segurando um tablet

O que mais muda sua conta

Quatro fatores mexem no total mais do que a tabela de tarifas: cache, lotes, tamanho do prompt e raciocínio. Cada um favorece um fornecedor diferente em uma situação diferente.

A conta do cache de prompts

É no cache que os dois fornecedores mais divergem. A Claude permite pagar um pequeno acréscimo para gravar um prefixo de prompt em cache e depois lê-lo com um desconto grande.

Evento de cacheClaudeOpenAI
Gravação, cache de 5 minutos1,25x o preço de entradaNenhum preço de gravação separado listado
Gravação, cache de 1 hora2x o preço de entradaNenhum preço de gravação separado listado
Leitura0,1x o preço de entrada (0,05x no Opus 5.5 e no Sonnet 5.5, 0,025x no Fable 5.1)0,1x na maioria dos modelos listados

Uma gravação de 5 minutos na Claude se paga após uma única leitura do cache. Se seu app envia o mesmo prompt de sistema, as mesmas definições de ferramentas ou o mesmo documento de referência em toda requisição, o cache reduz essa parte da conta em 90% a 97,5% na Claude. O desconto de 90% da OpenAI na entrada em cache vem logo atrás, mas o Opus 5.5 e o Sonnet 5.5 cortam pela metade o custo restante.

Pense nisso como o mise en place de uma cozinha de restaurante. Ingredientes preparados uma vez atendem cada pedido mais rápido e mais barato, e um prefixo de prompt em cache funciona do mesmo jeito.

Vista de cima do balcão de um chef com pequenas tigelas de ingredientes preparados

Descontos em lote

Os dois fornecedores dão 50% de desconto para trabalhos que podem esperar. A API em lote da Anthropic reduz pela metade as tarifas de entrada e saída, então o Claude Sonnet 5.5 cai para US$ 1 de entrada e US$ 5 de saída, e o Claude Opus 5.5 cai para US$ 2 e US$ 10. A página de preços da OpenAI mostra a mesma redução de 50% em sua faixa de lote e também lista uma faixa Flex, cobrada com tarifas de lote para requisições que toleram respostas mais lentas.

Classificação noturna, resumos em massa, rotulagem de conjuntos de dados e rodadas de avaliação se encaixam nesse perfil. A Anthropic afirma que os descontos de lote e de cache podem ser combinados, porque os multiplicadores se acumulam.

💡 O modo rápido funciona na direção oposta. O Claude Opus 5.5 no modo rápido custa US$ 8 de entrada e US$ 40 de saída, exatamente o dobro da tarifa padrão, em troca de uma saída mais rápida. Se a latência não é um problema para seu produto, não pague por ela.

Vista aérea de um depósito silencioso ao amanhecer, com fileiras de caixas empilhadas

Sobretaxas de contexto longo

A OpenAI divide sua tabela de preços no limite de 272K tokens de entrada. Abaixo dessa linha você paga a tarifa de contexto curto. Acima dela vale a tarifa de contexto longo: US$ 8 de entrada e US$ 30 de saída para o GPT 5.6 Sol, contra US$ 4 e US$ 20 abaixo da linha. Os modelos da Claude a partir da geração 4.6 incluem a janela completa de 1M de tokens no preço padrão, então uma requisição de 900K tokens é cobrada à mesma tarifa por token que uma de 9K. A exceção é o Haiku 5.5, que sobe acima de 100K tokens.

Veja o que isso significa para uma requisição que envia 400K tokens de código-fonte e recebe 2.000 tokens de volta:

  • Claude Opus 5.5: 0,4 × US$ 4 + 0,002 × US$ 20 = US$ 1,64
  • GPT 5.6 Sol nas tarifas de contexto longo: 0,4 × US$ 8 + 0,002 × US$ 30 = US$ 3,26
  • GPT-5.5 nas tarifas de contexto longo (US$ 10 e US$ 45): 0,4 × US$ 10 + 0,002 × US$ 45 = US$ 4,09

Rode isso 1.000 vezes e a diferença entre o Opus 5.5 e o Sol chega a US$ 1.620. Uma ressalva: os dois fornecedores contam tokens de maneira diferente, então a mesma base de código não vai medir exatamente 400K dos dois lados.

Vista de baixo ângulo de um grande arquivo de biblioteca com estantes altas de carvalho e um leitor

Exemplos de custo mensal real

Tabelas de tarifas são abstratas. Duas cargas de trabalho tornam os números concretos.

Um jovem fundador trabalhando em um notebook em um café ensolarado ao lado de um recibo

Carga de trabalho de um bot de suporte

Considere um assistente de suporte que atende um milhão de requisições por mês. Cada requisição envia 1.500 tokens de entrada (prompt de sistema mais a mensagem do cliente) e devolve 500 tokens de saída. São 1.500 MTok de entrada e 500 MTok de saída por mês, sem cache e sem lotes.

ModeloCálculoCusto mensal
GPT 5 Nano1.500 × US$ 0,05 + 500 × US$ 0,40US$ 275
Claude Haiku 5.51.500 × US$ 0,10 + 500 × US$ 0,50US$ 400
GPT-6 Luna1.500 × US$ 0,10 + 500 × US$ 0,50US$ 400
GPT 5.6 Luna1.500 × US$ 0,20 + 500 × US$ 1,20US$ 900
Claude Sonnet 5.51.500 × US$ 2 + 500 × US$ 10US$ 8.000
GPT-6 Sol1.500 × US$ 2 + 500 × US$ 10US$ 8.000
GPT 5.6 Terra1.500 × US$ 2 + 500 × US$ 12US$ 9.000
GPT 5.41.500 × US$ 2,50 + 500 × US$ 15US$ 11.250
Claude Opus 5.51.500 × US$ 4 + 500 × US$ 20US$ 16.000
GPT 5.6 Sol1.500 × US$ 4 + 500 × US$ 20US$ 16.000
GPT-5.51.500 × US$ 5 + 500 × US$ 30US$ 22.500

Sem cache, os dois fornecedores empatam quase em todos os casos. O perdedor claro é o GPT-5.5, que custa US$ 6.500 a mais por mês que o Opus 5.5 para o mesmo tráfego. O GPT 5.6 Terra soma US$ 1.000 a mais que o Sonnet 5.5, tudo por causa da tarifa de saída.

Agora suponha que 1.200 dos 1.500 tokens de entrada sejam um prompt de sistema fixo que acerta o cache em quase toda requisição. O Claude Sonnet 5.5 fica em US$ 5.720, o GPT-6 Sol em US$ 5.840 e o GPT 5.6 Terra em US$ 6.840. Isso deixa o Sonnet US$ 120 à frente do Sol e US$ 1.120 à frente do Terra, antes da pequena cobrança de gravação do cache. Os tokens de saída ainda dominam, já que US$ 5.000 dos US$ 5.720 do Sonnet são saída, e é por isso que a diferença para o Sol continua pequena.

Carga de trabalho com documento repetido

Agora um assistente de pesquisa que responde perguntas sobre um único documento de referência de 20.000 tokens. Ele atende 100.000 perguntas por mês, e o documento é idêntico em todas elas, então o prefixo repetido soma 2.000 MTok. A saída é cobrada da mesma forma nos dois lados, então compare apenas o lado da entrada.

ConfiguraçãoCusto do documento repetido
Claude Opus 5.5, sem cacheUS$ 8.000
Claude Opus 5.5, leituras de cacheUS$ 400
GPT 5.6 Sol, entrada em cacheUS$ 800
Claude Sonnet 5.5, leituras de cacheUS$ 200
GPT 5.6 Terra, entrada em cacheUS$ 400

Os números da Claude pressupõem que o cache continua ativo. Com cerca de 2,3 requisições por minuto ele continua, porque cada leitura renova a janela de 5 minutos. Uma cobrança de gravação de 1,25x cada vez que o cache esfria quase não altera o total.

Na mesma faixa, as leituras de cache da Claude custam metade do preço das da OpenAI. Para um produto com muitas leituras, isso dá centenas de dólares por mês nesta escala e milhares em escalas maiores.

Custos ocultos que ninguém menciona

Os preços de tabela descrevem apenas os tokens que você planeja enviar. Três coisas mudam, sem alarde, quantos tokens você paga.

Tokens de raciocínio

O raciocínio é cobrado como saída. Nas duas plataformas, os tokens que o modelo gasta raciocinando antes de responder são cobrados à tarifa de saída, a coluna cara. Uma requisição hipotética que devolve uma resposta de 300 tokens depois de 2.000 tokens de raciocínio é cobrada como 2.300 tokens de saída. No Claude Opus 5.5, isso dá US$ 0,046 em vez de US$ 0,006, quase oito vezes mais pela mesma resposta visível.

As duas empresas oferecem um controle. O Claude Sonnet 5 tem uma configuração de esforço em que o nível baixo desliga o raciocínio para respostas mais rápidas e baratas, e o GPT 5.6 Terra tem uma configuração de esforço de raciocínio que vem com none por padrão. Comece no nível mais baixo e suba apenas quando as respostas piorarem.

Diferenças de tokenizador

A Anthropic afirma que os modelos Claude a partir da versão 4.7 usam um tokenizador mais novo, que gera cerca de 30% mais tokens para o mesmo texto que o anterior. Isso importa em atualizações dentro da linha Claude. Ir do Sonnet 4.6 para o Sonnet 5.5 reduz a tarifa em um terço, mas, se seu texto agora se divide em 30% mais tokens, a economia líquida fica mais perto de 13%.

A mesma lógica vale entre fornecedores. Uma tarifa por token não é um custo por palavra, e não existe conversão pública entre os dois tokenizadores. O objeto de uso devolvido com cada resposta lista os tokens de entrada e saída cobrados, então meça em vez de adivinhar.

Taxas de ferramentas e pesquisa

As ferramentas integradas têm cobranças próprias. Na Claude, a pesquisa na web custa US$ 10 por 1.000 pesquisas, mais os tokens que os resultados acrescentam ao seu prompt; a busca de página na web não tem cobrança além dos tokens, e a execução de código é gratuita quando usada junto com pesquisa ou busca na web. A execução de código avulsa inclui 1.550 horas gratuitas por mês e depois US$ 0,05 por hora por contêiner.

Fixar a inferência da Claude para processamento somente nos EUA multiplica todas as categorias de token por 1,1x. A OpenAI cobra suas próprias ferramentas integradas em separado, na página de preços, então inclua essas linhas na mesma planilha antes de comparar os totais.

Como escolher a mais barata

Agora você tem as tarifas, os multiplicadores e dois exemplos calculados. O último passo é o seu próprio tráfego.

Dois colegas comparando folhas impressas em uma mesa de reunião de madeira

Rode 50 prompts reais

Tire 50 requisições reais dos seus logs, incluindo as confusas. Envie cada uma para dois candidatos da mesma faixa. Registre os tokens de entrada e de saída cobrados e se a resposta era boa o bastante para ir ao ar. Multiplique pelas tarifas de cada fornecedor, incluindo as tarifas de cache e de lote onde se aplicarem.

O modelo com o menor custo por resposta aceitável é o mais barato, mesmo que sua tabela de tarifas pareça pior. Um modelo que precisa de duas tentativas para acertar custa o dobro, qualquer que seja o preço por milhão de tokens.

Sua carga de trabalhoProvavelmente mais baratoMotivo
Milhões de chamadas curtas de classificaçãoGPT 5 Nano, depois Haiku 5.5 ou GPT-6 LunaMenores tarifas de tabela
Chat com um prompt de sistema fixo e longoClaude Sonnet 5.5 ou Opus 5.5Leituras de cache a 5% do preço de entrada
Repositórios inteiros ou contratos acima de 272K tokensClaude Opus 5.5Uma tarifa até 1M de tokens
Trabalhos noturnos em loteQualquer umOs dois dão 50% de desconto, então escolha pela qualidade
Escrita com muita saída na faixa intermediáriaClaude Sonnet 5.5 ou GPT-6 SolUS$ 10 de saída contra US$ 12 do Terra
Raciocínio de ponta com contexto repetidoClaude Fable 5.1Leituras de cache a US$ 0,25 contra US$ 1,00

Teste os dois modelos no PicassoIA

Antes de integrar um SDK ao seu produto, rode o mesmo prompt pelos modelos dos dois fornecedores no navegador. O PicassoIA hospeda tanto o Claude Sonnet 5 quanto o GPT 5.6 Terra em sua coleção de modelos de linguagem de grande porte, então você pode comparar as respostas lado a lado sem código.

Compare em cinco passos

  1. Abra a página do Claude Sonnet 5 e cole um prompt real do seu produto no campo Prompt. Coloque as instruções de produção em System Prompt.
  2. Deixe Effort em low, o padrão, que mantém o raciocínio desligado. Mantenha Max Tokens em 8.192 ou reduza para o limite real de saída e depois rode e copie a resposta.
  3. Abra a página do GPT 5.6 Terra e cole o mesmo prompt e o mesmo prompt de sistema. Mantenha Reasoning Effort em none e defina Verbosity como medium.
  4. Compare o tamanho e a qualidade das respostas. Os tokens de saída são o lado caro da conta, então uma resposta mais curta que faz o trabalho é uma economia direta.
  5. Suba Effort na Claude e Reasoning Effort no Terra para medium, rode os dois de novo e verifique se o ganho de qualidade justifica os tokens de raciocínio extras da seção acima.

💡 Os dois modelos aceitam imagens, então você também pode anexar uma captura de tela para testar tarefas de visão. A entrada de imagem adiciona tokens: a página do Claude Sonnet 5 informa que ela equivale a largura × altura ÷ 750 tokens de entrada.

Crie suas próprias imagens em seguida

O hábito que economiza dinheiro com modelos de texto também funciona na geração de imagens: teste pouco, ajuste e só depois escale. Escreva um prompt, renderize, troque a iluminação ou a lente e renderize de novo. As fotos deste artigo foram todas geradas a partir de prompts de texto e de algumas revisões rápidas.

Um fotógrafo analisando fotografias de paisagem impressas em um estúdio ensolarado

Abra a biblioteca de modelos do PicassoIA, escolha um modelo de texto para imagem e descreva a cena que você quer: assunto, luz, lente, clima. Depois rode o mesmo prompt em um segundo modelo e compare os resultados. Alguns minutos de experimentação mostram qual modelo combina com o seu estilo, e cada renderização é uma chance de criar um visual que faça seu próximo artigo, página de produto ou campanha se destacar.

Compartilhe este artigo

Escolha seu idioma