Grok 4.7: data de lançamento, preço, janela de contexto e benchmarks

O Grok 4.7 chegou em 21 de setembro de 2026 com os mesmos preços de token de US$ 2 e US$ 6 do Grok 4.6, uma janela de contexto de 500.000 tokens e notas de programação mais altas. Veja os dados do lançamento, as faixas de preço, os benchmarks divulgados pela xAI e o que testes independentes encontraram sobre o custo por tarefa.

Grok 4.7: data de lançamento, preço, janela de contexto e benchmarks
Cristian Da Conceicao
Fundador do Picasso IA

O Grok 4.7 chegou em 21 de setembro de 2026, e a primeira coisa que as pessoas notaram foi o que não mudou: o preço. Depois de um lançamento que atrasou em relação às datas-alvo anteriores, a xAI (agora chamada SpaceXAI) manteve as tarifas do Grok 4.6, de US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de tokens de saída, e manteve a janela de contexto de 500.000 tokens. O que mudou foi o quanto o modelo trabalha em cada tarefa, e é aí que está a verdadeira história de custo.

Esta página reúne num só lugar a data de lançamento, todas as faixas de preço, os limites da janela de contexto, as notas de benchmark que a xAI divulgou e os números medidos por testadores independentes. Quando as fontes divergem, você verá os dois valores. Uma nota divulgada pelo fornecedor é uma afirmação até que outra pessoa a repita, por isso cada número abaixo traz o nome de quem o produziu.

💡 Leitura rápida: os mesmos preços por token do Grok 4.6, a mesma janela de 500K, notas mais altas em todos os sete benchmarks da xAI e cerca de 2,25 vezes mais tokens de saída por tarefa. A conta por tarefa é o número a acompanhar, não a tarifa por token.

Data de lançamento do Grok 4.7

O que foi lançado em 21 de setembro

A xAI lançou o Grok 4.7 em 21 de setembro de 2026, anunciado pela conta da SpaceXAI por volta das 16h17 UTC. O antecessor, Grok 4.6, chegou em 12 de agosto de 2026, então apenas 40 dias separam os dois modelos, embora reportagens descrevam o 4.7 como atrasado em relação a datas-alvo anteriores. Os dados básicos cabem numa tabela.

DetalheGrok 4.7
Data de lançamento21 de setembro de 2026
Modelo anteriorGrok 4.6, 12 de agosto de 2026
ID do modelo na APIgrok-4.7
EntradaTexto e imagens
SaídaTexto
Esforço de raciocíniolow, medium, high (padrão), xhigh
Data de corte do conhecimentoMaio ou junho de 2026, as fontes divergem

Um integrador observa que a grafia com hífen grok-4-7 é rejeitada, então use o ID com ponto nas chamadas de API. No lado técnico, a xAI descreve um modelo base maior, com treinamento por reforço estendido em tarefas que duram horas, além de hábitos melhores para verificar o próprio trabalho e gerenciar contextos longos.

Calendário de parede com uma data no fim de setembro circulada em vermelho com caneta marcadora sobre uma mesa

Onde você pode usar

O Grok 4.7 chegou aos desenvolvedores por vários canais já no primeiro dia:

  • API da xAI: disponível desde o lançamento com o ID grok-4.7.
  • Cursor: adicionou o modelo imediatamente, incluindo uma variante paga mais rápida.
  • Grok Build: o arnês de programação próprio da xAI, onde várias das execuções de benchmark divulgadas foram feitas.
  • GitHub Copilot: liberou o modelo gradualmente após o lançamento.
  • OpenRouter e Vercel AI Gateway: ambos listaram o modelo para roteamento.
  • Plataformas em nuvem: Bedrock, Model Garden e Foundry ficaram atrás da API da xAI no lançamento.

Os limites de taxa listados são 150 requisições por segundo e 50 milhões de tokens por minuto, o que é generoso o bastante para que a maioria das equipes esgote o orçamento muito antes de bater no teto.

Preço do Grok 4.7 por milhão de tokens

Tarifas padrão e de prompt longo

O preço é idêntico ao do Grok 4.6. A tarifa depende do tamanho do seu prompt, e a requisição inteira é cobrada na faixa mais alta assim que você ultrapassa o limite, não apenas os tokens extras.

Tamanho do promptEntradaEntrada em cacheSaída
Abaixo de 200K tokensUS$ 2,00US$ 0,50US$ 6,00
200K tokens ou maisUS$ 4,00US$ 1,00US$ 12,00

Todos os preços são por milhão de tokens. A entrada em cache custa um quarto da tarifa padrão de entrada, o que torna prompts de sistema repetidos e contexto de projeto compartilhado bem mais baratos.

Existe também uma variante rápida disponível apenas dentro do Cursor e do Grok Build, não pela API pública. Ela é descrita como tendo o dobro da velocidade de saída pelo dobro do preço, então conte com o dobro das tarifas padrão se optar por ela.

Vista aérea de faturas impressas, uma calculadora e um caderno de números sobre uma mesa de carvalho

Contas reais para prompts reais

As tarifas significam pouco até você aplicá-las. A tabela abaixo supõe uma resposta de 5.000 tokens de saída e sem cache.

Tamanho do promptCusto de entradaCusto de saídaTotal
50K tokensUS$ 0,10US$ 0,03US$ 0,13
150K tokensUS$ 0,30US$ 0,03US$ 0,33
199K tokensUS$ 0,40US$ 0,03US$ 0,43
201K tokensUS$ 0,80US$ 0,06US$ 0,86
400K tokensUS$ 1,60US$ 0,06US$ 1,66

Observe as linhas do meio. Acrescentar apenas 2.000 tokens a um prompt leva a conta de US$ 0,43 para US$ 0,86, um dobro causado apenas por cruzar o limite.

💡 Dica: se o seu prompt fica perto de 200K tokens, reduza-o ou divida a tarefa em duas chamadas. A entrada em cache na faixa mais baixa costuma sair mais barata do que uma única requisição superdimensionada.

A janela de contexto de 500K

O que cabe em 500.000 tokens

O Grok 4.7 aceita 500.000 tokens numa única requisição, exatamente como o Grok 4.6, então isso não é uma melhoria. Uma regra prática comum é que um token equivale a cerca de três quartos de uma palavra em inglês. Isso põe a janela perto de 375.000 palavras, ou aproximadamente 1.500 páginas de texto simples. Na prática, ela pode conter:

  • Um repositório de código de porte médio, com seus testes e documentação
  • Vários contratos longos ou artigos de pesquisa ao mesmo tempo
  • Uma semana inteira de chamados de suporte para uma busca de padrões
  • Uma sessão muito longa de agente com a saída das ferramentas ainda na memória

Trate isso como estimativas. Código, tabelas e textos em outros idiomas usam mais tokens por palavra do que a prosa comum, então a capacidade real varia conforme o seu conteúdo.

Quando prompts longos custam o dobro

A janela é grande, mas a faixa de preço é o que limita você. Tudo em ou acima de 200K tokens passa para as tarifas de US$ 4 de entrada e US$ 12 de saída para a requisição inteira. Um prompt completo de 500K com resposta de 5.000 tokens custa cerca de US$ 2,06 nessas tarifas, contra US$ 0,33 para um prompt de 150K.

Vista aérea de um rolo de papel muito longo desenrolado sobre a mesa de leitura de uma biblioteca

Uma janela maior também não garante uma recuperação melhor. A xAI diz que o 4.7 é melhor em gerenciar contexto mais longo e em verificar o próprio trabalho em tarefas de várias horas, mas essas são afirmações de lançamento, e você deve testar a recuperação de informações com os seus próprios documentos antes de enviar meio milhão de tokens em produção.

Benchmarks divulgados pela xAI

Notas de programação e terminal

A xAI publicou uma tabela com sete benchmarks, e o Grok 4.7 superou o Grok 4.6 em todos. As linhas de programação mostram a maior evolução.

BenchmarkGrok 4.6Grok 4.7Configuração do Grok 4.7
CursorBench 4.040,4%46,3%xhigh
DeepSWE v1.165,2%71,0%high
Terminal-Bench 4.020,3%38,0%xhigh, arnês Grok Build
SWE-Marathon v1.131,9%46,0%high

O Terminal-Bench 4.0 é o destaque, um ganho de cerca de 17 pontos, e um veículo de imprensa lista a nota do 4.7 como 37,6% em vez de 38,0%. O SWE-Marathon também subiu mais de 14 pontos, o que combina com o foco em trabalho longo, de várias horas.

Um detalhe merece atenção. A tabela de lançamento compara o Grok 4.6 com esforço high e o Grok 4.7 com xhigh no CursorBench, então essa comparação não é de igual para igual. Mais esforço significa mais tokens de raciocínio, um ponto que volta na seção de custo abaixo.

Notas de trabalho intelectual

Fora da programação, o quadro é menor, mas ainda positivo.

BenchmarkGrok 4.6Grok 4.7
EEBench53,0%64,0%
HealthBench Professional48,5%56,7%
Benchmark jurídico Harvey15,8%19,6%

A nota jurídica lembra o quanto esses testes são difíceis. Mesmo após um ganho de quase quatro pontos, o Grok 4.7 fica abaixo de 20% no benchmark Harvey, então a redação jurídica ainda precisa de revisão humana.

Mão apontando uma caneta para gráficos de barras impressos fixados em um quadro de cortiça

💡 Ressalva: cada nota desta seção vem dos próprios materiais da xAI. Sites de terceiros que republicaram os números afirmam claramente que não os verificaram.

O que testes independentes encontraram

Notas de índices de terceiros

Um rastreador independente de classificações mediu o Grok 4.7 no dia do lançamento e encontrou ganhos menores do que sugere a tabela do fornecedor:

  • Intelligence Index: nota 46, em 16º lugar entre 655 modelos rastreados, 2 pontos acima do Grok 4.6.
  • Coding Agent Index: 9 pontos acima do Grok 4.6.
  • Cyber Index (28 de setembro): 56%, empatado em primeiro lugar entre 17 modelos.
  • VulcanBench (4 de outubro): o Grok 4.7 ficou entre os três primeiros, à frente do nível 5.1 Max da família Claude Fable 5.

O padrão é coerente. O modelo é claramente melhor em programação agêntica e trabalho de segurança, enquanto o raciocínio geral mudou pouco. Isso combina com um modelo ajustado pelo treinamento em tarefas longas, e não com um modelo feito para conversa.

O problema do apetite por tokens

Aqui está a armadilha. O mesmo rastreador registrou cerca de 81.000 tokens de saída por tarefa para o Grok 4.7, contra 36.000 para o Grok 4.6, uma razão de aproximadamente 2,25. Outros testadores observaram o mesmo: em xhigh, o modelo novo escreve mais que o dobro da saída do 4.6 em high.

MétricaGrok 4.6Grok 4.7
Tokens de saída por tarefa36.00081.000
Custo de saída por tarefa a US$ 6 por milhãoUS$ 0,22US$ 0,49
Preço por tokenUS$ 6 por milhãoUS$ 6 por milhão

Apenas custo de saída, antes de entrada e cache. A tabela de tarifas não mudou, mas o custo por tarefa concluída praticamente dobrou. Um modelo barato que fala o dobro não é um modelo barato.

Close-up de um taxímetro amarelo com os números passando durante uma corrida na chuva

Você pode manter esse apetite sob controle com alguns hábitos:

  • Limite o tamanho da saída com um máximo sensato de tokens em cada chamada.
  • Use esforço low ou medium nas etapas fáceis de um ciclo de agente e reserve o xhigh para a etapa que precisa dele.
  • Coloque em cache o contexto compartilhado, para que a tarifa de entrada de US$ 0,50 se aplique ao seu prompt de sistema e aos arquivos do projeto.
  • Encaminhe tarefas curtas para o Grok 4.6 ou um modelo menor, e envie ao 4.7 apenas os trabalhos longos e pesados em ferramentas.
  • Registre os tokens por tarefa concluída, não por requisição, para que novas tentativas e respostas prolixas apareçam nos seus números.

Duas afirmações continuam sem confirmação. A xAI não informou a contagem de parâmetros, e um número de 2,1 trilhões citado por Elon Musk não foi respaldado pelos materiais de lançamento. Musk também mencionou dados complementares da SpaceX, que não aparecem nos documentos oficiais. Até que a xAI publique detalhes, trate os dois como boato.

Grok 4.7 frente aos rivais

Grok 4.7 ou Grok 4.6

RecursoGrok 4.6Grok 4.7
Lançamento12 de agosto de 202621 de setembro de 2026
Preço de entradaUS$ 2 por milhãoUS$ 2 por milhão
Preço de saídaUS$ 6 por milhãoUS$ 6 por milhão
Janela de contexto500K500K
Níveis de esforçode low a xhighde low a xhigh
Tokens de saída por tarefa36.00081.000
Terminal-Bench 4.020,3%cerca de 38%

A recomendação das comparações que analisei é simples. Atualize para programação agêntica, automação de terminal e trabalho em repositórios longos. Fique no 4.6 para respostas curtas, classificação e conversa, onde a verbosidade extra só acrescenta custo. Uma divisão aproximada fica assim:

  • Mude já: agentes de programação, refatorações de vários arquivos, automação de shell, triagem de segurança
  • Teste antes: tarefas jurídicas, de saúde e financeiras, em que notas absolutas baixas pedem revisão
  • Fique onde está: perguntas e respostas curtas, resumos, respostas de suporte, tudo o que é cobrado por mensagem

Desenvolvedor digitando à noite com dois monitores mostrando código e um abajur quente sobre a mesa

Fable 5.1 Max e outros rivais

Em relação à família Claude Fable 5, especificamente o nível 5.1 Max, a tabela da própria xAI mostra o Grok 4.7 à frente em dois dos sete benchmarks e atrás nas linhas de programação. O resultado no VulcanBench aponta na direção oposta, então o resumo honesto é que os dois se revezam nas vitórias conforme o teste.

Comparações diretas e limpas com outros laboratórios ainda são escassas. Se você está escolhendo entre Grok 4.7, GPT 5.6 Sol e Gemini 3.5 Flash, rode os mesmos dez prompts reais em cada um e compare a qualidade e o total de tokens usados.

Quatro velocistas agachados nos blocos de partida de uma pista de corrida ao nascer do sol

Como escolher um nível de esforço de raciocínio

O Grok 4.7 oferece quatro configurações: low, medium, high e xhigh, com high como padrão. Como os tokens de saída pesam na sua conta, o esforço é um controle de custo tanto quanto de qualidade.

  1. Low: consultas rápidas e tarefas de formatação
  2. Medium: escrita do dia a dia e pequenas edições de código
  3. High: o padrão, um ponto de partida sensato para a maioria dos trabalhos com agentes
  4. Xhigh: tarefas difíceis de várias etapas em que uma resposta errada custa mais do que os tokens extras

Comece em high, meça os tokens por tarefa concluída e passe para xhigh apenas nos trabalhos que falham sem ele.

Mão deslizando um de quatro faders de uma mesa de mixagem analógica

Experimente a família Grok no PicassoIA

O Grok 4.7 não está listado no PicassoIA até a data desta redação, mas o antecessor Grok 4 está, e ele roda diretamente num campo de texto, sem acesso à API nem configuração. É uma forma rápida de ter uma noção do estilo de raciocínio da xAI antes de comprometer gastos com a API.

Como usar o Grok 4 no PicassoIA

  1. Abra a página do Grok 4 na coleção de modelos de linguagem grandes.
  2. Digite sua pergunta no campo Prompt. Problemas de várias etapas e comparações são o que ele faz melhor.
  3. Mantenha Temperature no padrão de 0,1 para trabalhos factuais e aumente um pouco para brainstorming.
  4. Confira Max Tokens. O padrão é 2.048, então aumente se respostas longas forem cortadas.
  5. Deixe Top P em 1 e as duas penalidades em 0, a menos que a resposta se repita.
  6. Execute o prompt e depois cole o mesmo texto em outro modelo para comparar.

Para esse último passo, Claude Sonnet 5, GPT 5.6 Sol e Gemini 3.5 Flash são bons rivais, e vale dar uma olhada na página do Kimi K2.6 para prompts de programação no estilo agente.

Crie suas próprias imagens em seguida

Ler sobre modelos é metade do trabalho. A outra metade é criar algo com eles, e é aí que o PicassoIA ganha seu lugar. Escreva um roteiro, uma descrição de produto ou o esboço de um post com um modelo de linguagem e depois transforme a mesma ideia em imagens em poucos cliques.

Designer organizando cópias de fotos em um painel de referências sobre uma longa mesa de estúdio

Para resultados fotorrealistas, comece com Seedream 4.5, GPT Image 2, Flux 2 Pro ou Nano Banana Pro. Descreva o sujeito, a luz e a lente, como "85mm, luz suave de janela, granulação de filme", e compare dois modelos com o mesmo prompt. Quando uma imagem fixa ficar boa, a coleção de texto para vídeo pode transformá-la em um clipe curto.

Navegue por todos os modelos em picassoia.com/en/all-models, escolha um, escreva seu primeiro prompt e veja o que você pode criar hoje.

Compartilhe este artigo

Escolha seu idioma