O Grok 4.7 chegou em 21 de setembro de 2026, e a primeira coisa que as pessoas notaram foi o que não mudou: o preço. Depois de um lançamento que atrasou em relação às datas-alvo anteriores, a xAI (agora chamada SpaceXAI) manteve as tarifas do Grok 4.6, de US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de tokens de saída, e manteve a janela de contexto de 500.000 tokens. O que mudou foi o quanto o modelo trabalha em cada tarefa, e é aí que está a verdadeira história de custo.
Esta página reúne num só lugar a data de lançamento, todas as faixas de preço, os limites da janela de contexto, as notas de benchmark que a xAI divulgou e os números medidos por testadores independentes. Quando as fontes divergem, você verá os dois valores. Uma nota divulgada pelo fornecedor é uma afirmação até que outra pessoa a repita, por isso cada número abaixo traz o nome de quem o produziu.
💡 Leitura rápida: os mesmos preços por token do Grok 4.6, a mesma janela de 500K, notas mais altas em todos os sete benchmarks da xAI e cerca de 2,25 vezes mais tokens de saída por tarefa. A conta por tarefa é o número a acompanhar, não a tarifa por token.
Data de lançamento do Grok 4.7
O que foi lançado em 21 de setembro
A xAI lançou o Grok 4.7 em 21 de setembro de 2026, anunciado pela conta da SpaceXAI por volta das 16h17 UTC. O antecessor, Grok 4.6, chegou em 12 de agosto de 2026, então apenas 40 dias separam os dois modelos, embora reportagens descrevam o 4.7 como atrasado em relação a datas-alvo anteriores. Os dados básicos cabem numa tabela.
| Detalhe | Grok 4.7 |
|---|
| Data de lançamento | 21 de setembro de 2026 |
| Modelo anterior | Grok 4.6, 12 de agosto de 2026 |
| ID do modelo na API | grok-4.7 |
| Entrada | Texto e imagens |
| Saída | Texto |
| Esforço de raciocínio | low, medium, high (padrão), xhigh |
| Data de corte do conhecimento | Maio ou junho de 2026, as fontes divergem |
Um integrador observa que a grafia com hífen grok-4-7 é rejeitada, então use o ID com ponto nas chamadas de API. No lado técnico, a xAI descreve um modelo base maior, com treinamento por reforço estendido em tarefas que duram horas, além de hábitos melhores para verificar o próprio trabalho e gerenciar contextos longos.

Onde você pode usar
O Grok 4.7 chegou aos desenvolvedores por vários canais já no primeiro dia:
- API da xAI: disponível desde o lançamento com o ID
grok-4.7.
- Cursor: adicionou o modelo imediatamente, incluindo uma variante paga mais rápida.
- Grok Build: o arnês de programação próprio da xAI, onde várias das execuções de benchmark divulgadas foram feitas.
- GitHub Copilot: liberou o modelo gradualmente após o lançamento.
- OpenRouter e Vercel AI Gateway: ambos listaram o modelo para roteamento.
- Plataformas em nuvem: Bedrock, Model Garden e Foundry ficaram atrás da API da xAI no lançamento.
Os limites de taxa listados são 150 requisições por segundo e 50 milhões de tokens por minuto, o que é generoso o bastante para que a maioria das equipes esgote o orçamento muito antes de bater no teto.
Preço do Grok 4.7 por milhão de tokens
Tarifas padrão e de prompt longo
O preço é idêntico ao do Grok 4.6. A tarifa depende do tamanho do seu prompt, e a requisição inteira é cobrada na faixa mais alta assim que você ultrapassa o limite, não apenas os tokens extras.
| Tamanho do prompt | Entrada | Entrada em cache | Saída |
|---|
| Abaixo de 200K tokens | US$ 2,00 | US$ 0,50 | US$ 6,00 |
| 200K tokens ou mais | US$ 4,00 | US$ 1,00 | US$ 12,00 |
Todos os preços são por milhão de tokens. A entrada em cache custa um quarto da tarifa padrão de entrada, o que torna prompts de sistema repetidos e contexto de projeto compartilhado bem mais baratos.
Existe também uma variante rápida disponível apenas dentro do Cursor e do Grok Build, não pela API pública. Ela é descrita como tendo o dobro da velocidade de saída pelo dobro do preço, então conte com o dobro das tarifas padrão se optar por ela.

Contas reais para prompts reais
As tarifas significam pouco até você aplicá-las. A tabela abaixo supõe uma resposta de 5.000 tokens de saída e sem cache.
| Tamanho do prompt | Custo de entrada | Custo de saída | Total |
|---|
| 50K tokens | US$ 0,10 | US$ 0,03 | US$ 0,13 |
| 150K tokens | US$ 0,30 | US$ 0,03 | US$ 0,33 |
| 199K tokens | US$ 0,40 | US$ 0,03 | US$ 0,43 |
| 201K tokens | US$ 0,80 | US$ 0,06 | US$ 0,86 |
| 400K tokens | US$ 1,60 | US$ 0,06 | US$ 1,66 |
Observe as linhas do meio. Acrescentar apenas 2.000 tokens a um prompt leva a conta de US$ 0,43 para US$ 0,86, um dobro causado apenas por cruzar o limite.
💡 Dica: se o seu prompt fica perto de 200K tokens, reduza-o ou divida a tarefa em duas chamadas. A entrada em cache na faixa mais baixa costuma sair mais barata do que uma única requisição superdimensionada.
A janela de contexto de 500K
O que cabe em 500.000 tokens
O Grok 4.7 aceita 500.000 tokens numa única requisição, exatamente como o Grok 4.6, então isso não é uma melhoria. Uma regra prática comum é que um token equivale a cerca de três quartos de uma palavra em inglês. Isso põe a janela perto de 375.000 palavras, ou aproximadamente 1.500 páginas de texto simples. Na prática, ela pode conter:
- Um repositório de código de porte médio, com seus testes e documentação
- Vários contratos longos ou artigos de pesquisa ao mesmo tempo
- Uma semana inteira de chamados de suporte para uma busca de padrões
- Uma sessão muito longa de agente com a saída das ferramentas ainda na memória
Trate isso como estimativas. Código, tabelas e textos em outros idiomas usam mais tokens por palavra do que a prosa comum, então a capacidade real varia conforme o seu conteúdo.
Quando prompts longos custam o dobro
A janela é grande, mas a faixa de preço é o que limita você. Tudo em ou acima de 200K tokens passa para as tarifas de US$ 4 de entrada e US$ 12 de saída para a requisição inteira. Um prompt completo de 500K com resposta de 5.000 tokens custa cerca de US$ 2,06 nessas tarifas, contra US$ 0,33 para um prompt de 150K.

Uma janela maior também não garante uma recuperação melhor. A xAI diz que o 4.7 é melhor em gerenciar contexto mais longo e em verificar o próprio trabalho em tarefas de várias horas, mas essas são afirmações de lançamento, e você deve testar a recuperação de informações com os seus próprios documentos antes de enviar meio milhão de tokens em produção.
Benchmarks divulgados pela xAI
Notas de programação e terminal
A xAI publicou uma tabela com sete benchmarks, e o Grok 4.7 superou o Grok 4.6 em todos. As linhas de programação mostram a maior evolução.
| Benchmark | Grok 4.6 | Grok 4.7 | Configuração do Grok 4.7 |
|---|
| CursorBench 4.0 | 40,4% | 46,3% | xhigh |
| DeepSWE v1.1 | 65,2% | 71,0% | high |
| Terminal-Bench 4.0 | 20,3% | 38,0% | xhigh, arnês Grok Build |
| SWE-Marathon v1.1 | 31,9% | 46,0% | high |
O Terminal-Bench 4.0 é o destaque, um ganho de cerca de 17 pontos, e um veículo de imprensa lista a nota do 4.7 como 37,6% em vez de 38,0%. O SWE-Marathon também subiu mais de 14 pontos, o que combina com o foco em trabalho longo, de várias horas.
Um detalhe merece atenção. A tabela de lançamento compara o Grok 4.6 com esforço high e o Grok 4.7 com xhigh no CursorBench, então essa comparação não é de igual para igual. Mais esforço significa mais tokens de raciocínio, um ponto que volta na seção de custo abaixo.
Notas de trabalho intelectual
Fora da programação, o quadro é menor, mas ainda positivo.
| Benchmark | Grok 4.6 | Grok 4.7 |
|---|
| EEBench | 53,0% | 64,0% |
| HealthBench Professional | 48,5% | 56,7% |
| Benchmark jurídico Harvey | 15,8% | 19,6% |
A nota jurídica lembra o quanto esses testes são difíceis. Mesmo após um ganho de quase quatro pontos, o Grok 4.7 fica abaixo de 20% no benchmark Harvey, então a redação jurídica ainda precisa de revisão humana.

💡 Ressalva: cada nota desta seção vem dos próprios materiais da xAI. Sites de terceiros que republicaram os números afirmam claramente que não os verificaram.
O que testes independentes encontraram
Notas de índices de terceiros
Um rastreador independente de classificações mediu o Grok 4.7 no dia do lançamento e encontrou ganhos menores do que sugere a tabela do fornecedor:
- Intelligence Index: nota 46, em 16º lugar entre 655 modelos rastreados, 2 pontos acima do Grok 4.6.
- Coding Agent Index: 9 pontos acima do Grok 4.6.
- Cyber Index (28 de setembro): 56%, empatado em primeiro lugar entre 17 modelos.
- VulcanBench (4 de outubro): o Grok 4.7 ficou entre os três primeiros, à frente do nível 5.1 Max da família Claude Fable 5.
O padrão é coerente. O modelo é claramente melhor em programação agêntica e trabalho de segurança, enquanto o raciocínio geral mudou pouco. Isso combina com um modelo ajustado pelo treinamento em tarefas longas, e não com um modelo feito para conversa.
O problema do apetite por tokens
Aqui está a armadilha. O mesmo rastreador registrou cerca de 81.000 tokens de saída por tarefa para o Grok 4.7, contra 36.000 para o Grok 4.6, uma razão de aproximadamente 2,25. Outros testadores observaram o mesmo: em xhigh, o modelo novo escreve mais que o dobro da saída do 4.6 em high.
| Métrica | Grok 4.6 | Grok 4.7 |
|---|
| Tokens de saída por tarefa | 36.000 | 81.000 |
| Custo de saída por tarefa a US$ 6 por milhão | US$ 0,22 | US$ 0,49 |
| Preço por token | US$ 6 por milhão | US$ 6 por milhão |
Apenas custo de saída, antes de entrada e cache. A tabela de tarifas não mudou, mas o custo por tarefa concluída praticamente dobrou. Um modelo barato que fala o dobro não é um modelo barato.

Você pode manter esse apetite sob controle com alguns hábitos:
- Limite o tamanho da saída com um máximo sensato de tokens em cada chamada.
- Use esforço low ou medium nas etapas fáceis de um ciclo de agente e reserve o xhigh para a etapa que precisa dele.
- Coloque em cache o contexto compartilhado, para que a tarifa de entrada de US$ 0,50 se aplique ao seu prompt de sistema e aos arquivos do projeto.
- Encaminhe tarefas curtas para o Grok 4.6 ou um modelo menor, e envie ao 4.7 apenas os trabalhos longos e pesados em ferramentas.
- Registre os tokens por tarefa concluída, não por requisição, para que novas tentativas e respostas prolixas apareçam nos seus números.
Duas afirmações continuam sem confirmação. A xAI não informou a contagem de parâmetros, e um número de 2,1 trilhões citado por Elon Musk não foi respaldado pelos materiais de lançamento. Musk também mencionou dados complementares da SpaceX, que não aparecem nos documentos oficiais. Até que a xAI publique detalhes, trate os dois como boato.
Grok 4.7 frente aos rivais
Grok 4.7 ou Grok 4.6
| Recurso | Grok 4.6 | Grok 4.7 |
|---|
| Lançamento | 12 de agosto de 2026 | 21 de setembro de 2026 |
| Preço de entrada | US$ 2 por milhão | US$ 2 por milhão |
| Preço de saída | US$ 6 por milhão | US$ 6 por milhão |
| Janela de contexto | 500K | 500K |
| Níveis de esforço | de low a xhigh | de low a xhigh |
| Tokens de saída por tarefa | 36.000 | 81.000 |
| Terminal-Bench 4.0 | 20,3% | cerca de 38% |
A recomendação das comparações que analisei é simples. Atualize para programação agêntica, automação de terminal e trabalho em repositórios longos. Fique no 4.6 para respostas curtas, classificação e conversa, onde a verbosidade extra só acrescenta custo. Uma divisão aproximada fica assim:
- Mude já: agentes de programação, refatorações de vários arquivos, automação de shell, triagem de segurança
- Teste antes: tarefas jurídicas, de saúde e financeiras, em que notas absolutas baixas pedem revisão
- Fique onde está: perguntas e respostas curtas, resumos, respostas de suporte, tudo o que é cobrado por mensagem

Fable 5.1 Max e outros rivais
Em relação à família Claude Fable 5, especificamente o nível 5.1 Max, a tabela da própria xAI mostra o Grok 4.7 à frente em dois dos sete benchmarks e atrás nas linhas de programação. O resultado no VulcanBench aponta na direção oposta, então o resumo honesto é que os dois se revezam nas vitórias conforme o teste.
Comparações diretas e limpas com outros laboratórios ainda são escassas. Se você está escolhendo entre Grok 4.7, GPT 5.6 Sol e Gemini 3.5 Flash, rode os mesmos dez prompts reais em cada um e compare a qualidade e o total de tokens usados.

Como escolher um nível de esforço de raciocínio
O Grok 4.7 oferece quatro configurações: low, medium, high e xhigh, com high como padrão. Como os tokens de saída pesam na sua conta, o esforço é um controle de custo tanto quanto de qualidade.
- Low: consultas rápidas e tarefas de formatação
- Medium: escrita do dia a dia e pequenas edições de código
- High: o padrão, um ponto de partida sensato para a maioria dos trabalhos com agentes
- Xhigh: tarefas difíceis de várias etapas em que uma resposta errada custa mais do que os tokens extras
Comece em high, meça os tokens por tarefa concluída e passe para xhigh apenas nos trabalhos que falham sem ele.

Experimente a família Grok no PicassoIA
O Grok 4.7 não está listado no PicassoIA até a data desta redação, mas o antecessor Grok 4 está, e ele roda diretamente num campo de texto, sem acesso à API nem configuração. É uma forma rápida de ter uma noção do estilo de raciocínio da xAI antes de comprometer gastos com a API.
Como usar o Grok 4 no PicassoIA
- Abra a página do Grok 4 na coleção de modelos de linguagem grandes.
- Digite sua pergunta no campo Prompt. Problemas de várias etapas e comparações são o que ele faz melhor.
- Mantenha Temperature no padrão de 0,1 para trabalhos factuais e aumente um pouco para brainstorming.
- Confira Max Tokens. O padrão é 2.048, então aumente se respostas longas forem cortadas.
- Deixe Top P em 1 e as duas penalidades em 0, a menos que a resposta se repita.
- Execute o prompt e depois cole o mesmo texto em outro modelo para comparar.
Para esse último passo, Claude Sonnet 5, GPT 5.6 Sol e Gemini 3.5 Flash são bons rivais, e vale dar uma olhada na página do Kimi K2.6 para prompts de programação no estilo agente.
Crie suas próprias imagens em seguida
Ler sobre modelos é metade do trabalho. A outra metade é criar algo com eles, e é aí que o PicassoIA ganha seu lugar. Escreva um roteiro, uma descrição de produto ou o esboço de um post com um modelo de linguagem e depois transforme a mesma ideia em imagens em poucos cliques.

Para resultados fotorrealistas, comece com Seedream 4.5, GPT Image 2, Flux 2 Pro ou Nano Banana Pro. Descreva o sujeito, a luz e a lente, como "85mm, luz suave de janela, granulação de filme", e compare dois modelos com o mesmo prompt. Quando uma imagem fixa ficar boa, a coleção de texto para vídeo pode transformá-la em um clipe curto.
Navegue por todos os modelos em picassoia.com/en/all-models, escolha um, escreva seu primeiro prompt e veja o que você pode criar hoje.