Análise do Grok 4.7
O Grok 4.7 é uma atualização pelo mesmo preço que vale testar primeiro em agentes de programação e conhecimento de longa duração, mas os números da xAI não substituem um teste com seu workload.
Esta análise do Grok 4.7 chega a uma conclusão mais específica que as manchetes de lançamento. Para programação de longa duração, uso de ferramentas e trabalho profissional de conhecimento, faz sentido avaliar o 4.7 primeiro: ele melhora as sete linhas de Grok 4.6 publicadas pela xAI e mantém o preço padrão e o contexto de 500K. Isso não prova que seja um vencedor universal. A tabela oficial mistura níveis de reasoning effort e não executamos benchmark próprio com solicitações pagas.
A SpaceXAI lançou o grok-4.7 em 21 de setembro de 2026. A API pública da xAI já oferece o modelo, mas a OmniaKey não o listava no catálogo público em 22 de setembro. Até o catálogo ao vivo mudar, use o Grok 4.6 na OmniaKey ou um provedor que realmente exponha o ID exato do 4.7.
Dados verificados em 22 de setembro de 2026. As especificações e notas de benchmark vêm do anúncio e da documentação da SpaceXAI. A Artificial Analysis já mostrava um Intelligence Index inicial para xhigh, mas os campos de velocidade e preço por provedor ainda estavam incompletos. Não usamos preview privada, credenciais da xAI nem medição direta de latência. Resultados do fornecedor, evidência independente e nossa recomendação aparecem separados.
Veredito: o Grok 4.7 vale a pena?
Para novos agentes de longa duração, teste o 4.7 antes do 4.6. O sinal mais útil é a mudança de geração: a xAI relata números superiores para o 4.7 nas sete comparações diretas, com ganhos fortes em Terminal-Bench 4.0 e EEBench, sem aumentar a tarifa padrão por token.
Não migre só pela manchete. A tabela usa Grok 4.7 em xhigh, Grok 4.6 em high e os outros modelos frontier em max; o resultado DeepSWE do 4.7 ainda é marcado como high effort. A configuração pode mudar consumo, latência e comportamento.
Mantenha o 4.6 como rollback até seu teste passar. As duas gerações têm contexto de 500K e as mesmas tarifas diretas. Uma avaliação gradual custa menos que descobrir em produção uma regressão de tool call, recusa, verbosidade ou formato.
Lançamento e ficha técnica
| Item | Contrato do Grok 4.7 |
|---|---|
| Data de lançamento | 21 de setembro de 2026 |
| ID do modelo na API | grok-4.7 |
| Entrada / saída | Texto e imagem / texto |
| Janela de contexto | 500,000 tokens |
| Corte de conhecimento | Maio de 2026 |
| Reasoning effort | low, medium, high (padrão), xhigh |
| APIs | Responses API e Chat Completions |
| Recursos | Function calling, structured outputs, web search, X search, code execution |
| Batch API | Não suportada |
| Preço global direto abaixo de 200K de prompt | $2 entrada / $0.50 cache / $6 saída por 1M |
| Preço global direto a partir de 200K | $4 entrada / $1 cache / $12 saída por 1M |
Os 500K são capacidade, não uma franquia gratuita. Quando o prompt chega a 200K tokens, a xAI aplica o preço maior a todos os tokens da solicitação. O guia não define limite de saída em texto, mas rate limits, latência, orçamento e comportamento do endpoint ainda limitam workloads reais.
O que mudou em relação ao Grok 4.6
A SpaceXAI descreve um modelo-base novo e maior, um período mais longo de reinforcement learning com tarefas difíceis de várias horas, self-verification e gestão de contexto longo melhores, compreensão nativa do harness Grok Bot e uma nova pilha de safeguards.
São afirmações de lançamento, não uma auditoria independente da arquitetura. A empresa não publica contagem de parâmetros no anúncio nem no contrato atual do modelo.
| Decisão | Grok 4.7 | Grok 4.6 | Efeito prático |
|---|---|---|---|
| Base / treinamento | Nova base maior; RL mais longo em tarefas difíceis | Geração anterior | Motivo plausível para retestar agentes longos |
| Preço direto padrão | $2 / $0.50 / $6 | $2 / $0.50 / $6 | Sem adicional de tabela na atualização |
| Preço de contexto longo | $4 / $1 / $12 | $4 / $1 / $12 | Mesma economia no limite de 200K |
| Contexto | 500K | 500K | Não aumenta a capacidade |
| Reasoning | low a xhigh; high por padrão | low a xhigh; high por padrão | Fixe o mesmo effort na comparação |
| Batch | Não suportado | Não suportado | Não conte com desconto Batch |
| Foco do lançamento | Código, agentes, conhecimento, autoavaliação | Código e agentes longos | Confiabilidade, não nova modalidade |
O upgrade prático é desempenho declarado no mesmo preço de lista, não mais contexto ou token mais barato. O guia de preços da API do Grok 4.6 continua sendo a referência detalhada para a rota atualmente listada pela OmniaKey.
Benchmarks do Grok 4.7: como interpretar
Estes resultados são divulgados pela SpaceXAI e não foram reproduzidos pela OmniaKey. A empresa mostra 4.7 em xhigh, 4.6 em high, GPT-5.6 Sol em max e Fable 5.1 em max; o asterisco indica DeepSWE do 4.7 em high effort.
| Avaliação | Grok 4.7 | Grok 4.6 | GPT-5.6 Sol | Fable 5.1 | 4.7 vs. 4.6 |
|---|---|---|---|---|---|
| CursorBench 4.0 | 46.3% | 40.4% | 41.7% | 51.8% | +5.9 pp |
| DeepSWE v1.1 | 71.0%* | 65.2% | 72.7% | 70.0% | +5.8 pp |
| EEBench | 64.0% | 53.0% | 39.4% | 56.4% | +11.0 pp |
| AA Briefcase v1.1 | 1,657 | 1,546 | 1,487 | 1,678 | +111 Elo |
| Terminal-Bench 4.0 | 38.0% | 20.3% | 37.3% | 57.9% | +17.7 pp |
| Harvey Legal Agent Benchmark | 19.6% | 15.8% | 2.5% | 6.7% | +3.8 pp |
| HealthBench Professional | 56.7% | 48.5% | 60.5% | 62.1% | +8.2 pp |
A tabela sustenta uma afirmação sólida: na configuração da xAI, o 4.7 melhora sobre o 4.6 em todas as famílias exibidas. Ela não sustenta que “Grok 4.7 vence todos os modelos”. Fable lidera CursorBench, AA Briefcase, Terminal-Bench e HealthBench; GPT-5.6 Sol lidera DeepSWE. Preço, effort, harness, tokens e critérios de aprovação também variam.
Para programação, o ganho em Terminal-Bench é interessante porque representa trabalho de terminal de várias horas. Também é onde a vantagem de Fable é maior. Meça o critério de sucesso e as categorias de falha, não apenas a porcentagem agregada.
Qual evidência independente existe?
A Artificial Analysis já havia incluído o Grok 4.7 em xhigh na nossa verificação. A página mostrava Intelligence Index 46 e uso alto de saída: 240M tokens no índice, contra mediana de 92M na página.
É um retrato inicial. A velocidade de saída estava como N/A e os preços por provedor não estavam preenchidos de forma confiável. Portanto, ele não valida “mesma velocidade”, a variante Fast nem custo por tarefa. O resultado pode mudar quando a avaliação terminar ou a suite for atualizada.
- a evidência oficial mostra melhora consistente do 4.6 para o 4.7;
- uma suite independente já coloca xhigh na faixa frontier;
- não havia velocidade independente estável, p95 ou custo pareado com 4.6;
- seu workload continua sendo o teste decisivo.
Preço da API do Grok 4.7 e contexto longo
O Grok 4.7 mantém a mesma tabela global direta do Grok 4.6. O limite atual é abaixo de 200K contra 200K ou mais. Não calcule exatamente 200K pela tarifa padrão.
| Rota | Faixa do prompt | Entrada | Entrada em cache | Saída |
|---|---|---|---|---|
| xAI global | Abaixo de 200K | $2.00 | $0.50 | $6.00 |
| xAI global | 200K ou mais | $4.00 | $1.00 | $12.00 |
| xAI regional EUA | Abaixo de 200K | $2.20 | $0.55 | $6.60 |
| xAI regional EUA | 200K ou mais | $4.40 | $1.10 | $13.20 |
Todos os valores são USD por um milhão de tokens. O endpoint dos EUA mantém a inferência no país e acrescenta 10% ao preço. Tool calls, armazenamento, impostos, conversão e a cotação de uma plataforma terceira são separados.
| Workload | Cálculo | Custo de tokens do modelo |
|---|---|---|
| 100K entrada sem cache + 20K saída | 0.10 x $2 + 0.02 x $6 | $0.32 |
| 250K entrada sem cache + 20K saída | 0.25 x $4 + 0.02 x $12 | $1.24 |
| 50K sem cache + 200K em cache + 20K saída | 0.05 x $4 + 0.20 x $1 + 0.02 x $12 | $0.64 |
O preço de cache só se aplica quando o provedor registra um cache hit. A xAI recomenda prompt_cache_key em Responses ou x-grok-conv-id em Chat Completions para levar turnos relacionados ao mesmo servidor. Compactar contexto importa: repetir um prompt acima de 200K duplica as três tarifas.
Na variante Fast, leia a tabela
Grok 4.7 Fast é o mesmo modelo em infraestrutura mais rápida. Ele está disponível apenas no Cursor e Grok Build, não na API pública da xAI nem no plano gratuito do Grok Build.
A página de preços diz “duas vezes a tarifa padrão”, mas lista $4 / $1 / $12 abaixo de 200K e $6 / $1.50 / $18 a partir de 200K. A segunda linha é 1.5x a tarifa pública de contexto longo, não 2x. Cite a tabela em vez de deduzir pela frase e confira a cobrança ao vivo antes de uma execução grande. O Cursor cobra pelo próprio plano.
“Duas vezes a velocidade de saída” também é uma afirmação do provedor, não garantia de latência. Decode throughput exclui fila, prefill, primeiro token, ferramentas, rede e retries.
Detalhes da API importantes para agentes
A Responses API sempre devolve reasoning.encrypted_content com grok-4.7, mesmo sem pedido em include. Envie esses itens sem alteração no turno seguinte para preservar o estado de raciocínio do agente. Chat Completions não mudou.
Antes de migrar, verifique:
- ID realmente retornado e endpoint exato;
- o mesmo
reasoning_effortnas duas gerações; - schema de tool call e comportamento de retry;
- tokens de prompt, cache, reasoning e saída visível;
- primeiro token, latência total e custo por tarefa aceita;
- tamanho da saída, pois xhigh pode gastar mais tokens;
- rollback para
grok-4.6sem mudar o harness.
Exemplo direto com xAI Responses:
curl https://api.x.ai/v1/responses \
-H "Authorization: Bearer $XAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.7",
"prompt_cache_key": "repo-review-v1",
"input": "Review this patch, run the acceptance criteria, and report any remaining failure."
}'
Use uma cache key estável e não secreta; não inclua API key, e-mail, segredo de repositório ou ID de cliente. Esta base URL e credential são da conexão direta com xAI, não uma configuração da OmniaKey.
Onde o Grok 4.7 está disponível
| Plataforma | Estado em 22 de setembro de 2026 | Limite importante |
|---|---|---|
| xAI API | Disponível como grok-4.7 | Variante padrão; Fast não é API pública |
| Grok Build | Modelo padrão | Fast é pago e fica fora do free tier |
| Cursor | Disponível em todos os planos segundo a xAI | Cobrança do Fast segue o plano Cursor |
| GitHub Copilot | Rollout gradual anunciado | Pro, Pro+, Max, Business, Enterprise; policy de admin pode bloquear |
| OpenRouter, Vercel, Cloudflare | Listados pela xAI como gateways | Cada um controla rota, preço e disponibilidade |
| OmniaKey | Não listado na verificação | Consulte o catálogo de modelos ao vivo; não invente uma rota |
O GitHub cita VS Code, Visual Studio, Copilot CLI, cloud agent, Copilot app, JetBrains, Xcode e Eclipse. Rollout gradual não significa que todos os usuários vejam o seletor imediatamente.
Teste reproduzível de Grok 4.6 contra 4.7
Escolha de 20 a 50 tarefas da distribuição real de falhas, e não apenas prompts fáceis. Congele revisão do repositório, system prompt, ferramentas, permissões, effort, timeout e comandos de aceitação.
- aceita sem reparo, aceita após retry ou falha;
- erros de schema, edição incorreta, teste quebrado, recusa e loop;
- tokens de entrada, cache, reasoning e saída;
- latência de primeiro token e total em p50 e p95;
- ID retornado e valor total cobrado;
- minutos de revisão ou reparo humano.
Escolha o 4.7 se ele reduzir o custo por tarefa aceita ou falhas importantes. Mantenha o 4.6 se os resultados empatarem e sua rota for operacionalmente mais simples. Para outras famílias, use o guia de modelos para agentes de programação.
Erros comuns em uma análise do Grok 4.7
Chamar números do fornecedor de teste independente
As sete linhas são úteis, mas foram escolhidas e executadas pela SpaceXAI. Atribua a fonte e mantenha os níveis de effort visíveis.
Afirmar 2.1T parâmetros
O número circulou antes do lançamento, mas o anúncio e o contrato atual não o publicam. Só “new, larger base model” está confirmado.
Tratar 500K de contexto como grátis
É a capacidade máxima. Ao chegar a 200K tokens, a solicitação inteira entra na faixa direta mais cara.
Supor que Fast é um ID da API pública
É uma opção de serving no Cursor e Grok Build. A API pública documenta grok-4.7, não um slug Fast.
Supor que lançamento significa disponibilidade na OmniaKey
Lançamento do provedor e onboarding de gateway são eventos separados. Não havia rota pública 4.7 na OmniaKey na data da verificação.
Perguntas frequentes
Quando o Grok 4.7 foi lançado?
Em 21 de setembro de 2026. O ID direto da API é grok-4.7.
O Grok 4.7 é melhor que o Grok 4.6?
É o candidato mais forte para testar primeiro. A xAI relata resultado melhor em cada comparação exibida pelo mesmo preço direto. Ainda é necessário um teste pareado por causa de effort, tokens, ferramentas e falhas.
Quanto custa a API do Grok 4.7?
No endpoint global, abaixo de 200K custa $2 de entrada, $0.50 de cache e $6 de saída por milhão. A partir de 200K, custa $4, $1 e $12.
Qual é a janela de contexto do Grok 4.7?
500,000 tokens. O guia atual não define limite de saída em texto, mas limites de taxa, tempo e orçamento continuam valendo.
Quantos parâmetros o Grok 4.7 tem?
A SpaceXAI não publicou um número no anúncio nem na página do modelo. Apenas confirma uma base nova e maior que a do 4.6.
O Grok 4.7 aceita imagens e ferramentas?
Sim. Ele recebe texto e imagens, retorna texto e documenta function calling, structured output, web search, X search e code execution.
O Grok 4.7 está disponível na OmniaKey?
Não na verificação de 22 de setembro. O catálogo público mostrava Grok 4.6 e 4.5, mas não grok-4.7. Confira o catálogo ao vivo.
Fontes consultadas
- SpaceXAI: lançamento do Grok 4.7
- SpaceXAI: guia inicial do Grok 4.7
- SpaceXAI: página do modelo Grok 4.7
- SpaceXAI: preços da API
- SpaceXAI: notas de versão
- Artificial Analysis: Grok 4.7 xhigh
- GitHub: Grok 4.7 no Copilot
- OpenRouter: rota do Grok 4.7
- Catálogo ao vivo da OmniaKey
Verificado em 22 de setembro de 2026. Disponibilidade, scores dinâmicos, preços e rollouts podem mudar; confira as fontes primárias e o catálogo antes de migrar produção.