O modelo Jev agora está integrado e disponível · Boas-vindas
Blogue
Guia

Análise do Grok 4.7

O Grok 4.7 é uma atualização pelo mesmo preço que vale testar primeiro em agentes de programação e conhecimento de longa duração, mas os números da xAI não substituem um teste com seu workload.

13 min de leituraOmniaKey
Grok 4.7Grok 4.6preço da APIbenchmark de programaçãoanálise de modelo

Esta análise do Grok 4.7 chega a uma conclusão mais específica que as manchetes de lançamento. Para programação de longa duração, uso de ferramentas e trabalho profissional de conhecimento, faz sentido avaliar o 4.7 primeiro: ele melhora as sete linhas de Grok 4.6 publicadas pela xAI e mantém o preço padrão e o contexto de 500K. Isso não prova que seja um vencedor universal. A tabela oficial mistura níveis de reasoning effort e não executamos benchmark próprio com solicitações pagas.

A SpaceXAI lançou o grok-4.7 em 21 de setembro de 2026. A API pública da xAI já oferece o modelo, mas a OmniaKey não o listava no catálogo público em 22 de setembro. Até o catálogo ao vivo mudar, use o Grok 4.6 na OmniaKey ou um provedor que realmente exponha o ID exato do 4.7.

Dados verificados em 22 de setembro de 2026. As especificações e notas de benchmark vêm do anúncio e da documentação da SpaceXAI. A Artificial Analysis já mostrava um Intelligence Index inicial para xhigh, mas os campos de velocidade e preço por provedor ainda estavam incompletos. Não usamos preview privada, credenciais da xAI nem medição direta de latência. Resultados do fornecedor, evidência independente e nossa recomendação aparecem separados.

Veredito: o Grok 4.7 vale a pena?

Para novos agentes de longa duração, teste o 4.7 antes do 4.6. O sinal mais útil é a mudança de geração: a xAI relata números superiores para o 4.7 nas sete comparações diretas, com ganhos fortes em Terminal-Bench 4.0 e EEBench, sem aumentar a tarifa padrão por token.

Não migre só pela manchete. A tabela usa Grok 4.7 em xhigh, Grok 4.6 em high e os outros modelos frontier em max; o resultado DeepSWE do 4.7 ainda é marcado como high effort. A configuração pode mudar consumo, latência e comportamento.

Mantenha o 4.6 como rollback até seu teste passar. As duas gerações têm contexto de 500K e as mesmas tarifas diretas. Uma avaliação gradual custa menos que descobrir em produção uma regressão de tool call, recusa, verbosidade ou formato.

Lançamento e ficha técnica

ItemContrato do Grok 4.7
Data de lançamento21 de setembro de 2026
ID do modelo na APIgrok-4.7
Entrada / saídaTexto e imagem / texto
Janela de contexto500,000 tokens
Corte de conhecimentoMaio de 2026
Reasoning effortlow, medium, high (padrão), xhigh
APIsResponses API e Chat Completions
RecursosFunction calling, structured outputs, web search, X search, code execution
Batch APINão suportada
Preço global direto abaixo de 200K de prompt$2 entrada / $0.50 cache / $6 saída por 1M
Preço global direto a partir de 200K$4 entrada / $1 cache / $12 saída por 1M

Os 500K são capacidade, não uma franquia gratuita. Quando o prompt chega a 200K tokens, a xAI aplica o preço maior a todos os tokens da solicitação. O guia não define limite de saída em texto, mas rate limits, latência, orçamento e comportamento do endpoint ainda limitam workloads reais.

O que mudou em relação ao Grok 4.6

A SpaceXAI descreve um modelo-base novo e maior, um período mais longo de reinforcement learning com tarefas difíceis de várias horas, self-verification e gestão de contexto longo melhores, compreensão nativa do harness Grok Bot e uma nova pilha de safeguards.

São afirmações de lançamento, não uma auditoria independente da arquitetura. A empresa não publica contagem de parâmetros no anúncio nem no contrato atual do modelo.

DecisãoGrok 4.7Grok 4.6Efeito prático
Base / treinamentoNova base maior; RL mais longo em tarefas difíceisGeração anteriorMotivo plausível para retestar agentes longos
Preço direto padrão$2 / $0.50 / $6$2 / $0.50 / $6Sem adicional de tabela na atualização
Preço de contexto longo$4 / $1 / $12$4 / $1 / $12Mesma economia no limite de 200K
Contexto500K500KNão aumenta a capacidade
Reasoninglow a xhigh; high por padrãolow a xhigh; high por padrãoFixe o mesmo effort na comparação
BatchNão suportadoNão suportadoNão conte com desconto Batch
Foco do lançamentoCódigo, agentes, conhecimento, autoavaliaçãoCódigo e agentes longosConfiabilidade, não nova modalidade

O upgrade prático é desempenho declarado no mesmo preço de lista, não mais contexto ou token mais barato. O guia de preços da API do Grok 4.6 continua sendo a referência detalhada para a rota atualmente listada pela OmniaKey.

Benchmarks do Grok 4.7: como interpretar

Estes resultados são divulgados pela SpaceXAI e não foram reproduzidos pela OmniaKey. A empresa mostra 4.7 em xhigh, 4.6 em high, GPT-5.6 Sol em max e Fable 5.1 em max; o asterisco indica DeepSWE do 4.7 em high effort.

AvaliaçãoGrok 4.7Grok 4.6GPT-5.6 SolFable 5.14.7 vs. 4.6
CursorBench 4.046.3%40.4%41.7%51.8%+5.9 pp
DeepSWE v1.171.0%*65.2%72.7%70.0%+5.8 pp
EEBench64.0%53.0%39.4%56.4%+11.0 pp
AA Briefcase v1.11,6571,5461,4871,678+111 Elo
Terminal-Bench 4.038.0%20.3%37.3%57.9%+17.7 pp
Harvey Legal Agent Benchmark19.6%15.8%2.5%6.7%+3.8 pp
HealthBench Professional56.7%48.5%60.5%62.1%+8.2 pp

A tabela sustenta uma afirmação sólida: na configuração da xAI, o 4.7 melhora sobre o 4.6 em todas as famílias exibidas. Ela não sustenta que “Grok 4.7 vence todos os modelos”. Fable lidera CursorBench, AA Briefcase, Terminal-Bench e HealthBench; GPT-5.6 Sol lidera DeepSWE. Preço, effort, harness, tokens e critérios de aprovação também variam.

Para programação, o ganho em Terminal-Bench é interessante porque representa trabalho de terminal de várias horas. Também é onde a vantagem de Fable é maior. Meça o critério de sucesso e as categorias de falha, não apenas a porcentagem agregada.

Qual evidência independente existe?

A Artificial Analysis já havia incluído o Grok 4.7 em xhigh na nossa verificação. A página mostrava Intelligence Index 46 e uso alto de saída: 240M tokens no índice, contra mediana de 92M na página.

É um retrato inicial. A velocidade de saída estava como N/A e os preços por provedor não estavam preenchidos de forma confiável. Portanto, ele não valida “mesma velocidade”, a variante Fast nem custo por tarefa. O resultado pode mudar quando a avaliação terminar ou a suite for atualizada.

  • a evidência oficial mostra melhora consistente do 4.6 para o 4.7;
  • uma suite independente já coloca xhigh na faixa frontier;
  • não havia velocidade independente estável, p95 ou custo pareado com 4.6;
  • seu workload continua sendo o teste decisivo.

Preço da API do Grok 4.7 e contexto longo

O Grok 4.7 mantém a mesma tabela global direta do Grok 4.6. O limite atual é abaixo de 200K contra 200K ou mais. Não calcule exatamente 200K pela tarifa padrão.

RotaFaixa do promptEntradaEntrada em cacheSaída
xAI globalAbaixo de 200K$2.00$0.50$6.00
xAI global200K ou mais$4.00$1.00$12.00
xAI regional EUAAbaixo de 200K$2.20$0.55$6.60
xAI regional EUA200K ou mais$4.40$1.10$13.20

Todos os valores são USD por um milhão de tokens. O endpoint dos EUA mantém a inferência no país e acrescenta 10% ao preço. Tool calls, armazenamento, impostos, conversão e a cotação de uma plataforma terceira são separados.

WorkloadCálculoCusto de tokens do modelo
100K entrada sem cache + 20K saída0.10 x $2 + 0.02 x $6$0.32
250K entrada sem cache + 20K saída0.25 x $4 + 0.02 x $12$1.24
50K sem cache + 200K em cache + 20K saída0.05 x $4 + 0.20 x $1 + 0.02 x $12$0.64

O preço de cache só se aplica quando o provedor registra um cache hit. A xAI recomenda prompt_cache_key em Responses ou x-grok-conv-id em Chat Completions para levar turnos relacionados ao mesmo servidor. Compactar contexto importa: repetir um prompt acima de 200K duplica as três tarifas.

Na variante Fast, leia a tabela

Grok 4.7 Fast é o mesmo modelo em infraestrutura mais rápida. Ele está disponível apenas no Cursor e Grok Build, não na API pública da xAI nem no plano gratuito do Grok Build.

A página de preços diz “duas vezes a tarifa padrão”, mas lista $4 / $1 / $12 abaixo de 200K e $6 / $1.50 / $18 a partir de 200K. A segunda linha é 1.5x a tarifa pública de contexto longo, não 2x. Cite a tabela em vez de deduzir pela frase e confira a cobrança ao vivo antes de uma execução grande. O Cursor cobra pelo próprio plano.

“Duas vezes a velocidade de saída” também é uma afirmação do provedor, não garantia de latência. Decode throughput exclui fila, prefill, primeiro token, ferramentas, rede e retries.

Detalhes da API importantes para agentes

A Responses API sempre devolve reasoning.encrypted_content com grok-4.7, mesmo sem pedido em include. Envie esses itens sem alteração no turno seguinte para preservar o estado de raciocínio do agente. Chat Completions não mudou.

Antes de migrar, verifique:

  1. ID realmente retornado e endpoint exato;
  2. o mesmo reasoning_effort nas duas gerações;
  3. schema de tool call e comportamento de retry;
  4. tokens de prompt, cache, reasoning e saída visível;
  5. primeiro token, latência total e custo por tarefa aceita;
  6. tamanho da saída, pois xhigh pode gastar mais tokens;
  7. rollback para grok-4.6 sem mudar o harness.

Exemplo direto com xAI Responses:

bash
curl https://api.x.ai/v1/responses \
  -H "Authorization: Bearer $XAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.7",
    "prompt_cache_key": "repo-review-v1",
    "input": "Review this patch, run the acceptance criteria, and report any remaining failure."
  }'

Use uma cache key estável e não secreta; não inclua API key, e-mail, segredo de repositório ou ID de cliente. Esta base URL e credential são da conexão direta com xAI, não uma configuração da OmniaKey.

Onde o Grok 4.7 está disponível

PlataformaEstado em 22 de setembro de 2026Limite importante
xAI APIDisponível como grok-4.7Variante padrão; Fast não é API pública
Grok BuildModelo padrãoFast é pago e fica fora do free tier
CursorDisponível em todos os planos segundo a xAICobrança do Fast segue o plano Cursor
GitHub CopilotRollout gradual anunciadoPro, Pro+, Max, Business, Enterprise; policy de admin pode bloquear
OpenRouter, Vercel, CloudflareListados pela xAI como gatewaysCada um controla rota, preço e disponibilidade
OmniaKeyNão listado na verificaçãoConsulte o catálogo de modelos ao vivo; não invente uma rota

O GitHub cita VS Code, Visual Studio, Copilot CLI, cloud agent, Copilot app, JetBrains, Xcode e Eclipse. Rollout gradual não significa que todos os usuários vejam o seletor imediatamente.

Teste reproduzível de Grok 4.6 contra 4.7

Escolha de 20 a 50 tarefas da distribuição real de falhas, e não apenas prompts fáceis. Congele revisão do repositório, system prompt, ferramentas, permissões, effort, timeout e comandos de aceitação.

  • aceita sem reparo, aceita após retry ou falha;
  • erros de schema, edição incorreta, teste quebrado, recusa e loop;
  • tokens de entrada, cache, reasoning e saída;
  • latência de primeiro token e total em p50 e p95;
  • ID retornado e valor total cobrado;
  • minutos de revisão ou reparo humano.

Escolha o 4.7 se ele reduzir o custo por tarefa aceita ou falhas importantes. Mantenha o 4.6 se os resultados empatarem e sua rota for operacionalmente mais simples. Para outras famílias, use o guia de modelos para agentes de programação.

Erros comuns em uma análise do Grok 4.7

Chamar números do fornecedor de teste independente

As sete linhas são úteis, mas foram escolhidas e executadas pela SpaceXAI. Atribua a fonte e mantenha os níveis de effort visíveis.

Afirmar 2.1T parâmetros

O número circulou antes do lançamento, mas o anúncio e o contrato atual não o publicam. Só “new, larger base model” está confirmado.

Tratar 500K de contexto como grátis

É a capacidade máxima. Ao chegar a 200K tokens, a solicitação inteira entra na faixa direta mais cara.

Supor que Fast é um ID da API pública

É uma opção de serving no Cursor e Grok Build. A API pública documenta grok-4.7, não um slug Fast.

Supor que lançamento significa disponibilidade na OmniaKey

Lançamento do provedor e onboarding de gateway são eventos separados. Não havia rota pública 4.7 na OmniaKey na data da verificação.

Perguntas frequentes

Quando o Grok 4.7 foi lançado?

Em 21 de setembro de 2026. O ID direto da API é grok-4.7.

O Grok 4.7 é melhor que o Grok 4.6?

É o candidato mais forte para testar primeiro. A xAI relata resultado melhor em cada comparação exibida pelo mesmo preço direto. Ainda é necessário um teste pareado por causa de effort, tokens, ferramentas e falhas.

Quanto custa a API do Grok 4.7?

No endpoint global, abaixo de 200K custa $2 de entrada, $0.50 de cache e $6 de saída por milhão. A partir de 200K, custa $4, $1 e $12.

Qual é a janela de contexto do Grok 4.7?

500,000 tokens. O guia atual não define limite de saída em texto, mas limites de taxa, tempo e orçamento continuam valendo.

Quantos parâmetros o Grok 4.7 tem?

A SpaceXAI não publicou um número no anúncio nem na página do modelo. Apenas confirma uma base nova e maior que a do 4.6.

O Grok 4.7 aceita imagens e ferramentas?

Sim. Ele recebe texto e imagens, retorna texto e documenta function calling, structured output, web search, X search e code execution.

O Grok 4.7 está disponível na OmniaKey?

Não na verificação de 22 de setembro. O catálogo público mostrava Grok 4.6 e 4.5, mas não grok-4.7. Confira o catálogo ao vivo.

Fontes consultadas

Verificado em 22 de setembro de 2026. Disponibilidade, scores dinâmicos, preços e rollouts podem mudar; confira as fontes primárias e o catálogo antes de migrar produção.