Il modello Jev è ora integrato e disponibile · Benvenuto
Blog
Guida

Recensione di Grok 4.7

Grok 4.7 è un aggiornamento allo stesso prezzo da provare per primo negli agenti di coding e knowledge work di lunga durata, ma i risultati xAI non sostituiscono un test sul proprio carico.

13 min di letturaOmniaKey
Grok 4.7Grok 4.6prezzi APIbenchmark di codingrecensione modello

Questa recensione di Grok 4.7 arriva a una conclusione più circoscritta dei titoli di lancio. Per coding di lunga durata, uso di strumenti e knowledge work professionale, conviene valutare prima 4.7: migliora tutte le sette righe di confronto con Grok 4.6 pubblicate da xAI, mantenendo invariati prezzo API standard e contesto di 500K. Non dimostra di essere un vincitore universale. La tabella ufficiale mescola livelli di reasoning effort e non abbiamo eseguito un benchmark diretto con richieste a pagamento.

SpaceXAI ha rilasciato grok-4.7 il 21 settembre 2026. L'API pubblica xAI lo offre, ma il catalogo pubblico OmniaKey non lo elencava al controllo del 22 settembre. Finché il catalogo live non cambia, usa Grok 4.6 su OmniaKey oppure un provider che esponga realmente l'ID esatto di 4.7.

Dati verificati il 22 settembre 2026. Specifiche e benchmark di lancio provengono dall'annuncio e dalla documentazione developer di SpaceXAI. Artificial Analysis aveva pubblicato un primo Intelligence Index in xhigh, ma velocità e prezzi dei provider erano incompleti. Non abbiamo usato preview private, credenziali xAI o misure dirette della latenza. Risultati del vendor, prove indipendenti e nostra raccomandazione restano separati.

Verdetto della recensione Grok 4.7

Per nuovi agenti di lunga durata, prova 4.7 prima di 4.6. Il segnale più utile è il salto generazionale: xAI riporta risultati superiori per 4.7 in tutti i sette confronti diretti, con forti aumenti in Terminal-Bench 4.0 ed EEBench senza rialzare la tariffa standard per token.

Non migrare soltanto per il titolo del lancio. La tabella usa Grok 4.7 in xhigh, Grok 4.6 in high e gli altri modelli frontier in max; il risultato DeepSWE di 4.7 è inoltre segnato high effort. L'impostazione cambia consumo, latenza e comportamento.

Mantieni 4.6 come rollback finché i tuoi task non passano. Entrambe le generazioni offrono contesto 500K e gli stessi prezzi diretti. Una valutazione graduale costa meno che scoprire in produzione una regressione di tool call, rifiuto, verbosità o formato.

Data di uscita e specifiche principali

VoceContratto di Grok 4.7
Data di uscita21 settembre 2026
ID modello APIgrok-4.7
Input / outputTesto e immagini / testo
Finestra di contesto500,000 tokens
Knowledge cutoffMaggio 2026
Reasoning effortlow, medium, high (predefinito), xhigh
APIResponses API e Chat Completions
FunzioniFunction calling, structured outputs, web search, X search, code execution
Batch APINon supportata
Prezzo globale diretto sotto 200K di prompt$2 input / $0.50 cache / $6 output per 1M
Prezzo globale diretto da 200K in su$4 input / $1 cache / $12 output per 1M

I 500K indicano capacità, non una quota gratuita. Quando il prompt raggiunge 200K tokens, xAI applica il prezzo superiore a tutti i token della richiesta. La start guide non indica un limite di text output, ma rate limits, latenza, budget ed endpoint vincolano comunque i workload reali.

Cosa cambia rispetto a Grok 4.6

SpaceXAI descrive un nuovo base model più grande, reinforcement learning più lungo con compiti difficili di varie ore, self-verification e gestione del contesto lungo migliori, comprensione native dell'harness Grok Bot e un nuovo stack di safeguards.

Sono dichiarazioni di lancio, non risultati architetturali verificati in modo indipendente. L'azienda non pubblica il numero di parametri nell'annuncio o nel contratto attuale del modello.

DecisioneGrok 4.7Grok 4.6Significato
Base / trainingNuova base più grande; RL più lungo su task difficiliGenerazione precedenteMotivo plausibile per ritestare agenti lunghi
Prezzo diretto standard$2 / $0.50 / $6$2 / $0.50 / $6Nessun sovrapprezzo di listino
Prezzo long context$4 / $1 / $12$4 / $1 / $12Stessa economia alla soglia 200K
Contesto500K500KNessun aumento della capacità
Reasoninglow–xhigh; high predefinitolow–xhigh; high predefinitoFissa lo stesso effort nel confronto
BatchNon supportataNon supportataNon prevedere uno sconto Batch
Focus del lancioCoding, agenti, knowledge work, autocontrolloCoding e agenti lunghiAffidabilità, non nuova modalità

L'upgrade pratico è la performance dichiarata allo stesso prezzo, non più contesto o token più economici. La guida ai prezzi API di Grok 4.6 resta il riferimento di budget dettagliato per la route attualmente elencata su OmniaKey.

Benchmark di Grok 4.7: come interpretarli

Questi risultati sono riportati da SpaceXAI e non riprodotti da OmniaKey. Il publisher mostra 4.7 in xhigh, 4.6 in high, GPT-5.6 Sol in max e Fable 5.1 in max; l'asterisco indica DeepSWE 4.7 in high effort.

ValutazioneGrok 4.7Grok 4.6GPT-5.6 SolFable 5.14.7 vs 4.6
CursorBench 4.046.3%40.4%41.7%51.8%+5.9 pp
DeepSWE v1.171.0%*65.2%72.7%70.0%+5.8 pp
EEBench64.0%53.0%39.4%56.4%+11.0 pp
AA Briefcase v1.11,6571,5461,4871,678+111 Elo
Terminal-Bench 4.038.0%20.3%37.3%57.9%+17.7 pp
Harvey Legal Agent Benchmark19.6%15.8%2.5%6.7%+3.8 pp
HealthBench Professional56.7%48.5%60.5%62.1%+8.2 pp

La tabella supporta una sola conclusione robusta: nel setup di xAI, 4.7 migliora rispetto a 4.6 in ogni famiglia mostrata. Non dimostra che “Grok 4.7 batte ogni modello”. Fable guida CursorBench, AA Briefcase, Terminal-Bench e HealthBench; GPT-5.6 Sol guida DeepSWE. Anche prezzo, effort, harness, token e criteri di accettazione differiscono.

Per il coding, l'aumento su Terminal-Bench è interessante perché misura lavoro da terminale lungo varie ore. È anche dove il vantaggio di Fable è maggiore. Misura criteri di successo e categorie di errore, non solo la percentuale aggregata.

Quali prove indipendenti esistono?

Artificial Analysis aveva già aggiunto Grok 4.7 in xhigh al momento della verifica. La pagina mostrava un Intelligence Index di 46 e un uso elevato dell'output: 240M tokens nell'index contro una mediana di pagina di 92M.

È uno snapshot iniziale. La velocità di output era N/A e i prezzi provider non erano compilati in modo affidabile. Non lo usiamo quindi per validare “stessa velocità”, la variante Fast o il costo per task. Il risultato può cambiare al completamento della valutazione o con modifiche alla suite.

  • i dati ufficiali mostrano un miglioramento coerente da 4.6 a 4.7;
  • una suite indipendente colloca già xhigh nella fascia frontier;
  • mancavano velocità indipendente stabile, p95 latency e confronto di costo appaiato con 4.6;
  • il tuo workload resta il test decisivo.

Prezzi API di Grok 4.7 e contesto lungo

Grok 4.7 mantiene lo stesso listino globale diretto di Grok 4.6. La soglia attuale distingue meno di 200K e 200K o più. Esattamente 200K non rientra nel prezzo standard.

RouteIntervallo promptInputCached inputOutput
xAI globalMeno di 200K$2.00$0.50$6.00
xAI global200K o più$4.00$1.00$12.00
xAI US regionalMeno di 200K$2.20$0.55$6.60
xAI US regional200K o più$4.40$1.10$13.20

Tutti i valori sono USD per un milione di tokens. L'endpoint USA mantiene l'inference negli Stati Uniti e aggiunge il 10% ai prezzi. Tool calls, storage, imposte, conversione e preventivo di una piattaforma terza sono separati.

WorkloadCalcoloCosto token del modello
100K uncached input + 20K output0.10 x $2 + 0.02 x $6$0.32
250K uncached input + 20K output0.25 x $4 + 0.02 x $12$1.24
50K uncached + 200K cached + 20K output0.05 x $4 + 0.20 x $1 + 0.02 x $12$0.64

Il prezzo cache vale solo quando il provider segnala un cache hit. xAI consiglia prompt_cache_key su Responses o x-grok-conv-id su Chat Completions per inviare turn correlati allo stesso server. La context compaction conta nei tool loop lunghi: ripetere un prompt da 200K o più raddoppia tutte e tre le tariffe.

Per Fast, leggi la tabella dei prezzi

Grok 4.7 Fast è lo stesso modello su infrastructure più veloce. È disponibile solo in Cursor e Grok Build, non nella public API xAI né nel free tier di Grok Build.

La pagina prezzi definisce Fast “due volte la tariffa standard”, ma elenca $4 / $1 / $12 sotto 200K e $6 / $1.50 / $18 da 200K. La seconda riga equivale a 1.5x la tariffa public long-context, non 2x. Cita la tabella invece di ricavare il prezzo dalla frase e controlla la fattura live prima di un volume elevato. Cursor fattura tramite il proprio plan.

Anche “due volte la velocità di output” è una dichiarazione del provider, non una garanzia di latenza. Il decode throughput esclude coda, prompt prefill, time to first token, strumenti, rete e retries.

Dettagli API importanti per un agente

La Responses API restituisce sempre reasoning.encrypted_content con grok-4.7, anche se include non lo richiede. Rimanda questi reasoning items senza modificarli nel turno successivo per mantenere lo stato dell'agente multi-turn. Chat Completions non cambia.

Prima della migrazione verifica:

  1. ID realmente restituito ed endpoint esatto;
  2. stesso reasoning_effort per entrambe le generazioni;
  3. validità dello schema di tool call e comportamento dei retry;
  4. token di prompt, cache, reasoning e output visibile;
  5. primo token, latenza totale e costo per task accettato;
  6. output length, perché xhigh può usare più token;
  7. rollback a grok-4.6 senza cambiare harness.

Esempio diretto con xAI Responses:

bash
curl https://api.x.ai/v1/responses \
  -H "Authorization: Bearer $XAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.7",
    "prompt_cache_key": "repo-review-v1",
    "input": "Review this patch, run the acceptance criteria, and report any remaining failure."
  }'

Usa una cache key stabile e non segreta; non inserire API key, e-mail, repository secret o ID cliente. Base URL e credential sono per xAI diretto, non una configurazione OmniaKey.

Dove è disponibile Grok 4.7

PiattaformaStato al 22 settembre 2026Limite importante
xAI APIDisponibile come grok-4.7Variante standard; Fast non è public API
Grok BuildModello predefinitoFast è a pagamento e fuori dal free tier
CursorDisponibile su tutti i plan secondo xAILa fatturazione Fast segue il piano Cursor
GitHub CopilotRollout graduale annunciatoPro, Pro+, Max, Business, Enterprise; admin policy può disabilitarlo
OpenRouter, Vercel, CloudflareIndicati da xAI come gatewayOgnuno gestisce route, prezzo e disponibilità
OmniaKeyNon elencato alla verificaControlla il catalogo modelli live; non inventare una route

GitHub include VS Code, Visual Studio, Copilot CLI, cloud agent, Copilot app, JetBrains, Xcode ed Eclipse. Un rollout graduale non significa che ogni account veda subito il modello.

Confronto riproducibile tra Grok 4.6 e 4.7

Scegli da 20 a 50 task dalla distribuzione reale degli errori, non solo prompt facili. Fissa repository revision, system prompt, tools, permissions, effort, timeout e acceptance commands.

  • accettato senza riparazione, dopo retry o fallito;
  • errori di schema, modifiche errate, test failure, rifiuti e loop;
  • input, cached input, reasoning e output tokens;
  • first-token ed end-to-end latency a p50 e p95;
  • model ID restituito e totale fatturato;
  • minuti di review o riparazione umana.

Scegli 4.7 se migliora il costo per task accettato o riduce errori importanti. Mantieni 4.6 se i risultati sono equivalenti e la route esistente è più semplice da gestire. Per confrontare famiglie, usa la guida ai modelli per coding agent.

Errori comuni nelle recensioni di Grok 4.7

Chiamare indipendenti i risultati del vendor

Le sette righe sono utili, ma SpaceXAI le ha scelte ed eseguite. Attribuisci la fonte e mostra i livelli di effort.

Dichiarare 2.1T parametri come fatto

La cifra circolava prima dell'uscita, ma non compare nell'annuncio o nel developer contract corrente. È confermato solo “new, larger base model”.

Trattare il contesto 500K come gratuito

È la capacità massima del prompt. A 200K tokens l'intera richiesta entra nella fascia diretta più costosa.

Presumere che Fast sia un ID API pubblico

È un'opzione di serving in Cursor e Grok Build. La public API documenta grok-4.7, non uno slug Fast.

Confondere lancio e disponibilità OmniaKey

Il rilascio del provider e l'onboarding del gateway sono separati. Alla data di verifica non esisteva una route pubblica OmniaKey 4.7.

Domande frequenti

Quando è uscito Grok 4.7?

Il 21 settembre 2026. L'ID diretto del modello API è grok-4.7.

Grok 4.7 è migliore di Grok 4.6?

È il candidato più forte da provare per primo. xAI riporta risultati superiori in ogni confronto mostrato allo stesso prezzo diretto. Serve comunque un test appaiato per effort, token, tools e tipi di errore.

Quanto costa l'API di Grok 4.7?

Sull'endpoint globale, sotto 200K costa $2 input, $0.50 cache e $6 output per milione. Da 200K costa $4, $1 e $12.

Qual è la finestra di contesto?

500,000 tokens. La guida attuale non indica un limite di text output, ma restano limiti di rate, tempo e budget.

Quanti parametri ha Grok 4.7?

SpaceXAI non pubblica una cifra nell'annuncio o nella pagina developer. Conferma soltanto una nuova base più grande di quella di 4.6.

Supporta immagini e strumenti?

Sì. Accetta testo e immagini, produce testo e documenta function calling, structured output, web search, X search e code execution.

Grok 4.7 è disponibile su OmniaKey?

Non al controllo del 22 settembre. Il catalogo pubblico mostrava Grok 4.6 e 4.5, ma non grok-4.7. Consulta il catalogo live.

Fonti verificate

Verificato il 22 settembre 2026. Disponibilità, score dinamici, prezzi e rollout possono cambiare; ricontrolla fonti primarie e catalogo prima di una migrazione production.