Recensione di Grok 4.7
Grok 4.7 è un aggiornamento allo stesso prezzo da provare per primo negli agenti di coding e knowledge work di lunga durata, ma i risultati xAI non sostituiscono un test sul proprio carico.
Questa recensione di Grok 4.7 arriva a una conclusione più circoscritta dei titoli di lancio. Per coding di lunga durata, uso di strumenti e knowledge work professionale, conviene valutare prima 4.7: migliora tutte le sette righe di confronto con Grok 4.6 pubblicate da xAI, mantenendo invariati prezzo API standard e contesto di 500K. Non dimostra di essere un vincitore universale. La tabella ufficiale mescola livelli di reasoning effort e non abbiamo eseguito un benchmark diretto con richieste a pagamento.
SpaceXAI ha rilasciato grok-4.7 il 21 settembre 2026. L'API pubblica xAI lo offre, ma il catalogo pubblico OmniaKey non lo elencava al controllo del 22 settembre. Finché il catalogo live non cambia, usa Grok 4.6 su OmniaKey oppure un provider che esponga realmente l'ID esatto di 4.7.
Dati verificati il 22 settembre 2026. Specifiche e benchmark di lancio provengono dall'annuncio e dalla documentazione developer di SpaceXAI. Artificial Analysis aveva pubblicato un primo Intelligence Index in xhigh, ma velocità e prezzi dei provider erano incompleti. Non abbiamo usato preview private, credenziali xAI o misure dirette della latenza. Risultati del vendor, prove indipendenti e nostra raccomandazione restano separati.
Verdetto della recensione Grok 4.7
Per nuovi agenti di lunga durata, prova 4.7 prima di 4.6. Il segnale più utile è il salto generazionale: xAI riporta risultati superiori per 4.7 in tutti i sette confronti diretti, con forti aumenti in Terminal-Bench 4.0 ed EEBench senza rialzare la tariffa standard per token.
Non migrare soltanto per il titolo del lancio. La tabella usa Grok 4.7 in xhigh, Grok 4.6 in high e gli altri modelli frontier in max; il risultato DeepSWE di 4.7 è inoltre segnato high effort. L'impostazione cambia consumo, latenza e comportamento.
Mantieni 4.6 come rollback finché i tuoi task non passano. Entrambe le generazioni offrono contesto 500K e gli stessi prezzi diretti. Una valutazione graduale costa meno che scoprire in produzione una regressione di tool call, rifiuto, verbosità o formato.
Data di uscita e specifiche principali
| Voce | Contratto di Grok 4.7 |
|---|---|
| Data di uscita | 21 settembre 2026 |
| ID modello API | grok-4.7 |
| Input / output | Testo e immagini / testo |
| Finestra di contesto | 500,000 tokens |
| Knowledge cutoff | Maggio 2026 |
| Reasoning effort | low, medium, high (predefinito), xhigh |
| API | Responses API e Chat Completions |
| Funzioni | Function calling, structured outputs, web search, X search, code execution |
| Batch API | Non supportata |
| Prezzo globale diretto sotto 200K di prompt | $2 input / $0.50 cache / $6 output per 1M |
| Prezzo globale diretto da 200K in su | $4 input / $1 cache / $12 output per 1M |
I 500K indicano capacità, non una quota gratuita. Quando il prompt raggiunge 200K tokens, xAI applica il prezzo superiore a tutti i token della richiesta. La start guide non indica un limite di text output, ma rate limits, latenza, budget ed endpoint vincolano comunque i workload reali.
Cosa cambia rispetto a Grok 4.6
SpaceXAI descrive un nuovo base model più grande, reinforcement learning più lungo con compiti difficili di varie ore, self-verification e gestione del contesto lungo migliori, comprensione native dell'harness Grok Bot e un nuovo stack di safeguards.
Sono dichiarazioni di lancio, non risultati architetturali verificati in modo indipendente. L'azienda non pubblica il numero di parametri nell'annuncio o nel contratto attuale del modello.
| Decisione | Grok 4.7 | Grok 4.6 | Significato |
|---|---|---|---|
| Base / training | Nuova base più grande; RL più lungo su task difficili | Generazione precedente | Motivo plausibile per ritestare agenti lunghi |
| Prezzo diretto standard | $2 / $0.50 / $6 | $2 / $0.50 / $6 | Nessun sovrapprezzo di listino |
| Prezzo long context | $4 / $1 / $12 | $4 / $1 / $12 | Stessa economia alla soglia 200K |
| Contesto | 500K | 500K | Nessun aumento della capacità |
| Reasoning | low–xhigh; high predefinito | low–xhigh; high predefinito | Fissa lo stesso effort nel confronto |
| Batch | Non supportata | Non supportata | Non prevedere uno sconto Batch |
| Focus del lancio | Coding, agenti, knowledge work, autocontrollo | Coding e agenti lunghi | Affidabilità, non nuova modalità |
L'upgrade pratico è la performance dichiarata allo stesso prezzo, non più contesto o token più economici. La guida ai prezzi API di Grok 4.6 resta il riferimento di budget dettagliato per la route attualmente elencata su OmniaKey.
Benchmark di Grok 4.7: come interpretarli
Questi risultati sono riportati da SpaceXAI e non riprodotti da OmniaKey. Il publisher mostra 4.7 in xhigh, 4.6 in high, GPT-5.6 Sol in max e Fable 5.1 in max; l'asterisco indica DeepSWE 4.7 in high effort.
| Valutazione | Grok 4.7 | Grok 4.6 | GPT-5.6 Sol | Fable 5.1 | 4.7 vs 4.6 |
|---|---|---|---|---|---|
| CursorBench 4.0 | 46.3% | 40.4% | 41.7% | 51.8% | +5.9 pp |
| DeepSWE v1.1 | 71.0%* | 65.2% | 72.7% | 70.0% | +5.8 pp |
| EEBench | 64.0% | 53.0% | 39.4% | 56.4% | +11.0 pp |
| AA Briefcase v1.1 | 1,657 | 1,546 | 1,487 | 1,678 | +111 Elo |
| Terminal-Bench 4.0 | 38.0% | 20.3% | 37.3% | 57.9% | +17.7 pp |
| Harvey Legal Agent Benchmark | 19.6% | 15.8% | 2.5% | 6.7% | +3.8 pp |
| HealthBench Professional | 56.7% | 48.5% | 60.5% | 62.1% | +8.2 pp |
La tabella supporta una sola conclusione robusta: nel setup di xAI, 4.7 migliora rispetto a 4.6 in ogni famiglia mostrata. Non dimostra che “Grok 4.7 batte ogni modello”. Fable guida CursorBench, AA Briefcase, Terminal-Bench e HealthBench; GPT-5.6 Sol guida DeepSWE. Anche prezzo, effort, harness, token e criteri di accettazione differiscono.
Per il coding, l'aumento su Terminal-Bench è interessante perché misura lavoro da terminale lungo varie ore. È anche dove il vantaggio di Fable è maggiore. Misura criteri di successo e categorie di errore, non solo la percentuale aggregata.
Quali prove indipendenti esistono?
Artificial Analysis aveva già aggiunto Grok 4.7 in xhigh al momento della verifica. La pagina mostrava un Intelligence Index di 46 e un uso elevato dell'output: 240M tokens nell'index contro una mediana di pagina di 92M.
È uno snapshot iniziale. La velocità di output era N/A e i prezzi provider non erano compilati in modo affidabile. Non lo usiamo quindi per validare “stessa velocità”, la variante Fast o il costo per task. Il risultato può cambiare al completamento della valutazione o con modifiche alla suite.
- i dati ufficiali mostrano un miglioramento coerente da 4.6 a 4.7;
- una suite indipendente colloca già xhigh nella fascia frontier;
- mancavano velocità indipendente stabile, p95 latency e confronto di costo appaiato con 4.6;
- il tuo workload resta il test decisivo.
Prezzi API di Grok 4.7 e contesto lungo
Grok 4.7 mantiene lo stesso listino globale diretto di Grok 4.6. La soglia attuale distingue meno di 200K e 200K o più. Esattamente 200K non rientra nel prezzo standard.
| Route | Intervallo prompt | Input | Cached input | Output |
|---|---|---|---|---|
| xAI global | Meno di 200K | $2.00 | $0.50 | $6.00 |
| xAI global | 200K o più | $4.00 | $1.00 | $12.00 |
| xAI US regional | Meno di 200K | $2.20 | $0.55 | $6.60 |
| xAI US regional | 200K o più | $4.40 | $1.10 | $13.20 |
Tutti i valori sono USD per un milione di tokens. L'endpoint USA mantiene l'inference negli Stati Uniti e aggiunge il 10% ai prezzi. Tool calls, storage, imposte, conversione e preventivo di una piattaforma terza sono separati.
| Workload | Calcolo | Costo token del modello |
|---|---|---|
| 100K uncached input + 20K output | 0.10 x $2 + 0.02 x $6 | $0.32 |
| 250K uncached input + 20K output | 0.25 x $4 + 0.02 x $12 | $1.24 |
| 50K uncached + 200K cached + 20K output | 0.05 x $4 + 0.20 x $1 + 0.02 x $12 | $0.64 |
Il prezzo cache vale solo quando il provider segnala un cache hit. xAI consiglia prompt_cache_key su Responses o x-grok-conv-id su Chat Completions per inviare turn correlati allo stesso server. La context compaction conta nei tool loop lunghi: ripetere un prompt da 200K o più raddoppia tutte e tre le tariffe.
Per Fast, leggi la tabella dei prezzi
Grok 4.7 Fast è lo stesso modello su infrastructure più veloce. È disponibile solo in Cursor e Grok Build, non nella public API xAI né nel free tier di Grok Build.
La pagina prezzi definisce Fast “due volte la tariffa standard”, ma elenca $4 / $1 / $12 sotto 200K e $6 / $1.50 / $18 da 200K. La seconda riga equivale a 1.5x la tariffa public long-context, non 2x. Cita la tabella invece di ricavare il prezzo dalla frase e controlla la fattura live prima di un volume elevato. Cursor fattura tramite il proprio plan.
Anche “due volte la velocità di output” è una dichiarazione del provider, non una garanzia di latenza. Il decode throughput esclude coda, prompt prefill, time to first token, strumenti, rete e retries.
Dettagli API importanti per un agente
La Responses API restituisce sempre reasoning.encrypted_content con grok-4.7, anche se include non lo richiede. Rimanda questi reasoning items senza modificarli nel turno successivo per mantenere lo stato dell'agente multi-turn. Chat Completions non cambia.
Prima della migrazione verifica:
- ID realmente restituito ed endpoint esatto;
- stesso
reasoning_effortper entrambe le generazioni; - validità dello schema di tool call e comportamento dei retry;
- token di prompt, cache, reasoning e output visibile;
- primo token, latenza totale e costo per task accettato;
- output length, perché xhigh può usare più token;
- rollback a
grok-4.6senza cambiare harness.
Esempio diretto con xAI Responses:
curl https://api.x.ai/v1/responses \
-H "Authorization: Bearer $XAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.7",
"prompt_cache_key": "repo-review-v1",
"input": "Review this patch, run the acceptance criteria, and report any remaining failure."
}'
Usa una cache key stabile e non segreta; non inserire API key, e-mail, repository secret o ID cliente. Base URL e credential sono per xAI diretto, non una configurazione OmniaKey.
Dove è disponibile Grok 4.7
| Piattaforma | Stato al 22 settembre 2026 | Limite importante |
|---|---|---|
| xAI API | Disponibile come grok-4.7 | Variante standard; Fast non è public API |
| Grok Build | Modello predefinito | Fast è a pagamento e fuori dal free tier |
| Cursor | Disponibile su tutti i plan secondo xAI | La fatturazione Fast segue il piano Cursor |
| GitHub Copilot | Rollout graduale annunciato | Pro, Pro+, Max, Business, Enterprise; admin policy può disabilitarlo |
| OpenRouter, Vercel, Cloudflare | Indicati da xAI come gateway | Ognuno gestisce route, prezzo e disponibilità |
| OmniaKey | Non elencato alla verifica | Controlla il catalogo modelli live; non inventare una route |
GitHub include VS Code, Visual Studio, Copilot CLI, cloud agent, Copilot app, JetBrains, Xcode ed Eclipse. Un rollout graduale non significa che ogni account veda subito il modello.
Confronto riproducibile tra Grok 4.6 e 4.7
Scegli da 20 a 50 task dalla distribuzione reale degli errori, non solo prompt facili. Fissa repository revision, system prompt, tools, permissions, effort, timeout e acceptance commands.
- accettato senza riparazione, dopo retry o fallito;
- errori di schema, modifiche errate, test failure, rifiuti e loop;
- input, cached input, reasoning e output tokens;
- first-token ed end-to-end latency a p50 e p95;
- model ID restituito e totale fatturato;
- minuti di review o riparazione umana.
Scegli 4.7 se migliora il costo per task accettato o riduce errori importanti. Mantieni 4.6 se i risultati sono equivalenti e la route esistente è più semplice da gestire. Per confrontare famiglie, usa la guida ai modelli per coding agent.
Errori comuni nelle recensioni di Grok 4.7
Chiamare indipendenti i risultati del vendor
Le sette righe sono utili, ma SpaceXAI le ha scelte ed eseguite. Attribuisci la fonte e mostra i livelli di effort.
Dichiarare 2.1T parametri come fatto
La cifra circolava prima dell'uscita, ma non compare nell'annuncio o nel developer contract corrente. È confermato solo “new, larger base model”.
Trattare il contesto 500K come gratuito
È la capacità massima del prompt. A 200K tokens l'intera richiesta entra nella fascia diretta più costosa.
Presumere che Fast sia un ID API pubblico
È un'opzione di serving in Cursor e Grok Build. La public API documenta grok-4.7, non uno slug Fast.
Confondere lancio e disponibilità OmniaKey
Il rilascio del provider e l'onboarding del gateway sono separati. Alla data di verifica non esisteva una route pubblica OmniaKey 4.7.
Domande frequenti
Quando è uscito Grok 4.7?
Il 21 settembre 2026. L'ID diretto del modello API è grok-4.7.
Grok 4.7 è migliore di Grok 4.6?
È il candidato più forte da provare per primo. xAI riporta risultati superiori in ogni confronto mostrato allo stesso prezzo diretto. Serve comunque un test appaiato per effort, token, tools e tipi di errore.
Quanto costa l'API di Grok 4.7?
Sull'endpoint globale, sotto 200K costa $2 input, $0.50 cache e $6 output per milione. Da 200K costa $4, $1 e $12.
Qual è la finestra di contesto?
500,000 tokens. La guida attuale non indica un limite di text output, ma restano limiti di rate, tempo e budget.
Quanti parametri ha Grok 4.7?
SpaceXAI non pubblica una cifra nell'annuncio o nella pagina developer. Conferma soltanto una nuova base più grande di quella di 4.6.
Supporta immagini e strumenti?
Sì. Accetta testo e immagini, produce testo e documenta function calling, structured output, web search, X search e code execution.
Grok 4.7 è disponibile su OmniaKey?
Non al controllo del 22 settembre. Il catalogo pubblico mostrava Grok 4.6 e 4.5, ma non grok-4.7. Consulta il catalogo live.
Fonti verificate
- SpaceXAI: lancio di Grok 4.7
- SpaceXAI: guida iniziale Grok 4.7
- SpaceXAI: pagina modello Grok 4.7
- SpaceXAI: prezzi API
- SpaceXAI: release notes
- Artificial Analysis: Grok 4.7 xhigh
- GitHub: Grok 4.7 in Copilot
- OpenRouter: route Grok 4.7
- Catalogo modelli live OmniaKey
Verificato il 22 settembre 2026. Disponibilità, score dinamici, prezzi e rollout possono cambiare; ricontrolla fonti primarie e catalogo prima di una migrazione production.