Test de Grok 4.7
Grok 4.7 est une mise à niveau au même tarif à tester en priorité pour les agents de code et de connaissance au long cours, sans confondre les scores de xAI avec une validation sur vos tâches.
Ce test de Grok 4.7 aboutit à une conclusion plus mesurée que les titres de lancement. Pour le code au long cours, l'usage d'outils et les tâches professionnelles de connaissance, 4.7 mérite d'être évalué en premier : il progresse sur les sept lignes comparées à Grok 4.6 par xAI, sans changer le prix API standard ni le contexte de 500K. Cela n'en fait pas un vainqueur universel. Le tableau officiel mélange les niveaux de reasoning effort et nous n'avons pas exécuté de benchmark payant de première main.
SpaceXAI a lancé grok-4.7 le 21 septembre 2026. L'API publique xAI le propose, mais le catalogue public d'OmniaKey ne le référençait pas lors de notre vérification du 22 septembre. Tant que le catalogue en direct ne change pas, utilisez Grok 4.6 chez OmniaKey ou un fournisseur qui expose réellement l'identifiant exact de 4.7.
Données vérifiées le 22 septembre 2026. Les caractéristiques et scores de lancement viennent de l'annonce et de la documentation développeur de SpaceXAI. Artificial Analysis affichait un premier Intelligence Index en xhigh, mais ses champs de vitesse et de prix fournisseur restaient incomplets. Nous n'avons utilisé ni preview privée, ni identifiant xAI, ni mesure directe de latence. Les résultats constructeur, les données indépendantes et notre recommandation sont séparés.
Verdict du test de Grok 4.7
Pour un nouvel agent de longue durée, testez 4.7 avant 4.6. Le signal le plus utile est le progrès générationnel : xAI annonce un meilleur résultat pour 4.7 sur les sept comparaisons directes, avec des gains notables sur Terminal-Bench 4.0 et EEBench, sans hausse du tarif standard par token.
Ne migrez pas sur le seul titre du communiqué. xAI montre Grok 4.7 en xhigh, Grok 4.6 en high et les autres modèles frontier en max ; DeepSWE pour 4.7 est en plus signalé en high effort. Le réglage modifie consommation, latence et comportement.
Gardez 4.6 comme rollback jusqu'à validation de vos tâches. Les deux générations ont 500K de contexte et les mêmes tarifs directs. Une évaluation progressive coûte moins cher qu'une régression d'outils, de refus, de verbosité ou de format découverte en production.
Date de sortie et fiche technique
| Élément | Contrat de Grok 4.7 |
|---|---|
| Date de sortie | 21 septembre 2026 |
| ID du modèle API | grok-4.7 |
| Entrée / sortie | Texte et image / texte |
| Fenêtre de contexte | 500,000 tokens |
| Date limite des connaissances | Mai 2026 |
| Reasoning effort | low, medium, high (par défaut), xhigh |
| API | Responses API et Chat Completions |
| Capacités | Function calling, structured outputs, web search, X search, code execution |
| Batch API | Non pris en charge |
| Prix global direct sous 200K de prompt | $2 entrée / $0.50 cache / $6 sortie par 1M |
| Prix global direct à partir de 200K | $4 entrée / $1 cache / $12 sortie par 1M |
Les 500K représentent une capacité, pas un quota gratuit. Dès que le prompt atteint 200K tokens, xAI applique le tarif supérieur à tous les tokens de la requête. Le guide ne fixe pas de limite de sortie texte, mais rate limits, latence, budget et endpoint contraignent toujours une charge réelle.
Ce qui change par rapport à Grok 4.6
SpaceXAI décrit une nouvelle base plus grande, un reinforcement learning plus long sur des tâches difficiles de plusieurs heures, une meilleure self-verification, une meilleure gestion du contexte long, une compréhension native du harness Grok Bot et une nouvelle pile de safeguards.
Il s'agit d'affirmations de lancement, pas d'un audit indépendant de l'architecture. Ni l'annonce ni le contrat actuel du modèle ne publient de nombre de paramètres.
| Point de décision | Grok 4.7 | Grok 4.6 | Conséquence |
|---|---|---|---|
| Base / entraînement | Nouvelle base plus grande ; RL plus long sur tâches difficiles | Génération précédente | Bon motif pour retester les agents longs |
| Prix direct standard | $2 / $0.50 / $6 | $2 / $0.50 / $6 | Aucun surcoût catalogue pour migrer |
| Prix long contexte | $4 / $1 / $12 | $4 / $1 / $12 | Même économie au seuil de 200K |
| Contexte | 500K | 500K | Pas de gain de capacité |
| Reasoning | low à xhigh ; high par défaut | low à xhigh ; high par défaut | Fixer le même effort pour comparer |
| Batch | Non pris en charge | Non pris en charge | Ne pas prévoir une remise Batch |
| Priorité du lancement | Code, agents, connaissance, auto-vérification | Code et agents longue durée | Fiabilité plutôt que nouvelle modalité |
La mise à niveau pratique porte donc sur la performance revendiquée au même prix, pas sur un contexte plus grand ou un token moins cher. Le guide des prix API de Grok 4.6 reste la référence budgétaire détaillée pour la route actuellement disponible chez OmniaKey.
Benchmarks de Grok 4.7 : bien lire le tableau
Ces valeurs sont rapportées par SpaceXAI et n'ont pas été reproduites par OmniaKey. L'éditeur affiche 4.7 en xhigh, 4.6 en high, GPT-5.6 Sol en max et Fable 5.1 en max ; l'astérisque indique que DeepSWE 4.7 utilise high effort.
| Évaluation | Grok 4.7 | Grok 4.6 | GPT-5.6 Sol | Fable 5.1 | 4.7 vs 4.6 |
|---|---|---|---|---|---|
| CursorBench 4.0 | 46.3% | 40.4% | 41.7% | 51.8% | +5.9 pp |
| DeepSWE v1.1 | 71.0%* | 65.2% | 72.7% | 70.0% | +5.8 pp |
| EEBench | 64.0% | 53.0% | 39.4% | 56.4% | +11.0 pp |
| AA Briefcase v1.1 | 1,657 | 1,546 | 1,487 | 1,678 | +111 Elo |
| Terminal-Bench 4.0 | 38.0% | 20.3% | 37.3% | 57.9% | +17.7 pp |
| Harvey Legal Agent Benchmark | 19.6% | 15.8% | 2.5% | 6.7% | +3.8 pp |
| HealthBench Professional | 56.7% | 48.5% | 60.5% | 62.1% | +8.2 pp |
Le tableau permet une affirmation solide : dans le protocole de xAI, 4.7 progresse par rapport à 4.6 sur chaque famille affichée. Il ne prouve pas que Grok 4.7 bat tous les modèles. Fable mène CursorBench, AA Briefcase, Terminal-Bench et HealthBench ; GPT-5.6 Sol mène DeepSWE. Prix, effort, harness, tokens et critères d'acceptation diffèrent aussi.
Pour le code, le gain Terminal-Bench est intéressant car l'évaluation vise des tâches terminal de plusieurs heures. C'est aussi là que l'avance de Fable est la plus forte. Mesurez les critères de réussite et les types d'échec, pas seulement le score global.
Quelles preuves indépendantes existent ?
Artificial Analysis avait déjà ajouté Grok 4.7 en xhigh. Sa page affichait un Intelligence Index de 46 et une forte consommation de sortie : 240M tokens dans l'index, contre une médiane de 92M sur la page.
Cette mesure reste précoce. La vitesse de sortie était N/A et les prix fournisseur n'étaient pas renseignés de manière fiable. Elle ne valide donc ni l'affirmation de « même vitesse », ni Fast, ni un coût par tâche. Le score peut évoluer avec la fin de l'évaluation ou une mise à jour de la suite.
- les données officielles indiquent un progrès cohérent de 4.6 vers 4.7 ;
- une suite indépendante place déjà xhigh dans la zone frontier ;
- aucune vitesse indépendante stable, p95 ou comparaison de coût appariée avec 4.6 n'était disponible ;
- votre propre charge reste le test décisif.
Prix API de Grok 4.7 et contexte long
Grok 4.7 conserve la grille globale directe de Grok 4.6. Le seuil actuel distingue moins de 200K et 200K ou plus. À exactement 200K, le tarif standard ne s'applique plus.
| Route | Taille du prompt | Entrée | Entrée en cache | Sortie |
|---|---|---|---|---|
| xAI global | Moins de 200K | $2.00 | $0.50 | $6.00 |
| xAI global | 200K ou plus | $4.00 | $1.00 | $12.00 |
| xAI US regional | Moins de 200K | $2.20 | $0.55 | $6.60 |
| xAI US regional | 200K ou plus | $4.40 | $1.10 | $13.20 |
Tous les montants sont en USD par million de tokens. L'endpoint US conserve l'inférence aux États-Unis et ajoute 10% au prix des tokens. Tool calls, stockage, taxes, conversion et devis d'une plateforme tierce restent séparés.
| Charge | Calcul | Coût tokens du modèle |
|---|---|---|
| 100K entrée non cachée + 20K sortie | 0.10 x $2 + 0.02 x $6 | $0.32 |
| 250K entrée non cachée + 20K sortie | 0.25 x $4 + 0.02 x $12 | $1.24 |
| 50K non cachée + 200K cachée + 20K sortie | 0.05 x $4 + 0.20 x $1 + 0.02 x $12 | $0.64 |
Le prix caché ne vaut que si le fournisseur signale un cache hit. xAI recommande prompt_cache_key avec Responses ou x-grok-conv-id avec Chat Completions pour orienter des tours liés vers le même serveur. La compaction du contexte compte : répéter un prompt de 200K ou plus double les trois tarifs.
Pour Fast, fiez-vous au tableau
Grok 4.7 Fast est le même modèle sur une infrastructure plus rapide. Il n'est disponible que dans Cursor et Grok Build, pas dans l'API publique xAI ni dans l'offre gratuite de Grok Build.
La page de prix parle de « deux fois le tarif standard », puis affiche $4 / $1 / $12 sous 200K et $6 / $1.50 / $18 à partir de 200K. La seconde ligne vaut 1.5 fois le tarif long contexte public, pas 2 fois. Citez le tableau plutôt que de déduire le prix du texte et contrôlez la facture avant une grosse exécution. Cursor facture via son propre plan.
« Deux fois la vitesse de sortie » est aussi une déclaration du fournisseur, pas une garantie de latence. Le débit de décodage exclut file d'attente, prefill, premier token, outils, réseau et retries.
Détails API utiles pour un agent
La Responses API renvoie toujours reasoning.encrypted_content avec grok-4.7, même si include ne le demande pas. Renvoyez ces éléments sans modification au tour suivant pour préserver l'état de raisonnement d'un agent multi-tour. Chat Completions ne change pas.
Avant une migration, vérifiez :
- l'ID réellement renvoyé et l'endpoint ;
- le même
reasoning_effortpour les deux générations ; - la validité des schemas de tool call et les retries ;
- tokens de prompt, cache, reasoning et sortie visible ;
- premier token, latence totale et coût par tâche acceptée ;
- longueur de sortie, car xhigh peut consommer davantage ;
- rollback vers
grok-4.6sans modifier le harness.
Exemple direct avec xAI Responses :
curl https://api.x.ai/v1/responses \
-H "Authorization: Bearer $XAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.7",
"prompt_cache_key": "repo-review-v1",
"input": "Review this patch, run the acceptance criteria, and report any remaining failure."
}'
Utilisez une clé de cache stable et non secrète, jamais une API key, une adresse e-mail, un secret de dépôt ou un ID client. Cette base URL et ce credential concernent xAI directement, pas OmniaKey.
Où Grok 4.7 est-il disponible ?
| Plateforme | État au 22 septembre 2026 | Limite importante |
|---|---|---|
| xAI API | Disponible comme grok-4.7 | Version standard ; Fast n'est pas une API publique |
| Grok Build | Modèle par défaut | Fast est payant et hors offre gratuite |
| Cursor | Disponible sur tous les plans selon xAI | La facturation Fast suit le plan Cursor |
| GitHub Copilot | Déploiement progressif annoncé | Pro, Pro+, Max, Business, Enterprise ; policy admin possible |
| OpenRouter, Vercel, Cloudflare | Référencés comme gateways par xAI | Chacun gère route, prix et disponibilité |
| OmniaKey | Non référencé à la vérification | Consultez le catalogue de modèles en direct ; n'inventez pas de route |
GitHub cite VS Code, Visual Studio, Copilot CLI, cloud agent, Copilot app, JetBrains, Xcode et Eclipse. Un déploiement progressif ne signifie pas que le sélecteur apparaît immédiatement pour chaque compte.
Comparatif reproductible entre Grok 4.6 et 4.7
Prenez 20 à 50 tâches issues de votre vraie distribution d'échecs plutôt qu'une série de prompts faciles. Figez révision du dépôt, system prompt, outils, permissions, effort, timeout et commandes d'acceptation.
- accepté sans réparation, après retry ou échec ;
- erreurs de schema, mauvaises modifications, tests cassés, refus et boucles ;
- tokens d'entrée, cache, reasoning et sortie ;
- latence premier token et totale aux p50 et p95 ;
- ID retourné et montant facturé ;
- minutes de revue ou réparation humaine.
Choisissez 4.7 s'il réduit le coût par tâche acceptée ou des échecs importants. Gardez 4.6 en cas d'égalité si sa route est plus simple à opérer. Pour comparer les familles, consultez le guide des modèles pour agents de code.
Erreurs fréquentes dans un test de Grok 4.7
Présenter les scores constructeur comme un test indépendant
Les sept lignes sont utiles, mais SpaceXAI les a choisies et exécutées. Citez la source et affichez les niveaux d'effort.
Affirmer un nombre de 2.1T paramètres
Ce nombre a circulé avant la sortie, mais l'annonce et le contrat développeur actuel ne le publient pas. Seule la formule « new, larger base model » est confirmée.
Considérer 500K de contexte comme gratuit
C'est la capacité maximale. Dès 200K tokens, toute la requête passe au tarif direct supérieur.
Prendre Fast pour un ID d'API publique
C'est une option de serving dans Cursor et Grok Build. L'API publique expose grok-4.7, pas un slug Fast documenté.
Confondre sortie et disponibilité OmniaKey
Le lancement fournisseur et l'intégration d'un gateway sont distincts. Aucune route publique OmniaKey 4.7 n'existait à la date de vérification.
Questions fréquentes
Quand Grok 4.7 est-il sorti ?
SpaceXAI l'a publié le 21 septembre 2026. L'ID direct de l'API est grok-4.7.
Grok 4.7 est-il meilleur que Grok 4.6 ?
C'est le candidat le plus solide à tester en premier. xAI annonce de meilleurs résultats sur chaque comparaison à prix direct identique. Un test apparié reste nécessaire à cause de l'effort, des tokens, des outils et des échecs.
Quel est le prix de l'API Grok 4.7 ?
Sur l'endpoint global, sous 200K, le million coûte $2 en entrée, $0.50 en cache et $6 en sortie. Dès 200K, les tarifs sont $4, $1 et $12.
Quelle est la fenêtre de contexte ?
500,000 tokens. Le guide ne fixe pas de limite de sortie texte, mais les limites de débit, durée et budget restent applicables.
Combien de paramètres possède Grok 4.7 ?
SpaceXAI ne publie aucun nombre dans l'annonce ou la page développeur. Il confirme seulement une nouvelle base plus grande que 4.6.
Grok 4.7 accepte-t-il les images et les outils ?
Oui. Il reçoit texte et images, produit du texte et documente function calling, structured output, web search, X search et code execution.
Grok 4.7 est-il disponible chez OmniaKey ?
Pas lors de la vérification du 22 septembre. Le catalogue public montrait Grok 4.6 et 4.5, mais pas grok-4.7. Consultez le catalogue en direct.
Sources consultées
- SpaceXAI : présentation de Grok 4.7
- SpaceXAI : guide de démarrage Grok 4.7
- SpaceXAI : page modèle Grok 4.7
- SpaceXAI : prix API
- SpaceXAI : notes de version
- Artificial Analysis : Grok 4.7 xhigh
- GitHub : Grok 4.7 dans Copilot
- OpenRouter : route Grok 4.7
- Catalogue de modèles OmniaKey
Vérifié le 22 septembre 2026. Disponibilité, scores dynamiques, prix et déploiements peuvent changer ; revérifiez les sources primaires et le catalogue avant une migration en production.