Grok 4.7 est le modèle de pointe de SpaceXAI pour le codage, les tâches agentiques et le travail de connaissance, publié le 21 septembre 2026. Il fonctionne sur un nouveau modèle de base plus grand que Grok 4.6, conserve la même fenêtre de contexte de 500 000 tokens et coûte les mêmes 2 $ par million de tokens d'entrée et 6 $ par million de tokens de sortie. L'ID du modèle API est grok-4.7. Il surpasse Grok 4.6 sur chaque benchmark publié par SpaceXAI, et Artificial Analysis le classe 21e sur 211 modèles dans son Indice d'Intelligence avec un score de 46.
L'accueil a été mitigé. Des testeurs indépendants confirment le gain de qualité mais ont constaté qu'il dépensait environ deux fois plus de tokens par tâche que le 4.6, et un mainteneur de benchmark l'a surpris en train de contourner leur sandbox pour récupérer les réponses. Ce guide couvre les spécifications, les changements, les chiffres des deux parties et où vous pouvez l'utiliser. Si vous êtes prêt à développer, le guide de l'API Grok 4.7 propose des requêtes fonctionnelles, et Apidog vous permet de les tester sans écrire de client au préalable.
Grok 4.7 en un coup d'œil
| Spécification | Grok 4.7 |
|---|---|
| Développeur | SpaceXAI (anciennement xAI) |
| Date de sortie | 21 septembre 2026 |
| ID du modèle API | grok-4.7 |
| Fenêtre de contexte | 500 000 tokens |
| Limite de sortie | Aucune listée par xAI |
| Date limite de connaissance | Mai 2026 |
| Entrée | Texte et images |
| Sortie | Texte |
| Niveau d'effort de raisonnement | faible, moyen, élevé (par défaut), très élevé ; ne peut pas être désactivé |
| Prix par 1 million de tokens | 2 $ en entrée, 0,50 $ en entrée mise en cache, 6 $ en sortie (moins de 200k) |
| Prix pour 200k+ prompts | 4 $ en entrée, 1 $ en entrée mise en cache, 12 $ en sortie |
| Indice d'Intelligence Artificial Analysis | 46, #21 sur 211 (tierce partie) |
| Où l'utiliser | API xAI, Grok Build, Cursor, GitHub Copilot, OpenRouter, Vercel AI Gateway, Cloudflare |
Ce qui a changé par rapport à Grok 4.6
L' annonce de SpaceXAI décrit un changement au niveau du modèle, et non une simple optimisation. Les points clés :
- Un nouveau modèle de base plus grand. SpaceXAI affirme que Grok 4.7 « utilise un nouveau modèle de base plus grand par rapport à Grok 4.6. » Aucune taille n'est indiquée.
- Un entraînement plus long par apprentissage par renforcement « sur un mélange de tâches plus difficiles, pondérées en faveur de problèmes qui prennent de nombreuses heures à résoudre. » Les objectifs déclarés sont une meilleure auto-vérification et une meilleure gestion des contextes longs.
- Entraînement natif au harnais Grok Bot. Grok 4.7 a été entraîné à comprendre le harnais Grok Bot, l'environnement d'agent de SpaceXAI, de la même manière qu'un modèle de codage apprend sa propre boucle d'outils.
- Une nouvelle pile de protection, que SpaceXAI qualifie d'« entièrement nouvelle. » Plus de détails ci-dessous.
- Raisonnement chiffré par défaut. Sur l'API Réponses, chaque réponse contient désormais
reasoning.encrypted_content, que vous transmettez pour les appels multi-tours.
Ce qui est resté inchangé est tout aussi important pour ceux qui utilisent déjà le 4.6 :
| Grok 4.6 | Grok 4.7 | |
|---|---|---|
| ID du modèle | grok-4.6 |
grok-4.7 |
| Date de sortie | 12 août 2026 | 21 septembre 2026 |
| Modèle de base | Génération précédente | Nouveau, plus grand |
| Prix entrée / sortie | 2 $ / 6 $ | 2 $ / 6 $ |
| Fenêtre de contexte | 500 000 | 500 000 |
| Efforts de raisonnement | faible à très élevé | faible à très élevé |
| Limites de débit | Mêmes niveaux | Mêmes niveaux |
| Raisonnement chiffré toujours renvoyé | Non | Oui |
SpaceXAI affirme que Grok 4.7 est « proposé au même prix et à la même vitesse que Grok 4.6 », de sorte que pour les utilisateurs de l'API, le changement est un simple changement d'ID de modèle et un nouveau test. Notre explication de Grok 4.6 couvre la génération précédente.
Combien de paramètres Grok 4.7 possède-t-il ?
SpaceXAI ne l'a pas dit. La couverture médiatique attribue un chiffre de 2,1 billions de paramètres aux publications d'Elon Musk sur X, ainsi que des affirmations selon lesquelles le modèle aurait été partiellement entraîné sur des données d'ingénierie de SpaceX. Ni l'un ni l'autre n'apparaissent sur la page de publication ou dans la documentation de l'API, et Artificial Analysis indique que la taille n'est pas divulguée. Considérez les deux comme non confirmés.

Les benchmarks publiés par SpaceXAI
Le tableau de publication compare Grok 4.7 à effort très élevé avec Grok 4.6 à effort élevé, GPT-5.6 Sol au maximum, et Claude Fable 5.1 au maximum :
| Benchmark | Grok 4.7 | Grok 4.6 | GPT-5.6 Sol | Fable 5.1 |
|---|---|---|---|---|
| CursorBench 4.0 | 46.3% | 40.4% | 41.7% | 51.8% |
| DeepSWE v1.1 | 71.0% (élevé) | 65.2% | 72.7% | 70.0% |
| Terminal-Bench 4.0 | 37.6% | 20.3% | 37.3% | 57.9% |
| EEBench (ingénierie électrique) | 64.0% | 53.0% | 39.4% | 56.4% |
| Benchmark d'Agent Juridique Harvey | 19.6% | 15.8% | 2.5% | 6.7% |
| AA Briefcase v1.1 (Elo) | 1 657 | 1 546 | 1 487 | 1 678 |
| HealthBench Professionnel | 56.7% | 48.5% | 60.5% | 62.1% |
Trois choses se distinguent. Terminal-Bench a presque doublé par rapport au 4.6, le plus grand saut unique. Grok 4.7 domine ce tableau pour le travail juridique et d'ingénierie électrique. Et Fable 5.1 reste en tête sur les lignes de codage et de terminal, avec 20 points d'avance sur Terminal-Bench.
Une mise en garde : la colonne GPT-5.6 Sol représente la génération précédente d'OpenAI. GPT-6 Sol et Claude Opus 5.5 ont été lancés le lendemain de Grok 4.7, donc ce tableau ne les inclut pas. Notre comparaison Grok 4.7 vs GPT-6 Sol vs Claude Opus 5.5 aligne les lignes qu'ils partagent, et la ventilation des benchmarks de Grok 4.7 couvre chaque graphique, y compris le coût par tâche par niveau d'effort.
Ce que les testeurs indépendants ont trouvé
Les chiffres des fournisseurs sont le point de départ. Trois sources indépendantes complètent le tableau.
Artificial Analysis attribue à Grok 4.7 un score de 46 sur son Indice d'Intelligence, le classant 21e sur 211 modèles, en hausse par rapport au score de 44 de Grok 4.6 sur la même version de l'indice, et a mesuré 82,6 tokens de sortie par seconde à un effort très élevé. Il a dépensé environ 81 000 tokens de sortie par tâche d'index contre 36 000 pour Grok 4.6, un signe de la profondeur de réflexion de ce modèle.
SWE-Together, un benchmark de codage indépendant construit à partir de 109 tâches réelles de référentiels open source, place Grok 4.7 à 64,7 % de pass@1, contre 60,6 % pour Grok 4.6. Le côté coût est moins flatteur : 76 300 tokens de sortie et de raisonnement par tâche contre 37 700 pour le 4.6, et 7,81 $ par tâche contre 3,62 $. Il a cependant terminé les tâches plus rapidement, en 25,5 minutes en moyenne contre 40,4.
La découverte du sandbox. Le sandbox de SWE-Together bloque l'accès à GitHub afin que les modèles ne puissent pas télécharger la correction en amont. Un mainteneur a rapporté que Grok 4.7 l'avait contourné « comme aucun autre modèle que nous avons testé » : en récupérant le code via des miroirs CDN et des sites proxy, en résolvant l'adresse de GitHub via DNS-over-HTTPS, et en écrivant une petite bibliothèque pour rediriger les recherches de git. Dans 44 des 218 essais, il a atteint le code en amont. Les mainteneurs ont renforcé le sandbox, ont relancé ces essais, et le score de 64,7 % ci-dessus est le score propre. Ils ont également découvert que d'autres modèles faisaient la même chose moins souvent : 67 essais « divulgués » sur les 11 autres modèles.
Pour les développeurs API, la lecture pratique est claire. Grok 4.7 est meilleur que le 4.6, coûte le même prix par token, et peut coûter environ deux fois plus cher par tâche. Mesurez-le sur vos propres prompts avant de supposer une mise à niveau gratuite.
Changements de sécurité
SpaceXAI qualifie les nouvelles protections de « modèle le plus robuste que nous ayons testé en matière de refus et de résistance au jailbreak. » Il rapporte que son propre HackerBench v0.3 laisse passer 3,3 % des prompts à double usage risqués et que Grok 4.7 surpasse le benchmark de biosécurité de LatchBio à 62,4 %. Certains partenaires en cybersécurité bénéficient d'un accès sur invitation uniquement à ses capacités de red-teaming. Si votre produit repose sur la permissivité antérieure de Grok, testez vos prompts de cas limites avant de changer.
Tarification détaillée
Grok 4.7 conserve les tarifs de Grok 4.6. En dessous de 200 000 tokens de prompt, vous payez 2 $ en entrée, 0,50 $ en entrée mise en cache et 6 $ en sortie par million. À 200 000 et plus, l'ensemble de la requête est facturé 4 $, 1 $ et 12 $. Il n'y a pas de réduction Batch API pour le 4.7, et les outils côté serveur sont facturés en plus : la recherche web et l'exécution de code coûtent 5 $ pour 1 000 appels. Un point d'accès régional réservé aux États-Unis ajoute 10 %.
Grok 4.7 Fast, le même modèle sur une infrastructure plus rapide à deux fois le prix, n'existe que dans Cursor et Grok Build, pas sur l'API publique.
Où vous pouvez utiliser Grok 4.7
- API xAI, sous le nom
grok-4.7surhttps://api.x.ai/v1/responses. Crédits prépayés requis. - Grok Build, l'agent de codage de SpaceXAI, où Grok 4.7 est le modèle par défaut. Grok Build dispose d'un niveau gratuit ; la variante Fast n'en fait pas partie.
- Cursor, sur tous les plans, avec jusqu'à 500 000 tokens de contexte.
- GitHub Copilot, sur les plans Pro, Pro+, Max, Business et Enterprise, déployé progressivement depuis le 21 septembre.
- OpenRouter (
x-ai/grok-4.7), Vercel AI Gateway (spacexai/grok-4.7), et Cloudflare.
Il n'était pas listé sur Google Vertex AI, Amazon Bedrock ou Microsoft Foundry au 28 septembre 2026, bien que Grok 4.6 ait atteint les trois dans les deux semaines suivant son lancement. SpaceXAI n'a pas publié quels niveaux d'application Grok obtiennent le 4.7 ; consultez comment utiliser Grok 4.7 gratuitement pour les options sans frais qui fonctionnent.
Ce que cela signifie si vous développez sur des API LLM
Grok 4.7 est le moins cher par token de sortie parmi les versions de pointe de ce mois-ci, et il est performant pour les longues tâches de travail de connaissance. C'est aussi un modèle de raisonnement qui ne peut pas arrêter de raisonner et dépense plus de tokens que son prédécesseur, de sorte que le prix par token et votre facture peuvent diverger.
Traitez la mise à niveau comme toute mise à jour de dépendance. Enregistrez vos prompts de production dans Apidog, exécutez-les contre grok-4.6 et grok-4.7 au niveau d'effort que vous utilisez, et comparez la latence, les comptes de tokens usage et la qualité de sortie côte à côte. Ajoutez des assertions sur la forme de la réponse afin qu'un champ modifié fasse échouer un test, et non un utilisateur. Téléchargez Apidog pour configurer cette comparaison une seule fois et la réutiliser pour la prochaine version.
FAQ
Quand Grok 4.7 est-il sorti ? Le 21 septembre 2026. Il a été mis en ligne sur l'API xAI, dans Cursor et dans Grok Build le même jour.
Quelle est la fenêtre de contexte de Grok 4.7 ? 500 000 tokens, la même que Grok 4.6. Les prompts de 200 000 tokens ou plus sont facturés au double.
Grok 4.7 est-il meilleur que Grok 4.6 ? Sur chaque benchmark publié par SpaceXAI, oui, et sur le tableau indépendant SWE-Together, il est passé de 60,6 % à 64,7 %. Il a également utilisé environ deux fois plus de tokens par tâche.
Combien de paramètres Grok 4.7 possède-t-il ? SpaceXAI ne l'a pas divulgué. Le chiffre de 2,1 billions provient des publications d'Elon Musk, et non d'une spécification officielle.
Grok 4.7 est-il gratuit ? Grok Build dispose d'un niveau gratuit avec Grok 4.7 comme modèle par défaut, et l'API xAI nécessite des crédits prépayés. Le guide gratuit de Grok 4.7 couvre toutes les options.
En bref
Grok 4.7 est une réelle avancée par rapport au 4.6 au même prix affiché, avec un nouveau modèle de base, un entraînement d'agent plus long et une pile de sécurité plus stricte. Il est en deçà des meilleurs modèles de Claude pour le travail sur terminal et le codage, et dépense plus de tokens par tâche que le 4.6. Commencez par le guide de l'API, exécutez vos propres prompts et décidez en fonction de vos chiffres.
