Comment utiliser l'API Grok 4.6

Tutoriel pas à pas de l'API Grok 4.6 : obtenir une clé API xAI, faire votre première requête avec curl/Python/JavaScript, gérer le streaming des réponses, utiliser le contexte de 500 000, et tout tester avec Apidog.

Ashley Innocent

Ashley Innocent

13 August 2026

Comment utiliser l'API Grok 4.6

Apidog pour les entreprises

Déploiement sur site

SSO & RBAC

Conforme SOC 2

Découvrir Apidog Enterprise

xAI a lancé Grok 4.6 le 12 août 2026, et l'argumentaire s'adresse directement aux développeurs : un modèle de pointe pour les agents à exécution longue et les travaux de codage en plusieurs étapes, au prix de 2 $ par million de jetons d'entrée et 6 $ par million de jetons de sortie. La documentation officielle couvre le matériel de référence, mais rien dans les premiers résultats de recherche ne vous explique comment appeler l'API de bout en bout. Ce guide y remédie.

À la fin, vous disposerez d'une clé API, d'une requête fonctionnelle en curl, Python et JavaScript, d'une sortie en streaming, et d'une configuration reproductible pour tester les points d'accès de Grok 4.6 avant qu'ils n'atteignent la production. Si vous souhaitez construire et déboguer ces requêtes visuellement au lieu de jongler avec des fenêtres de terminal, Apidog gère l'ensemble du flux, téléchargez-le gratuitement pour suivre.

bouton

TL;DR

Ce avec quoi vous travaillez

Avant d'écrire du code, voici la fiche technique importante pour les décisions d'intégration :

Spécification Grok 4.6
Date de sortie 12 août 2026
Fenêtre de contexte 500 000 jetons
Date limite de connaissances 1er février 2026
Prix d'entrée 2 $ / 1M de jetons
Prix de sortie 6 $ / 1M de jetons
Variante rapide 2x le prix
Style d'API REST compatible OpenAI
Disponibilité API xAI, OpenRouter, Vercel, Cloudflare, Cursor, Grok Build

Les principales améliorations par rapport à Grok 4.5 sont liées aux agents : xAI rapporte que le modèle vérifie plus souvent son propre travail sur de longues trajectoires et produit des premiers essais plus solides sur des projets interactifs et visuels. Sur les benchmarks, il est passé de 54 % à 65,9 % sur DeepSWE v1.1 et de 47,1 % à 57.5 % sur APEX-Agents. Si vous avez développé avec l'API Grok 4.5, la surface d'intégration reste inchangée ; consultez notre guide de l'API Grok 4.5 pour la base, puis échangez le nom du modèle.

Étape 1 : Obtenez votre clé API

  1. Allez sur console.x.ai et connectez-vous ou créez un compte xAI.
  2. Ouvrez Clés API dans la barre latérale et cliquez sur Créer une clé API.
  3. Nommez la clé en fonction de son environnement (grok-dev, grok-prod) ; vous vous en remercierez lors de la rotation des clés plus tard.
  4. Copiez la clé immédiatement. xAI ne l'affiche qu'une seule fois.

Stockez-la comme variable d'environnement plutôt que de la coller dans le code :

export XAI_API_KEY="your-key-here"

Une habitude à adopter dès le premier jour : conservez des clés distinctes pour le développement et la production, et ne commettez jamais une clé dans le contrôle de version. Si une clé est divulguée, révoquez-la dans la console et émettez-en une nouvelle.

Étape 2 : Votre première requête avec curl

L'API xAI suit le format des complétions de chat d'OpenAI. Voici la requête minimale :

curl https://api.x.ai/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $XAI_API_KEY" \
  -d '{
    "model": "grok-4-6",
    "messages": [
      {"role": "system", "content": "You are a concise technical assistant."},
      {"role": "user", "content": "Explain idempotency in REST APIs in two sentences."}
    ]
  }'

Une réponse réussie renvoie un tableau choices avec le message de l'assistant, plus un objet usage comptant les jetons d'entrée et de sortie. Ce bloc usage est votre compteur de facturation, enregistrez-le dès le début.

Astuce : les ID de modèle diffèrent parfois entre l'API native et les revendeurs (OpenRouter le liste comme x-ai/grok-4.6, par exemple). Si vous obtenez une erreur model not found, listez ce à quoi votre clé peut accéder :

curl https://api.x.ai/v1/models -H "Authorization: Bearer $XAI_API_KEY"

Étape 3 : Python et JavaScript

Parce que l'API est compatible avec OpenAI, les SDK OpenAI officiels fonctionnent avec deux lignes modifiées : l'URL de base et la clé.

Python :

from openai import OpenAI
import os

client = OpenAI(
    api_key=os.environ["XAI_API_KEY"],
    base_url="https://api.x.ai/v1",
)

response = client.chat.completions.create(
    model="grok-4-6",
    messages=[
        {"role": "system", "content": "You are a concise technical assistant."},
        {"role": "user", "content": "Write a Python function that validates an email address."},
    ],
)

print(response.choices[0].message.content)
print(response.usage)

JavaScript / TypeScript :

import OpenAI from "openai";

const client = new OpenAI({
  apiKey: process.env.XAI_API_KEY,
  baseURL: "https://api.x.ai/v1",
});

const response = await client.chat.completions.create({
  model: "grok-4-6",
  messages: [
    { role: "system", content: "You are a concise technical assistant." },
    { role: "user", content: "Write a TypeScript type guard for a User object." },
  ],
});

console.log(response.choices[0].message.content);

Cette compatibilité signifie également que la migration dans les deux sens est peu coûteuse. Si vous utilisez déjà l'API GPT-5.6, vous pouvez tester Grok 4.6 en A/B par rapport à celle-ci derrière un seul drapeau de configuration.

Étape 4 : Réponses en streaming

Pour tout ce qui est destiné à l'utilisateur, utilisez le streaming. Grok 4.6 est optimisé pour les sorties longues en plusieurs étapes, et faire fixer un indicateur de chargement aux utilisateurs pour une réponse de 2 000 jetons est un mauvais compromis.

stream = client.chat.completions.create(
    model="grok-4-6",
    messages=[{"role": "user", "content": "Refactor this function and explain each change: ..."}],
    stream=True,
)

for chunk in stream:
    delta = chunk.choices[0].delta.content
    if delta:
        print(delta, end="", flush=True)

Les réponses en streaming arrivent sous forme d'événements envoyés par le serveur (SSE). Elles sont difficiles à inspecter dans un terminal une fois que vous déboguez, chaque bloc est une ligne data: distincte, et une mauvaise gestion se traduit par des jetons perdus ou des interfaces utilisateur bloquées. Apidog affiche les flux SSE en temps réel dans son panneau de réponse, ce qui permet de savoir clairement si un blocage est dû à la réflexion du modèle ou à la mise en cache de votre client.

Étape 5 : Utilisez le contexte de 500K, avec précaution

Une fenêtre de 500 000 jetons peut contenir une base de code de taille moyenne entière ou plusieurs centaines de pages de documents. Deux précautions avant de tout y jeter :

La variante rapide (2x le prix) vaut la peine pour les chemins sensibles à la latence, comme les assistants de codage interactifs. Pour les travaux par lots, l'analyse nocturne, la classification en masse, le niveau standard est le choix évident. Le calcul complet des prix et les comparaisons avec GPT-5.6 et Claude se trouvent dans notre analyse des prix de Grok 4.5, qui s'applique toujours structurellement à la version 4.6.

Testez l'intégration correctement avec Apidog

Une commande curl fonctionnelle n'est pas une intégration. Avant que Grok 4.6 n'atteigne la production, vous voulez un endroit où les requêtes sont versionnées, les environnements séparés et les échecs reproductibles. C'est là qu'Apidog gagne sa place dans le flux de travail :

  1. Créez un projet et ajoutez un environnement avec base_url = https://api.x.ai/v1 et votre XAI_API_KEY comme variable d'environnement. Les clés de développement et de production restent clairement séparées.
  2. Créez la requête de complétion de chat une fois, avec l'authentification héritée de l'environnement. Chaque membre de l'équipe accède désormais au même point d'accès de la même manière.
  3. Inspectez le streaming visuellement. Apidog affiche les blocs SSE au fur et à mesure qu'ils arrivent, vous permettant ainsi de surveiller la sortie jeton par jeton et de repérer immédiatement les blocages ou les troncations.
  4. Ajoutez des assertions. Validez que choices[0].message.content n'est pas vide, que usage.total_tokens reste dans le budget, et que le temps de réponse respecte votre SLA, puis exécutez-les comme scénarios de test automatisés en CI.
  5. Simulez le point d'accès. Le mock intelligent d'Apidog renvoie des réponses réalistes de type Grok, de sorte que le code frontend et agent peut se développer contre un faux stable pendant que vous itérez sur les invites, sans dépenser de jetons.

Ce dernier point est plus important qu'il n'y paraît. Les boucles d'agents qui appellent le modèle des dizaines de fois par tâche deviennent coûteuses à tester contre l'API en direct. Simuler le scénario idéal et tester la vraie chose séparément maintient l'intégration continue rapide et votre facture raisonnable.

Erreurs courantes et solutions rapides

Erreur Cause probable Solution
401 Unauthorized En-tête Authorization manquant ou mal formé Vérifiez le préfixe Bearer et que la variable d'environnement est définie dans le shell que vous utilisez
404 model not found Mauvais ID de modèle pour votre fournisseur Listez /v1/models ; les revendeurs utilisent des ID différents (par exemple, x-ai/grok-4.6 sur OpenRouter)
429 Too Many Requests Limite de débit ou quota épuisé Réessayez avec un délai exponentiel ; vérifiez l'utilisation sur console.x.ai
Sortie tronquée max_tokens défini trop bas pour une longue réponse d'agent Augmentez la limite ; Grok 4.6 est bavard sur les tâches en plusieurs étapes par conception
Flux bloqué Mise en cache client, proxy supprimant les SSE Confirmez stream: true, désactivez la mise en cache du proxy, testez le flux brut dans Apidog

FAQ

L'API Grok 4.6 est-elle compatible avec OpenAI ? Oui. Le point d'accès des complétions de chat accepte la même forme de requête, et les SDK OpenAI officiels fonctionnent en pointant base_url vers https://api.x.ai/v1.

Combien coûte l'API Grok 4.6 ? 2 $ par million de jetons d'entrée et 6 $ par million de jetons de sortie. La variante plus rapide est deux fois plus chère. Il n'y a pas de frais séparés pour le contexte de 500K, vous payez pour les jetons que vous envoyez réellement.

Ai-je besoin d'une nouvelle intégration si j'utilise Grok 4.5 ? Non. Échangez le nom du modèle. Le format de requête, l'authentification et les points d'accès sont inchangés par rapport à Grok 4.5.

Puis-je utiliser Grok 4.6 sans compte xAI ? Oui, via OpenRouter, Vercel AI Gateway ou Cloudflare, chacun avec sa propre facturation. L'API native est généralement le chemin le moins cher en volume.

Pratiquez le Design-first d'API dans Apidog

Découvrez une manière plus simple de créer et utiliser des API