xAI a lancé Grok 4.6 le 12 août 2026. Le modèle cible les agents à exécution longue et les tâches de code en plusieurs étapes, avec un prix de 2 $ par million de jetons d’entrée et 6 $ par million de jetons de sortie. La documentation officielle couvre les éléments de référence, mais ce guide montre comment appeler l’API de bout en bout.
Essayez Apidog dès aujourd’hui
À la fin de ce tutoriel, vous aurez une clé API, des requêtes fonctionnelles avec curl, Python et JavaScript, une sortie en streaming, ainsi qu’une configuration reproductible pour tester les endpoints de Grok 4.6 avant la production. Si vous préférez construire et déboguer vos requêtes visuellement plutôt que de jongler entre plusieurs terminaux, Apidog couvre tout le flux.
TL;DR
- Créez une clé API sur console.x.ai, stockez-la dans
XAI_API_KEY, puis appelezhttps://api.x.ai/v1/chat/completionsavec le modèlegrok-4-6. - L’API est compatible avec OpenAI : utilisez les SDK OpenAI officiels en modifiant simplement l’URL de base.
- Grok 4.6 propose une fenêtre de contexte de 500 000 jetons et une date limite de connaissances au 1er février 2026.
- Prix : 2 $ / million de jetons d’entrée et 6 $ / million de jetons de sortie. La variante rapide coûte deux fois plus cher.
- Grok 4.6 est également disponible via OpenRouter, Vercel, Cloudflare, Cursor et Grok Build.
- Testez les requêtes, inspectez les flux SSE et simulez les endpoints Grok en CI avec Apidog.
Ce avec quoi vous travaillez
Avant d’intégrer le modèle, vérifiez les caractéristiques qui influencent l’architecture et le budget :
| Spécification | Grok 4.6 |
|---|---|
| Date de sortie | 12 août 2026 |
| Fenêtre de contexte | 500 000 jetons |
| Date limite de connaissances | 1er février 2026 |
| Prix d’entrée | 2 $ / 1M de jetons |
| Prix de sortie | 6 $ / 1M de jetons |
| Variante rapide | 2× le prix |
| Style d’API | REST compatible OpenAI |
| Disponibilité | API xAI, OpenRouter, Vercel, Cloudflare, Cursor, Grok Build |
Les améliorations par rapport à Grok 4.5 concernent principalement les agents. xAI indique que le modèle vérifie davantage son travail lors de longues trajectoires et produit de meilleurs premiers essais sur les projets interactifs et visuels.
Sur les benchmarks, Grok 4.6 passe de 54 % à 65,9 % sur DeepSWE v1.1 et de 47,1 % à 57,5 % sur APEX-Agents. Si vous utilisez déjà Grok 4.5, la surface d’intégration ne change pas : consultez le guide de l’API Grok 4.5, puis remplacez le nom du modèle.
Étape 1 : obtenez votre clé API
- Ouvrez console.x.ai, puis connectez-vous ou créez un compte xAI.
- Dans la barre latérale, ouvrez API Keys, puis cliquez sur Create API Key.
- Donnez à la clé un nom lié à son environnement, par exemple
grok-devougrok-prod. - Copiez la clé immédiatement : xAI ne l’affiche qu’une seule fois.
Stockez-la dans une variable d’environnement, jamais directement dans le code :
export XAI_API_KEY="your-key-here"
Utilisez des clés distinctes pour le développement et la production. N’ajoutez jamais une clé au contrôle de version. En cas de fuite, révoquez-la dans la console et générez-en une nouvelle.
Étape 2 : envoyez votre première requête avec curl
L’API xAI suit le format des Chat Completions d’OpenAI. Voici une requête minimale :
curl https://api.x.ai/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $XAI_API_KEY" \
-d '{
"model": "grok-4-6",
"messages": [
{"role": "system", "content": "You are a concise technical assistant."},
{"role": "user", "content": "Explain idempotency in REST APIs in two sentences."}
]
}'
Une réponse réussie contient notamment :
-
choices, avec la réponse de l’assistant ; -
usage, avec le nombre de jetons d’entrée et de sortie.
Enregistrez usage dès le début : c’est la donnée à suivre pour contrôler la facturation.
Les identifiants de modèle peuvent varier selon le fournisseur. Par exemple, OpenRouter liste ce modèle sous x-ai/grok-4.6. Si vous obtenez une erreur model not found, listez les modèles accessibles avec votre clé :
curl https://api.x.ai/v1/models \
-H "Authorization: Bearer $XAI_API_KEY"
Étape 3 : utilisez Python ou JavaScript
La compatibilité OpenAI permet de conserver les SDK officiels. Il suffit de fournir la clé xAI et de remplacer l’URL de base.
Python
from openai import OpenAI
import os
client = OpenAI(
api_key=os.environ["XAI_API_KEY"],
base_url="https://api.x.ai/v1",
)
response = client.chat.completions.create(
model="grok-4-6",
messages=[
{"role": "system", "content": "You are a concise technical assistant."},
{"role": "user", "content": "Write a Python function that validates an email address."},
],
)
print(response.choices[0].message.content)
print(response.usage)
JavaScript / TypeScript
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.XAI_API_KEY,
baseURL: "https://api.x.ai/v1",
});
const response = await client.chat.completions.create({
model: "grok-4-6",
messages: [
{ role: "system", content: "You are a concise technical assistant." },
{ role: "user", content: "Write a TypeScript type guard for a User object." },
],
});
console.log(response.choices[0].message.content);
Cette compatibilité rend aussi les tests A/B simples. Si vous utilisez déjà l’API GPT-5.6, placez le fournisseur et le nom du modèle derrière une variable de configuration :
const provider = process.env.LLM_PROVIDER;
const config = provider === "xai"
? { baseURL: "https://api.x.ai/v1", model: "grok-4-6" }
: { baseURL: "https://api.openai.com/v1", model: "gpt-5.6" };
Étape 4 : diffusez les réponses en streaming
Pour les interfaces utilisateur et les sorties longues, activez le streaming. Cela évite d’afficher un simple indicateur de chargement pendant la génération d’une réponse de plusieurs milliers de jetons.
stream = client.chat.completions.create(
model="grok-4-6",
messages=[
{
"role": "user",
"content": "Refactor this function and explain each change: ..."
}
],
stream=True,
)
for chunk in stream:
delta = chunk.choices[0].delta.content
if delta:
print(delta, end="", flush=True)
Les réponses arrivent sous forme d’événements envoyés par le serveur (SSE). En pratique :
- activez
stream=True; - affichez chaque fragment
delta.contentdès sa réception ; - gérez les fragments vides ;
- vérifiez que votre proxy ne met pas en cache ou ne supprime pas les événements SSE.
Les flux sont difficiles à analyser dans un terminal lorsque vous déboguez. Apidog affiche les événements SSE en temps réel dans le panneau de réponse, ce qui aide à distinguer un délai de génération du modèle d’un problème de cache ou de proxy côté client.
Étape 5 : utilisez le contexte de 500K avec précaution
Une fenêtre de 500 000 jetons peut contenir une base de code moyenne complète ou plusieurs centaines de pages de documentation. Cela ne signifie pas qu’il faut systématiquement tout envoyer.
Deux règles pratiques :
- Contrôlez le coût d’entrée. À 2 $ par million de jetons d’entrée, une requête de 500K jetons coûte environ 1 $ avant toute génération. Pour les requêtes répétées sur le même corpus, mettez en cache les résultats ou récupérez uniquement les documents pertinents.
- Structurez le prompt. Placez les instructions au début, les documents de référence au milieu et la question finale à la fin. Cette disposition améliore la récupération des informations dans les contextes longs.
La variante rapide, deux fois plus chère, convient aux flux sensibles à la latence comme les assistants de code interactifs. Pour les traitements par lots, l’analyse nocturne ou la classification à grande échelle, le niveau standard est généralement plus adapté.
Pour les calculs de coût et les comparaisons avec GPT-5.6 et Claude, consultez l’analyse des prix de Grok 4.5, dont la structure reste applicable à Grok 4.6.
Testez l’intégration correctement avec Apidog
Une commande curl qui fonctionne ne suffit pas pour une intégration prête pour la production. Vous devez versionner les requêtes, séparer les environnements et reproduire les échecs.
Apidog peut centraliser ce flux de travail :
- Créez un projet et un environnement avec :
base_url = https://api.x.ai/v1-
XAI_API_KEYcomme variable d’environnement.
- Créez une requête
POST /chat/completionset utilisez l’authentification héritée de l’environnement. - Inspectez les réponses SSE dans l’interface pour vérifier les fragments, les blocages et les troncations.
- Ajoutez des assertions sur :
-
choices[0].message.contentnon vide ; -
usage.total_tokensdans le budget ; - le temps de réponse conforme à votre SLA.
-
- Simulez l’endpoint afin de développer le frontend et les agents contre une réponse stable sans consommer de jetons à chaque exécution.
Ce dernier point est particulièrement utile pour les boucles d’agents qui appellent le modèle plusieurs dizaines de fois par tâche. Utilisez un mock pour les tests d’intégration fréquents, puis réservez les appels réels aux validations ciblées.
Erreurs courantes et solutions rapides
| Erreur | Cause probable | Solution |
|---|---|---|
401 Unauthorized |
En-tête Authorization absent ou mal formé |
Vérifiez le préfixe Bearer et assurez-vous que XAI_API_KEY est défini dans le shell actif. |
404 model not found |
ID de modèle incorrect pour votre fournisseur | Appelez /v1/models. Les revendeurs peuvent employer des IDs différents, par exemple x-ai/grok-4.6 sur OpenRouter. |
429 Too Many Requests |
Limite de débit ou quota épuisé | Réessayez avec un délai exponentiel et vérifiez l’utilisation sur console.x.ai. |
| Sortie tronquée |
max_tokens trop faible pour une réponse longue |
Augmentez la limite de sortie pour les tâches d’agent en plusieurs étapes. |
| Flux bloqué | Cache client ou proxy supprimant les SSE | Confirmez stream: true, désactivez le cache du proxy et testez le flux brut dans Apidog. |
FAQ
L’API Grok 4.6 est-elle compatible avec OpenAI ?
Oui. L’endpoint Chat Completions accepte le même format de requête, et les SDK OpenAI fonctionnent en pointant base_url vers https://api.x.ai/v1.
Combien coûte l’API Grok 4.6 ?
Le prix est de 2 $ par million de jetons d’entrée et 6 $ par million de jetons de sortie. La variante rapide coûte deux fois plus cher. Il n’y a pas de frais distincts pour le contexte de 500K : vous payez les jetons effectivement envoyés et générés.
Dois-je créer une nouvelle intégration si j’utilise déjà Grok 4.5 ?
Non. Remplacez le nom du modèle. Le format de requête, l’authentification et les endpoints restent identiques à ceux de Grok 4.5.
Puis-je utiliser Grok 4.6 sans compte xAI ?
Oui, via OpenRouter, Vercel AI Gateway ou Cloudflare, chacun avec son propre système de facturation. L’API native est généralement le chemin le moins coûteux pour un volume important.


Top comments (0)