Aller au contenu principal

L'API xAI pour les développeurs

Mis à jour le 29 juillet 2026

Intégrer Grok dans vos applications

Tout ce que vous avez appris à faire dans l’interface de Grok peut être déclenché depuis votre propre code. L’API xAI intègre ces capacités dans vos applications, vos sites web et vos services : la conversation cesse d’être un endroit où l’on va, elle devient une fonction que votre produit appelle.

Prérequis

Quatre éléments doivent être réunis avant d’écrire la première ligne de code :

  1. Un compte xAI créé sur accounts.x.ai
  2. Une clé API générée sur console.x.ai
  3. Un moyen de paiement configuré (pour dépasser le quota gratuit)
  4. Un environnement de développement Python ou JavaScript

Les deux premiers relèvent de ce que vous avez déjà fait dans cette formation : le compte sert à l’authentification, la clé identifie votre application auprès de l’API. Le moyen de paiement n’entre en jeu qu’au moment où votre consommation dépasse le quota gratuit, ce qui arrive plus vite qu’on ne le croit dès qu’un service tourne en continu. Quant à l’environnement, Python et JavaScript sont les deux langages les mieux outillés, mais l’API répondant en HTTP, n’importe quel langage capable d’émettre une requête fait l’affaire.

Configuration initiale

La première étape consiste à stocker votre clé API de manière sécurisée, dans une variable d’environnement :

export XAI_API_KEY="xai-votre-cle-ici"

Ne codez jamais votre clé en dur dans votre code source. La raison est prosaïque : une clé écrite dans un fichier finit tôt ou tard dans un dépôt Git, et une clé poussée sur un dépôt public est exploitée en quelques minutes par des robots qui scrutent les commits — la facture, elle, reste à votre nom.

Vient ensuite le choix du SDK. Le SDK natif xAI en Python s’installe avec pip install xai-sdk. Si votre code appelle déjà OpenAI, la bibliothèque openai fonctionne telle quelle grâce à la compatibilité de format. Côté JavaScript, le Vercel AI SDK s’ajoute avec npm install ai @ai-sdk/xai et s’intègre aux applications React et Next.js.

Votre première requête

Avec le SDK natif, la création du client et l’ouverture d’une conversation tiennent en trois lignes :

from xai_sdk import Client
import os

client = Client(api_key=os.getenv("XAI_API_KEY"))
response = client.chat.create(model="grok-4.5")

La voie de la compatibilité OpenAI est tout aussi directe : seul le base_url change par rapport à un code existant, ce qui explique que beaucoup d’équipes basculent en quelques minutes.

from openai import OpenAI
import os

client = OpenAI(
    api_key=os.getenv("XAI_API_KEY"),
    base_url="https://api.x.ai/v1"
)

response = client.responses.create(
    model="grok-4.5",
    input="Explique-moi le machine learning en 3 phrases."
)

Pour vérifier qu’une clé fonctionne avant même d’écrire du code, rien ne vaut un appel en ligne de commande :

curl https://api.x.ai/v1/responses \
  -H "Authorization: Bearer $XAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.5",
    "input": "Bonjour, comment vas-tu ?"
  }'

Ce que l’API expose

Le socle est la génération de texte — réponses conversationnelles, rédaction, analyse — doublée d’un mode de raisonnement qui résout les problèmes complexes étape par étape. Le streaming s’y ajoute en délivrant la réponse token par token au lieu d’attendre la fin de la génération.

Un deuxième ensemble donne accès à l’information : la recherche web et X en temps réel, et le RAG, qui interroge des collections de documents que vous avez constituées. Le volet multimodal couvre la compréhension d’images fournies en entrée, la génération d’images et de vidéos via grok-imagine, et la voix, avec les conversations vocales et le TTS.

Trois mécanismes rendent enfin l’API programmable au sens strict : le function calling, qui laisse le modèle appeler vos propres fonctions, les sorties structurées, qui garantissent un JSON exploitable sans post-traitement fragile, et l’exécution de code côté serveur.

Choisir son modèle

Le raisonnement se décline selon le modèle. grok-4.5, le modèle phare, propose un raisonnement configurable : un paramètre d’effort décide de la profondeur de réflexion, requête par requête. grok-4.3 reste l’option économique et à très long contexte, environ deux fois moins chère. Les mêmes modèles existent en version non-reasoning, adaptée aux tâches simples — une reformulation ou une classification n’ont pas besoin de délibération interne.

Les conventions de nommage engagent la stabilité de votre application :

  • grok-4.20 : dernière version stable recommandée
  • grok-4.20-latest : version la plus récente (peut changer)
  • grok-4.20-0309 : version figée à une date précise (9 mars)

En production, une version figée protège vos prompts d’une évolution silencieuse du modèle ; latest convient à l’exploration, à condition d’accepter que le comportement bouge.

Débit et bonnes pratiques

L’API impose des limites de débit pour garantir un service stable : 10 millions de tokens par minute et 1 800 requêtes par minute. Les modèles de génération d’images et de vidéos relèvent de plafonds spécifiques, de 30 à 300 requêtes par minute selon le modèle — bien plus bas, donc à surveiller sur un service grand public.

Quelques réflexes séparent le prototype de l’intégration solide. Activez le streaming sur les réponses longues, car attendre trente secondes devant un écran vide est perçu comme une panne. Transmettez un identifiant de conversation pour bénéficier du cache. Routez chaque tâche vers le bon modèle, grok-4.3 pour le volume simple et grok-4.20 pour le raisonnement. Gérez les erreurs avec des retries à backoff exponentiel, faute de quoi un pic de charge se transforme en avalanche de requêtes rejetées. Et surveillez votre consommation dans la console avant d’en découvrir le montant en fin de mois.

Points clés à retenir

  • L’API xAI est compatible avec le format OpenAI, facilitant la migration
  • Plusieurs SDKs sont disponibles : xAI natif, OpenAI, Vercel AI SDK
  • L’API couvre le texte, les images, les vidéos, la voix et la recherche
  • Deux niveaux de modèles : grok-4.5 (phare, raisonnement configurable) et grok-4.3 (économique, 1M de contexte)
  • Stockez toujours votre clé API dans une variable d’environnement, jamais en dur dans le code