La gamme API complète : 4.3, 4.20 et Build 0.1
Mis à jour le 28 juillet 2026
La leçon précédente a présenté Grok 4.5 ; celle-ci replace le phare dans son contexte, car le catalogue API de xAI au 28 juillet 2026 compte six modèles de texte, et le bon choix dépend rarement du seul modèle le plus récent. Commençons par la vue d’ensemble officielle, avec les prix par palier de contexte, avant de dégager une méthode de choix.
Le catalogue (docs.x.ai, relevé du 28 juillet 2026)
| Modèle | Contexte | Entrée < 200 k | Sortie < 200 k | Entrée ≥ 200 k | Sortie ≥ 200 k |
|---|---|---|---|---|---|
grok-4.5 | 500 k | 2 $ | 6 $ | 4 $ | 12 $ |
grok-4.3 | 1 M | 1,25 $ | 2,50 $ | 2,50 $ | 5 $ |
grok-4.20-0309-reasoning | 1 M | 1,25 $ | 2,50 $ | 2,50 $ | 5 $ |
grok-4.20-0309-non-reasoning | 1 M | 1,25 $ | 2,50 $ | 2,50 $ | 5 $ |
grok-4.20-multi-agent-0309 | 1 M | 1,25 $ | 2,50 $ | 2,50 $ | 5 $ |
grok-build-0.1 | 256 k | 1 $ | 2 $ | 2 $ | 4 $ |
(Prix par million de tokens.)
Première observation, avant même d’entrer dans le détail des modèles : la tarification à palier n’est pas une particularité de Grok 4.5. Les six modèles suivent la même mécanique — le prix change autour de 200 000 tokens de contexte — avec des montants différents. Le réflexe de surveillance des tailles de contexte vu à la leçon précédente vaut donc pour toute la gamme.
Comment lire cette gamme
En tête de catalogue, grok-4.5 incarne la capacité maximale : code, agents, travail de connaissance, avec son raisonnement configurable. C’est le modèle que xAI met en avant, et c’est le plus cher du catalogue texte. Sa fenêtre de 500 k tokens, confortable dans l’absolu, est pourtant la moitié de celle des modèles qui le suivent dans le tableau — nous y revenons dans un instant.
Juste en dessous, grok-4.3 joue le rôle du généraliste économique à très grand contexte. Un million de tokens de fenêtre pour 1,25 $ / 2,50 $ sous le palier : c’est le modèle de l’ingestion massive et de l’analyse de corpus. Quand la question est « comment faire tenir tout ce volume dans une seule requête ? », c’est vers lui — ou vers les 4.20 — qu’il faut regarder, pas vers le phare.
Reste à comprendre la raison d’être des trois variantes grok-4.20, car elles partagent exactement le contexte et les prix de 4.3. Ce qu’elles apportent, c’est le contrôle fin du mode d’exécution : la variante reasoning réfléchit avant de répondre, la non-reasoning répond directement — plus vite, pour les tâches qui n’exigent pas de raisonnement profond —, et la multi-agent orchestre plusieurs agents. Vous choisissez donc explicitement le comportement, là où d’autres modèles décident pour vous. C’est la génération que nos cours existants détaillent, et elle n’a pas disparu avec l’arrivée de 4.5.
Enfin, grok-build-0.1 est un cas à part : c’est le modèle de code le plus rapide de la gamme, en bêta publique sur l’API depuis le 1er juin, et le moteur historique de l’agent Grok Build. Avec ses 256 k de contexte et son tarif plancher (1 $ / 2 $ sous le palier), il est taillé pour le code à haut débit — les usages où l’on enchaîne beaucoup de requêtes et où la latence et le coût comptent plus que la capacité brute.
Ce qui change pour vos choix
La conséquence pratique de ce catalogue, c’est que la question n’est plus « quel Grok ? » mais « quel couple contexte/capacité ? ». Si la capacité prime — raisonnement exigeant, agents, code complexe —, partez sur grok-4.5, en surveillant le palier des 200 k qui double la facture. Si c’est le contexte qui prime, parce que vous devez charger un million de tokens d’un coup, grok-4.3 est le choix naturel, ou une variante 4.20 si vous avez en plus besoin du contrôle reasoning / multi-agent. Et si votre besoin est du code à haut débit au meilleur coût, grok-build-0.1 est fait pour cela.
Un mot enfin sur nos cours existants : « Guide des modèles Grok » et « Multi-agent research » décrivent la génération 4.20. Tout ce qu’ils disent reste exact — mais cette génération n’est plus seule dans le catalogue. Quand vous les suivrez, replacez simplement les modèles 4.20 dans le tableau ci-dessus : ils y occupent la position du milieu, entre le phare et le spécialiste du code.
Source officielle : docs.x.ai/docs/models
Tarifs relevés le 5 août 2026 — les prix évoluent régulièrement : avant tout calcul de budget, vérifiez la grille en vigueur sur la page officielle des modèles et tarifs xAI.
Points clés à retenir
- Six modèles texte : 4.5 (500 k), 4.3 et trois variantes 4.20 (1 M), build-0.1 (256 k)
- Tous suivent une tarification à palier autour de 200 k tokens de contexte
- Les variantes 4.20 gardent l’intérêt du contrôle reasoning / non-reasoning / multi-agent
grok-build-0.1est le modèle de code rapide et économique