Grok 4.20 : le modèle phare
Le sommet de la gamme Grok
Grok 4.20, lancé en mars 2026, représente le modèle le plus puissant de xAI. Disponible en deux variantes — reasoning et non-reasoning — il offre une fenêtre de contexte de 2 millions de tokens et des capacités de raisonnement parmi les plus avancées du marché.
Que vous construisiez un agent complexe, analysiez des documents volumineux ou résolviez des problèmes mathématiques, Grok 4.20 est conçu pour les tâches qui exigent une réflexion approfondie.
Deux variantes : reasoning et non-reasoning
Grok 4.20 existe en deux versions distinctes, chacune avec un identifiant API propre :
grok-4.20-0309-reasoning
La variante reasoning engage un processus de réflexion interne avant de produire sa réponse. Ce raisonnement est dit « chiffré » : vous ne pouvez pas lire les étapes intermédiaires en clair, mais vous pouvez récupérer une version chiffrée pour maintenir la continuité entre les requêtes.
Cette variante excelle sur les problèmes complexes : mathématiques, logique formelle, analyse de code, questions multi-étapes. Le raisonnement consomme des tokens de sortie supplémentaires, ce qui augmente le coût par requête, mais améliore significativement la qualité des réponses.
Attention : en mode reasoning, certains paramètres API sont interdits. L’utilisation de presencePenalty, frequencyPenalty ou stop provoquera une erreur. Si vous migrez depuis un modèle non-reasoning, pensez à retirer ces paramètres de vos requêtes.
grok-4.20-0309-non-reasoning
La variante non-reasoning répond directement sans phase de réflexion interne. Elle est plus rapide, consomme moins de tokens et supporte tous les paramètres API standard.
Utilisez-la pour les tâches qui ne nécessitent pas de raisonnement complexe : rédaction, résumé, traduction, classification, extraction d’informations structurées.
Le raisonnement chiffré en pratique
Le raisonnement chiffré est une spécificité de xAI. Contrairement à d’autres fournisseurs qui affichent la « chaîne de pensée » en clair, Grok 4.20 garde ses réflexions internes confidentielles. Vous pouvez toutefois récupérer une version chiffrée via le paramètre include :
response = client.responses.create(
model="grok-4.20-0309-reasoning",
input="Démontrez que la racine carrée de 2 est irrationnelle",
include=["reasoning.encrypted_content"]
)
Ce contenu chiffré peut être réinjecté dans les requêtes suivantes pour que le modèle reprenne le fil de son raisonnement — une sorte de « cache de pensée » qui permet des conversations cohérentes sur des sujets complexes.
Les tokens de raisonnement
Les tokens consommés par le processus de raisonnement sont comptabilisés séparément dans la réponse API :
{
"usage": {
"completion_tokens_details": {
"reasoning_tokens": 1250
}
}
}
Ces tokens sont facturés au même tarif que les tokens de sortie ($6.00 par million). Pour une requête complexe, le raisonnement peut représenter une part significative du coût total.
Le paramètre max_completion_tokens limite la somme des tokens visibles et des tokens de raisonnement. Si cette limite est trop basse, le modèle pourrait tronquer sa réponse après avoir épuisé son budget en raisonnement.
Recommandation : pour les requêtes complexes, prévoyez un timeout d’au moins 3 600 secondes. Le raisonnement peut prendre du temps sur les problèmes difficiles.
Grok 4.20 Multi-agent
xAI propose également grok-4.20-multi-agent-0309, une variante optimisée pour l’orchestration de plusieurs agents. Ce modèle partage les mêmes tarifs et la même fenêtre de contexte que Grok 4.20 standard, mais il est spécialement calibré pour coordonner des sous-agents, gérer des flux de travail parallèles et synthétiser les résultats de multiples sources.
Entrée multimodale
Grok 4.20 accepte du texte et des images en entrée. Les images doivent être au format JPG ou PNG, avec une taille maximale de 20 MiB. Chaque image consomme entre 256 et 1 792 tokens selon ses dimensions et le niveau de détail demandé.
La sortie reste exclusivement textuelle — Grok 4.20 ne génère pas d’images. Pour la génération visuelle, vous utiliserez les modèles Grok Imagine dédiés.
Points clés à retenir
- Grok 4.20 est le modèle le plus puissant de xAI, avec 2M tokens de contexte
- La variante reasoning utilise un raisonnement chiffré non visible en clair
- La variante non-reasoning est plus rapide et moins coûteuse
- Les paramètres
presencePenalty,frequencyPenaltyetstopsont interdits en mode reasoning - Le cache automatique réduit le coût des tokens en entrée de 90 % ($0.20 au lieu de $2.00)
- La variante Multi-agent est optimisée pour l’orchestration de sous-agents