Reasoning vs Non-reasoning
Deux approches fondamentalement différentes
Chaque modèle texte de la gamme Grok (Grok 4.20 et Grok 4-1 Fast) est disponible en deux variantes : reasoning et non-reasoning. Ce choix n’est pas cosmétique — il modifie fondamentalement le comportement du modèle, ses capacités, son coût et ses contraintes API. Choisir la bonne variante pour chaque tâche est une compétence clé.
Comment fonctionne le reasoning
Quand vous utilisez une variante reasoning, le modèle s’engage dans un processus de réflexion interne avant de produire sa réponse. Il décompose le problème, explore différentes approches, vérifie sa logique et construit sa réponse étape par étape.
Chez xAI, ce raisonnement est « chiffré » pour les modèles Grok 4 et supérieurs : vous ne pouvez pas lire les étapes intermédiaires en clair. Vous pouvez toutefois :
- Récupérer le contenu chiffré via
include=["reasoning.encrypted_content"]pour le réinjecter dans les requêtes suivantes - Consulter le nombre de tokens de raisonnement dans
usage.completion_tokens_details.reasoning_tokens
Le raisonnement consomme des tokens de sortie supplémentaires. Une requête reasoning peut donc coûter 2 à 5 fois plus qu’une requête non-reasoning identique, selon la complexité du problème.
Paramètres interdits en mode reasoning
C’est un piège fréquent lors de la migration. Les variantes reasoning ne supportent pas certains paramètres qui sont courants en mode non-reasoning :
| Paramètre | Non-reasoning | Reasoning |
|---|---|---|
| presencePenalty | Supporté | Interdit (erreur) |
| frequencyPenalty | Supporté | Interdit (erreur) |
| stop | Supporté | Interdit (erreur) |
| logprobs | Non supporté (Grok 4.20) | Non supporté |
| max_completion_tokens | Supporté | Supporté (inclut reasoning) |
Si vous passez presencePenalty, frequencyPenalty ou stop à une variante reasoning, l’API retournera une erreur. Assurez-vous de retirer ces paramètres de vos requêtes quand vous basculez vers le reasoning.
Quand utiliser le reasoning
Le reasoning apporte une valeur ajoutée claire sur certaines catégories de tâches :
- Mathématiques et logique formelle — résolution d’équations, preuves, optimisation
- Analyse de code complexe — debugging avec interdépendances, audit de sécurité
- Questions multi-étapes — problèmes qui nécessitent de construire un raisonnement en plusieurs phases
- Décisions nuancées — évaluation de pour et contre, analyse comparative approfondie
- Expertise quantitative — statistiques, modélisation financière, analyse de données
Quand utiliser le non-reasoning
Le non-reasoning est préférable quand la tâche ne nécessite pas de réflexion approfondie :
- Rédaction et résumé — le modèle n’a pas besoin de « réfléchir » pour rédiger
- Classification et tagging — catégorisation rapide de contenus
- Extraction d’informations — structurer des données depuis du texte brut
- Traduction — le modèle sait traduire sans raisonnement explicite
- Conversation simple — chatbots, FAQ, assistance de premier niveau
- Génération de contenu — emails, descriptions, copy marketing
Stratégie de routage
En production, la stratégie optimale consiste à router dynamiquement les requêtes vers la bonne variante :
- Analysez la requête — détermine-t-elle un calcul, une analyse ou un simple traitement ?
- Routing par défaut vers non-reasoning — c’est plus rapide et moins cher
- Basculez vers reasoning quand la requête implique un raisonnement multi-étapes
- Monitorez les résultats — ajustez les critères de routage en fonction de la qualité observée
Cette approche vous permet de bénéficier de la puissance du reasoning quand c’est nécessaire, sans en payer le surcoût quand c’est superflu.
Le cas particulier de max_completion_tokens
En mode reasoning, le paramètre max_completion_tokens limite la somme des tokens visibles ET des tokens de raisonnement. Si vous fixez une limite trop basse, le modèle risque d’épuiser son budget en raisonnement interne et de tronquer la réponse visible.
Pour les tâches de raisonnement complexes, augmentez généreusement cette limite. Il vaut mieux payer pour une réponse complète que pour une réponse tronquée qui nécessitera un second appel.
Points clés à retenir
- Les variantes reasoning ajoutent une phase de réflexion interne avant de répondre
- Le raisonnement est chiffré (non visible) sur Grok 4 et Grok 4.20
presencePenalty,frequencyPenaltyetstopsont interdits en mode reasoning- Le reasoning coûte 2 à 5 fois plus que le non-reasoning
- Utilisez le reasoning pour les maths, la logique et les problèmes multi-étapes
- Utilisez le non-reasoning pour la rédaction, la classification et l’extraction