Aller au contenu principal

Grok-4 et grok-4.20-reasoning : raisonnement chiffré

Les modèles de raisonnement avancé

Les modèles grok-4, grok-4-fast-reasoning et grok-4.20-reasoning représentent la gamme haute du raisonnement chez xAI. Contrairement à grok-3-mini, leur processus de réflexion interne n’est pas accessible en clair. Vous recevez uniquement la réponse finale, le raisonnement restant une boîte noire.

Cela ne signifie pas que le raisonnement est absent. Au contraire, ces modèles mobilisent des capacités de réflexion significativement plus puissantes que grok-3-mini. La différence réside dans la visibilité : le raisonnement existe, mais il est chiffré.

Pourquoi le raisonnement est-il chiffré ?

Le chiffrement du raisonnement interne répond à plusieurs objectifs techniques et stratégiques :

  • Protection de la propriété intellectuelle : le processus de raisonnement interne constitue une innovation que xAI protège
  • Réduction du risque d’extraction : empêcher l’ingénierie inverse des mécanismes de pensée du modèle
  • Optimisation : le format chiffré permet une compression efficace pour la réutilisation

Du point de vue développeur, cela signifie que vous ne pouvez pas inspecter directement le raisonnement. Mais vous pouvez le récupérer sous forme chiffrée et le réutiliser dans les requêtes suivantes.

Récupérer le raisonnement chiffré

Pour obtenir le contenu chiffré du raisonnement, vous devez utiliser l’API Responses avec le paramètre include :

from openai import OpenAI

client = OpenAI(
    api_key="votre-cle-api",
    base_url="https://api.x.ai/v1"
)

response = client.responses.create(
    model="grok-4.20-reasoning",
    input="Prouvez que la somme des angles d'un triangle est 180 degrés.",
    include=["reasoning.encrypted_content"]
)

La réponse contiendra un champ avec le contenu chiffré du raisonnement. Ce contenu est un blob binaire encodé que vous ne pouvez pas lire directement, mais que vous pouvez stocker et réutiliser.

Les trois modèles et leurs caractéristiques

grok-4

Le modèle de référence pour le raisonnement avancé. Il offre un bon équilibre entre profondeur de réflexion et vitesse de réponse. C’est le choix par défaut pour les tâches qui nécessitent un raisonnement complexe sans contrainte de temps stricte.

grok-4-fast-reasoning

Une variante optimisée pour la vitesse. Le raisonnement reste chiffré, mais le modèle est calibré pour fournir des réponses plus rapides. Le compromis se fait sur la profondeur de réflexion : pour des problèmes extrêmement complexes, grok-4 ou grok-4.20-reasoning sera préférable.

Côté tarification, il est nettement plus économique : 0,20 $ par million de tokens en entrée contre 2,00 $ pour grok-4.20-reasoning.

grok-4.20-reasoning

Le modèle le plus récent et le plus puissant de la gamme raisonnement. Il bénéficie des dernières améliorations de xAI et offre la réflexion la plus approfondie. Recommandé pour les problèmes mathématiques complexes, l’analyse de code multi-fichiers et les chaînes de raisonnement longues.

Différences pratiques avec grok-3-mini

Caractéristiquegrok-3-minigrok-4 / grok-4.20-reasoning
Raisonnement visibleOui (reasoning_content)Non
Raisonnement chiffréNonOui (include=["reasoning.encrypted_content"])
reasoning_effort (corps requête)low / highNon supporté
API Responses reasoningNonOui (effort, generate_summary, summary)
Puissance de raisonnementCorrecteÉlevée à très élevée

Points clés à retenir

  • Les modèles grok-4 offrent un raisonnement plus puissant que grok-3-mini, mais chiffré
  • Le raisonnement chiffré se récupère via include=["reasoning.encrypted_content"]
  • grok-4-fast-reasoning est 10x moins cher que grok-4.20-reasoning
  • Le contenu chiffré peut être réutilisé dans les requêtes suivantes (leçon 7)
  • Le contrôle du raisonnement sur grok-4 passe par l’API Responses, pas par reasoning_effort