Aller au contenu principal

Paramètres de requête

Contrôler le comportement du modèle

Au-delà de model, input et instructions, la Responses API offre de nombreux paramètres pour ajuster finement le comportement de Grok. Comprendre ces paramètres vous permettra d’obtenir des réponses plus pertinentes, plus courtes ou plus créatives selon vos besoins.

Paramètres de génération

temperature

Contrôle le caractère aléatoire des réponses. Valeur entre 0 et 2.

{
  "model": "grok-4.20-reasoning",
  "input": "Écris un slogan pour une boulangerie.",
  "temperature": 0.2
}
  • 0 : réponses déterministes, toujours la même sortie
  • 0.7 (défaut) : bon équilibre créativité/cohérence
  • 1.5+ : réponses très créatives mais potentiellement incohérentes

Pour du code ou de l’analyse factuelle, utilisez une température basse (0-0.3). Pour de la rédaction créative, montez à 0.8-1.2.

top_p

Échantillonnage nucleus — une alternative à temperature. Valeur entre 0 et 1.

{
  "model": "grok-4.20-reasoning",
  "input": "Résume cet article.",
  "top_p": 0.9
}

Avec top_p: 0.9, le modèle considère uniquement les tokens qui cumulent 90% de probabilité. En pratique, ajustez soit temperature, soit top_p, mais pas les deux en même temps.

max_output_tokens

Limite le nombre de tokens en sortie, raisonnement inclus :

{
  "model": "grok-4.20-reasoning",
  "input": "Explique la relativité générale.",
  "max_output_tokens": 500
}

Attention : pour les modèles de raisonnement (grok-4), cette limite inclut les tokens de réflexion interne. Si vous fixez 500 tokens, le modèle pourrait en utiliser 400 pour raisonner et ne produire que 100 tokens de réponse visible.

reasoning

Pour les modèles qui supportent le raisonnement, vous pouvez ajuster l’effort :

{
  "model": "grok-4.20-reasoning",
  "input": "Résous ce problème de logique.",
  "reasoning": {"effort": "high"}
}

Les valeurs possibles sont low, medium et high. Un effort élevé consomme plus de tokens mais donne de meilleurs résultats sur les problèmes complexes.

Paramètres de conversation

store

Détermine si la réponse est conservée côté serveur :

{
  "model": "grok-4.20-reasoning",
  "input": "Analyse ce contrat.",
  "store": false
}
  • true : réponse stockée 30 jours, récupérable via GET, utilisable avec previous_response_id
  • false : réponse non persistée (mode privé)

previous_response_id

Chaîne une nouvelle requête à une conversation existante (détaillé dans la leçon 5).

user

Identifiant de l’utilisateur final, utile pour le suivi et la modération :

{
  "model": "grok-4.20-reasoning",
  "input": "Bonjour",
  "user": "user-12345"
}

Paramètres d’outils

tools, tool_choice, parallel_tool_calls, max_turns

Ces paramètres contrôlent l’utilisation des outils (web_search, code_interpreter, fonctions custom). Ils sont couverts en détail dans la section “Outils” (leçons 9-12).

Récapitulatif des paramètres

ParamètreTypeDéfautUsage
modelstringrequisIdentifiant du modèle
inputstring/arrayrequisPrompt utilisateur
instructionsstringnullPrompt système
temperaturenumber~0.7Créativité (0-2)
top_pnumber1Échantillonnage nucleus
max_output_tokensintegernullLimite de tokens sortie
reasoningobjectnullEffort de raisonnement
storebooleannullPersistance 30 jours
streambooleanfalseStreaming SSE
userstringnullID utilisateur final

Points clés à retenir

  • temperature et top_p contrôlent la créativité — ajustez l’un ou l’autre, pas les deux
  • max_output_tokens inclut les tokens de raisonnement pour les modèles grok-4
  • store: true persiste la réponse 30 jours pour le chaînage de conversations
  • reasoning.effort permet de doser la réflexion du modèle selon la complexité de la tâche
  • Le paramètre user aide au suivi et à la modération côté xAI