Paramètres de requête
Contrôler le comportement du modèle
Au-delà de model, input et instructions, la Responses API offre de nombreux paramètres pour ajuster finement le comportement de Grok. Comprendre ces paramètres vous permettra d’obtenir des réponses plus pertinentes, plus courtes ou plus créatives selon vos besoins.
Paramètres de génération
temperature
Contrôle le caractère aléatoire des réponses. Valeur entre 0 et 2.
{
"model": "grok-4.20-reasoning",
"input": "Écris un slogan pour une boulangerie.",
"temperature": 0.2
}
- 0 : réponses déterministes, toujours la même sortie
- 0.7 (défaut) : bon équilibre créativité/cohérence
- 1.5+ : réponses très créatives mais potentiellement incohérentes
Pour du code ou de l’analyse factuelle, utilisez une température basse (0-0.3). Pour de la rédaction créative, montez à 0.8-1.2.
top_p
Échantillonnage nucleus — une alternative à temperature. Valeur entre 0 et 1.
{
"model": "grok-4.20-reasoning",
"input": "Résume cet article.",
"top_p": 0.9
}
Avec top_p: 0.9, le modèle considère uniquement les tokens qui cumulent 90% de probabilité. En pratique, ajustez soit temperature, soit top_p, mais pas les deux en même temps.
max_output_tokens
Limite le nombre de tokens en sortie, raisonnement inclus :
{
"model": "grok-4.20-reasoning",
"input": "Explique la relativité générale.",
"max_output_tokens": 500
}
Attention : pour les modèles de raisonnement (grok-4), cette limite inclut les tokens de réflexion interne. Si vous fixez 500 tokens, le modèle pourrait en utiliser 400 pour raisonner et ne produire que 100 tokens de réponse visible.
reasoning
Pour les modèles qui supportent le raisonnement, vous pouvez ajuster l’effort :
{
"model": "grok-4.20-reasoning",
"input": "Résous ce problème de logique.",
"reasoning": {"effort": "high"}
}
Les valeurs possibles sont low, medium et high. Un effort élevé consomme plus de tokens mais donne de meilleurs résultats sur les problèmes complexes.
Paramètres de conversation
store
Détermine si la réponse est conservée côté serveur :
{
"model": "grok-4.20-reasoning",
"input": "Analyse ce contrat.",
"store": false
}
true: réponse stockée 30 jours, récupérable via GET, utilisable avecprevious_response_idfalse: réponse non persistée (mode privé)
previous_response_id
Chaîne une nouvelle requête à une conversation existante (détaillé dans la leçon 5).
user
Identifiant de l’utilisateur final, utile pour le suivi et la modération :
{
"model": "grok-4.20-reasoning",
"input": "Bonjour",
"user": "user-12345"
}
Paramètres d’outils
tools, tool_choice, parallel_tool_calls, max_turns
Ces paramètres contrôlent l’utilisation des outils (web_search, code_interpreter, fonctions custom). Ils sont couverts en détail dans la section “Outils” (leçons 9-12).
Récapitulatif des paramètres
| Paramètre | Type | Défaut | Usage |
|---|---|---|---|
model | string | requis | Identifiant du modèle |
input | string/array | requis | Prompt utilisateur |
instructions | string | null | Prompt système |
temperature | number | ~0.7 | Créativité (0-2) |
top_p | number | 1 | Échantillonnage nucleus |
max_output_tokens | integer | null | Limite de tokens sortie |
reasoning | object | null | Effort de raisonnement |
store | boolean | null | Persistance 30 jours |
stream | boolean | false | Streaming SSE |
user | string | null | ID utilisateur final |
Points clés à retenir
temperatureettop_pcontrôlent la créativité — ajustez l’un ou l’autre, pas les deuxmax_output_tokensinclut les tokens de raisonnement pour les modèles grok-4store: truepersiste la réponse 30 jours pour le chaînage de conversationsreasoning.effortpermet de doser la réflexion du modèle selon la complexité de la tâche- Le paramètre
useraide au suivi et à la modération côté xAI