Le role du leader et des sub-agents
Une hierarchie claire
L’architecture multi-agent de Grok repose sur une distinction fondamentale entre deux types d’agents : le leader et les sub-agents. Comprendre cette hierarchie est essentiel pour exploiter efficacement le systeme.
L’agent leader
Le leader est l’agent principal qui interagit directement avec vous. Son role est triple :
- Coordonner : il decompose votre requete et distribue les sous-taches aux sub-agents
- Superviser : il suit les recherches de chaque sub-agent et oriente la discussion
- Synthetiser : il compile les resultats en une reponse finale coherente et structuree
Un point crucial : seuls les appels d’outils et la reponse du leader sont retournes a l’utilisateur. Vous ne voyez jamais directement ce que les sub-agents produisent — uniquement le resultat final du leader.
Les sub-agents
Les sub-agents sont les “chercheurs” de l’equipe. Chaque sub-agent peut :
- Effectuer des recherches web via
web_search - Fouiller les posts X avec
x_search - Executer du code avec
code_execution - Interroger des collections avec
collections_search - Utiliser des outils MCP distants
Ils discutent entre eux et avec le leader pour affiner leurs recherches. Cette collaboration permet d’explorer un sujet sous plusieurs angles simultanement.
Le raisonnement chiffre des sub-agents
Le raisonnement interne des sub-agents reste chiffre (encrypted). Vous ne pouvez pas lire leur processus de reflexion, contrairement au raisonnement visible de grok-3-mini par exemple.
Cela signifie que :
- Vous voyez le resultat final du leader, pas les etapes intermediaires
- L’etat des sub-agents n’est accessible qu’avec le parametre
use_encrypted_content=True - Meme avec ce parametre, le contenu est chiffre — il sert au modele pour maintenir la coherence entre les tours, pas a vous pour le lire
Cette opacite est un compromis delibere : elle permet aux agents de raisonner librement sans contrainte d’affichage, au prix d’une moindre transparence.
La reponse finale
Quand le leader a recu suffisamment d’informations de ses sub-agents, il produit la reponse finale. Cette reponse integre :
- Les resultats de recherche trouves par les differents agents
- Les appels d’outils (recherche web, execution de code) effectues par n’importe quel agent
- La synthese structuree du leader
Les appels d’outils sont visibles dans la reponse, qu’ils aient ete effectues par le leader ou par un sub-agent. C’est le seul apercu que vous avez du travail des sub-agents.
Implications pour vos prompts
Cette architecture a des consequences directes sur la facon dont vous devez formuler vos requetes :
- Soyez precis sur le livrable attendu : le leader doit savoir comment structurer sa synthese
- Definissez la portee : les sub-agents ont besoin de limites claires pour ne pas s’eparpiller
- Demandez des sources : les agents peuvent citer leurs sources, mais il faut le demander explicitement
- Ne cherchez pas a controler les sub-agents : vous interagissez uniquement avec le leader
Points cles a retenir
- Le leader coordonne, supervise et synthetise — c’est votre seul interlocuteur
- Les sub-agents font la recherche et l’analyse en parallele
- Seule la reponse du leader et les appels d’outils sont retournes
- Le raisonnement des sub-agents est chiffre et inaccessible
- Vos prompts doivent cibler le leader avec des consignes claires sur le livrable