Aller au contenu principal

Le role du leader et des sub-agents

Une hierarchie claire

L’architecture multi-agent de Grok repose sur une distinction fondamentale entre deux types d’agents : le leader et les sub-agents. Comprendre cette hierarchie est essentiel pour exploiter efficacement le systeme.

L’agent leader

Le leader est l’agent principal qui interagit directement avec vous. Son role est triple :

  • Coordonner : il decompose votre requete et distribue les sous-taches aux sub-agents
  • Superviser : il suit les recherches de chaque sub-agent et oriente la discussion
  • Synthetiser : il compile les resultats en une reponse finale coherente et structuree

Un point crucial : seuls les appels d’outils et la reponse du leader sont retournes a l’utilisateur. Vous ne voyez jamais directement ce que les sub-agents produisent — uniquement le resultat final du leader.

Les sub-agents

Les sub-agents sont les “chercheurs” de l’equipe. Chaque sub-agent peut :

  • Effectuer des recherches web via web_search
  • Fouiller les posts X avec x_search
  • Executer du code avec code_execution
  • Interroger des collections avec collections_search
  • Utiliser des outils MCP distants

Ils discutent entre eux et avec le leader pour affiner leurs recherches. Cette collaboration permet d’explorer un sujet sous plusieurs angles simultanement.

Le raisonnement chiffre des sub-agents

Le raisonnement interne des sub-agents reste chiffre (encrypted). Vous ne pouvez pas lire leur processus de reflexion, contrairement au raisonnement visible de grok-3-mini par exemple.

Cela signifie que :

  • Vous voyez le resultat final du leader, pas les etapes intermediaires
  • L’etat des sub-agents n’est accessible qu’avec le parametre use_encrypted_content=True
  • Meme avec ce parametre, le contenu est chiffre — il sert au modele pour maintenir la coherence entre les tours, pas a vous pour le lire

Cette opacite est un compromis delibere : elle permet aux agents de raisonner librement sans contrainte d’affichage, au prix d’une moindre transparence.

La reponse finale

Quand le leader a recu suffisamment d’informations de ses sub-agents, il produit la reponse finale. Cette reponse integre :

  • Les resultats de recherche trouves par les differents agents
  • Les appels d’outils (recherche web, execution de code) effectues par n’importe quel agent
  • La synthese structuree du leader

Les appels d’outils sont visibles dans la reponse, qu’ils aient ete effectues par le leader ou par un sub-agent. C’est le seul apercu que vous avez du travail des sub-agents.

Implications pour vos prompts

Cette architecture a des consequences directes sur la facon dont vous devez formuler vos requetes :

  • Soyez precis sur le livrable attendu : le leader doit savoir comment structurer sa synthese
  • Definissez la portee : les sub-agents ont besoin de limites claires pour ne pas s’eparpiller
  • Demandez des sources : les agents peuvent citer leurs sources, mais il faut le demander explicitement
  • Ne cherchez pas a controler les sub-agents : vous interagissez uniquement avec le leader

Points cles a retenir

  • Le leader coordonne, supervise et synthetise — c’est votre seul interlocuteur
  • Les sub-agents font la recherche et l’analyse en parallele
  • Seule la reponse du leader et les appels d’outils sont retournes
  • Le raisonnement des sub-agents est chiffre et inaccessible
  • Vos prompts doivent cibler le leader avec des consignes claires sur le livrable