En bref
Un subagent est un agent IA spécialisé auquel un agent principal délègue une tâche ciblée, qui tourne dans son propre context window séparé, avec son propre System Prompt et son propre ensemble d'outils délimité. Au lieu qu'un agent fasse tout dans une seule conversation, l'agent principal confie un travail (relis ce code, recherche ce sujet, lance ces tests) à un subagent qui fait le travail en isolation et ne renvoie qu'un résumé propre. Cela garde la conversation principale nette et permet de tailler chaque subagent pour bien faire une seule chose.
Comment fonctionnent les subagents
Quand l'agent principal lance un subagent, celui-ci repart de zéro : il ne voit que son propre System Prompt et le message de délégation, pas tout l'historique de la session principale. Il travaille avec un jeu d'outils et des permissions étroits, accomplit sa tâche et renvoie un court résultat. Parce que son contexte est isolé, tout le travail intermédiaire bruyant (résultats de recherche, logs, dumps de fichiers) reste hors du context window de l'agent principal.
- Context window séparé : le subagent n'hérite pas de toute la conversation principale.
- System Prompt propre : une mission courte et ciblée, taillée pour son unique travail.
- Outils et permissions délimités : seulement ce qu'exige la tâche, souvent en lecture seule.
Pourquoi les subagents aident
Le grand gain est l'hygiène du contexte. Une tâche annexe qui inonderait votre session principale de sorties (lire des dizaines de fichiers, fouiller des logs) se passe plutôt dans le subagent et ne renvoie que le résumé, pour que l'agent principal reste concentré et que le context window ne déborde pas. Une mission ciblée rend aussi le subagent plus fiable sur sa tâche spéciale qu'un agent unique jonglant avec tout.
Un exemple concret
Dans Claude Code, vous pouvez définir un subagent "relecteur de code" avec un jeu d'outils en lecture seule et une courte mission de revue. Après que l'agent principal a écrit une fonctionnalité, il délègue la revue à ce subagent, qui examine le diff dans son propre contexte et renvoie une liste concise de problèmes. L'agent principal les corrige ensuite, sans jamais avoir chargé tout le raisonnement de revue dans sa propre fenêtre.
