In breve
Un sistema multi-agente è un montaggio in cui più agenti IA, ciascuno con il proprio ruolo, i propri strumenti e il proprio contesto, lavorano insieme per portare a termine una task troppo grande o troppo varia per un agente unico. Invece che un agente faccia tutto in una lunga conversazione, il lavoro viene ripartito: un agente orchestratore scompone l'obiettivo in pezzi e affida ogni pezzo a un agente specializzato (ricerca, coding, revisione), poi fonde i loro risultati. Ogni agente gira nel proprio contesto, per restare concentrato e non annegare in tutta la task insieme. Lo schema scambia un po' di sovraccosto di coordinamento con specializzazione, parallelismo e un contesto più pulito, il che lo fa comparire nei sistemi agentici più ambiziosi.
Come funzionano i sistemi multi-agente
La maggior parte dei sistemi multi-agente segue una forma orchestratore-e-worker. Un agente lead pianifica e delega, degli agenti worker portano a termine sotto-task mirate, e i risultati rifluiscono per essere fusi.
- Orchestratore: legge l'obiettivo, lo divide in sotto-task e decide chi fa cosa.
- Agenti specialisti: ciascuno ha un ruolo stretto con il proprio prompt, i propri strumenti e il proprio context window.
- Coordinamento: i risultati vengono rimandati e fusi, a volte su più giri.
Multi-agente vs agente unico vs subagent
Un agente unico porta a termine un'intera task in un solo contesto, il che è il più semplice e il migliore per la maggior parte dei lavori. I subagent sono la variante leggera del percorso verso il multi-agente: un agente principale delega un pezzo mirato a un assistente che gira nel proprio contesto e restituisce un riepilogo. Un sistema multi-agente completo va oltre, con più agenti di pari rango che si coordinano attorno a un obiettivo comune. La regola onesta è ricorrere a più agenti solo quando un agente non può davvero portare la task, perché ogni agente aggiuntivo porta un costo di coordinamento.
Quando usare più agenti
Più agenti meritano il loro posto quando un lavoro ha competenze distinte o può girare in parallelo: cercare molte fonti alla volta, o ripartire costruire, testare e rivedere su specialisti. Aiutano anche a tenere pulito ogni contesto, poiché le sotto-task rumorose restano fuori dal thread principale. Ma più agenti significano più modi di fraintendersi, quindi inizia con un agente capace e i suoi subagent e cresci verso un sistema multi-agente completo solo quando la task lo esige chiaramente.
