Quand plusieurs agents valent-ils mieux qu’un seul ?

Questions d’entrevue Agents IA

Seniormulti-agentsarchitecture

Beaucoup moins souvent que la littérature ne le suggère. C’est une question où le bon candidat commence par pousser en arrière.

Les raisons valables

Isoler des contextes. Un agent qui traite des données non fiables — pages web, courriels entrants — ne doit pas être celui qui détient les outils sensibles. La séparation est alors une frontière de sécurité, et c’est l’argument le plus solide.

Paralléliser des sous-tâches réellement indépendantes. Analyser vingt documents séparément se répartit sans effort. Le gain est en temps, et il est réel.

Isoler pour économiser le contexte. Un sous-agent explore, produit un résumé de dix lignes, et disparaît avec ses cinquante mille jetons de fouille. L’agent principal ne paie que le résumé. C’est l’usage le plus rentable en pratique.

Spécialiser les outils. Un agent avec cinq outils choisit mieux qu’un agent avec trente. Découper par domaine d’outils améliore la sélection.

Les mauvaises raisons

Imiter une organisation humaine. Un « chef de produit », un « développeur », un « testeur » qui se parlent, c’est une métaphore séduisante et une architecture fragile. Les rôles humains existent à cause de contraintes humaines — spécialisation, bande passante, fatigue — qui ne s’appliquent pas ici.

Espérer que le débat améliore la réponse. Deux instances du même modèle partagent les mêmes biais et les mêmes lacunes. Elles peuvent se conforter dans une erreur au lieu de la corriger.

Parce que le cadriciel le propose. Ce n’est pas un argument, et il est étonnamment fréquent.

Ce que la multiplication coûte

  • Le coût se multiplie, chaque agent ayant son propre contexte et ses propres tours.
  • La communication perd de l’information. Ce qui passe d’un agent à l’autre est un résumé textuel : le détail qui aurait compté est souvent celui qui a été résumé.
  • Le débogage devient nettement plus dur. Il faut reconstituer plusieurs trajectoires et leur entrelacement pour comprendre une erreur.
  • Les modes de panne se composent. Deux agents qui se renvoient la tâche, chacun estimant qu’elle relève de l’autre, est un blocage classique.

Les topologies, si l’on y va

  • Superviseur et exécutants : un agent découpe et délègue, les autres exécutent et rendent. La plus prévisible, et celle à recommander par défaut.
  • En chaîne : sortie de l’un en entrée du suivant. Simple, mais c’est un enchaînement déterministe déguisé — autant l’écrire comme tel.
  • En réseau libre, où chacun parle à chacun. Souple sur le papier, ingérable en production.

Comment conclure

Un seul agent bien outillé, avec des sous-agents lancés à la demande pour isoler un contexte ou paralléliser. C’est l’architecture qui tient, et la réponse qui montre qu’on a payé le prix de l’alternative.

Toutes les questions Agents IA