Architecture d'agents IA : les motifs qui tiennent en production
Les discussions d'architecture démarrent souvent par le mauvais bout : un schéma de cases nommées d'après des concepts. La version utile part de la panne que vous cherchez à éviter, car chaque motif ci-dessous existe pour empêcher un mauvais après-midi précis.
Ces six-là sont ceux vers lesquels nous revenons toujours. Ils se composent : un agent en production est typiquement une boucle bornée avec passerelle d'outils, deux couches de mémoire et une porte humaine, plus une passe critique là seulement où le coût d'une erreur justifie un appel de plus.
1. La boucle bornée#
Le cas de base et votre choix par défaut. Une boucle sur un petit ensemble d'outils avec des conditions d'arrêt explicites : plafond d'étapes, plafond de dépense, détection de répétition et limite d'horloge. Sa vertu : une trace linéaire lisible de haut en bas. Tous les autres motifs y ajoutent, ils ne la remplacent pas.
Si vous ne pouvez pas dessiner votre agent comme une boucle avec une liste de sorties, vous n'avez pas encore d'architecture mais un prompt ambitieux.
2. Planificateur–exécuteur avec replanification#
Pour les tâches dépassant cinq étapes, demandez d'abord un plan numéroté, exécutez, puis replanifiez en cas d'échec plutôt que de suivre un plan périmé. Le gain n'est pas la justesse : c'est qu'un humain voit l'intention avant l'action, ce qui rend possibles la validation et le débogage. Le coût : un appel de plus et la discipline de traiter le plan comme révisable.
3. La passe critique#
Un deuxième appel relit le brouillon ou l'action proposée face à l'objectif et aux preuves récupérées, et peut la renvoyer une fois. Cela attrape une part réelle des sorties assurées mais non étayées. À utiliser là où une erreur coûte cher et un appel de plus non : messages clients, résumés financiers, changements de code.
| Motif | Appels en plus | Apporte | À sauter si |
|---|---|---|---|
| Boucle bornée | 0 | Traçabilité, maîtrise du coût | Jamais : c'est la base |
| Planificateur–exécuteur | 1–2 | Intention visible, auditabilité | Tâches sous cinq étapes |
| Passe critique | 1 par sortie relue | Moins d'affirmations non étayées | Sorties bon marché et réversibles |
| Passerelle d'outils | 0 | Droits, audit, limites de débit | Prototypes seulement |
| Mémoire en couches | 0–1 | Pertinence en contexte long | Exécutions courtes |
| Porte humaine | 0 | L'irréversible reste sûr | Si rien n'est irréversible |
4. La passerelle d'outils#
Ne laissez pas l'agent appeler vos systèmes directement. Placez devant chaque outil une couche qui fait quatre choses : valider les arguments contre un schéma, vérifier que cet utilisateur final peut toucher cet enregistrement, appliquer une limite de débit et écrire une ligne d'audit avec l'identifiant d'exécution. C'est la brique d'infrastructure la plus rentable du système, et c'est du code ordinaire, affaire de jours.
5. La mémoire en couches#
Un historique indifférencié est la cause la plus fréquente d'un agent qui se dégrade au fil d'une exécution. Séparez : objectif et contraintes, jamais élagués ; tours récents mot à mot ; tours anciens compressés en notes factuelles ; savoir récupéré, ramené par étape et jamais accumulé. Le contexte long coûte et l'attention est finie.
6. La porte humaine#
Chaque action irréversible passe derrière une validation explicite avec assez de contexte pour décider en quelques secondes : ce qui va se produire, sur quel enregistrement, pourquoi l'agent le juge juste et ce qu'il fera en cas de refus. La porte est une fonctionnalité produit, pas une limite : c'est elle qui permet de déployer là où les erreurs coûtent de l'argent.
Questions fréquentes
Faut-il les six motifs ?
Non. Commencez par la boucle bornée et la passerelle ; les deux sont quasi obligatoires dès qu'on touche de vrais systèmes. La porte humaine arrive dès qu'une action irréversible apparaît. Le reste se mérite par des pannes visibles dans une trace.
La passe critique améliore-t-elle vraiment la justesse ?
Sur les tâches où le modèle peut produire une réponse plausible mais non étayée, nettement — surtout si le critique reçoit les preuves et doit vérifier les affirmations. Sur des recherches simples, il approuve et double le coût.
Où placer la passerelle ?
Dans votre propre service, entre l'agent et vos systèmes, avec l'identité de l'utilisateur final qui la traverse. Dans le framework, vous la réécrirez au prochain changement et votre revue de sécurité repartira de zéro.
architecture d'agents iamotifs de conception d'agentsplanificateur exécuteurpasserelle d'outilsmémoire d'agent