Mémoire des agents IA : que garder, compresser et jeter

Construire des agents 9 min de lecture

Un tiroir de fichier entrouvert, seules quelques fiches tirées vers l'avant
Une bonne mémoire tient surtout à ce que vous acceptez de laisser dans le tiroir.

Dans un appel de modèle, il n'y a pas de mémoire. Chaque tour est une requête neuve, et le modèle ne sait que ce que vous avez assemblé cette fois-ci. Tout ce que l'on décrit comme un agent qui oublie, ou qui se dégrade sur une longue exécution, est une décision prise par votre code sur ce qu'il transporte.

Une fois cela accepté, la conception de la mémoire devient un problème d'ingénierie familier : qu'est-ce qui est toujours pertinent, récemment pertinent, résumable, et qu'est-ce qu'il vaut mieux aller rechercher que stocker.

Les quatre couches#

Mémoire des agents IA : que garder, compresser et jeter — Les quatre couches
CoucheContenuÉlaguée ?Taille typique
ÉpingléeObjectif, contraintes, identité, politiqueJamais200–500 tokens
RécenteDerniers tours mot à mot, avec résultatsFenêtre glissante2–5 tours
CompresséeTours anciens en notes factuellesRéécrite quand elle grossitMoins de 500 tokens
RécupéréeDocuments ramenés pour cette étapeJetée après usagePar étape

Compressez des faits, pas de la prose#

L'erreur habituelle est de résumer les tours anciens sous forme de récit : la cliente a demandé sa commande et l'agent a vérifié. Cela se lit bien et n'aide à rien. Compressez vers les faits dont une étape ultérieure pourrait avoir besoin : commande 4471, statut expédié, remboursement demandé, politique 30 jours, rien de remboursé. Structuré, vérifiable et dix fois plus petit.

Compressez à un seuil, pas à chaque tour. Résumer des résumés fait disparaître les détails en silence.

Récupérer n'est pas mémoriser#

Les documents tirés d'une base de connaissances appartiennent à l'étape qui en avait besoin. Les garder ensuite dans le contexte est le plus court chemin vers une exécution gonflée, chère et distraite. Ramener, utiliser, citer, jeter — et si une étape ultérieure a besoin du même fait, le ramener à nouveau. Récupérer coûte peu ; un contexte plein de vieux documents non.

Mémoire persistante entre sessions#

Les agents de longue vie accumulent des faits utiles sur une personne ou un compte : préférences, décisions passées, contraintes stables. Stockez-les volontairement, dans un petit enregistrement structuré avec une étape d'écriture explicite, plutôt que de laisser l'historique enfler. Trois règles gardent cela sain : n'écrire que des faits sur lesquels une exécution future agirait, toujours consigner l'origine, et donner à chaque fait une échéance.

  • Écrire volontairement : un appel d'outil, pas un effet de bord.
  • Stocker la source et la date à côté de chaque fait.
  • Plafonner la taille et faire expirer l'inutilisé.
  • Laisser la personne voir et corriger ce qui est stocké sur elle.

Symptômes et causes#

Mémoire des agents IA : que garder, compresser et jeter — Symptômes et causes
SymptômeCause habituelle
Oublie une contrainte du débutNon épinglée, élaguée avec l'historique
La qualité baisse après quelques étapesContexte dilué par de vieilles sorties
Répète une étape déjà faiteRésultat compressé sans marqueur d'achèvement
Le coût monte avec la longueurLes documents récupérés s'accumulent
Affirme du périmé avec assuranceMémoire persistante sans échéance ni origine

Questions fréquentes

Quelle part d'historique garder mot à mot ?

Trois à cinq tours couvrent l'essentiel du raisonnement sans dominer le contexte. Gardez les résultats attachés à leur appel et compressez le plus ancien en faits structurés plutôt que de le supprimer en silence.

Faut-il une base vectorielle pour la mémoire ?

Pour récupérer des documents, souvent oui. Pour l'état d'une exécution, non : c'est un petit objet structuré dans votre stockage. Confondre les deux donne une machine à états floue et un index sans focus.

Comment éviter une mémoire persistante périmée ?

Donnez à chaque fait une source, une date et une échéance, et faites préférer le frais. Montrez l'enregistrement à la personne pour que les erreurs soient corrigées au lieu d'être répétées.

mémoire des agents iagestion du contexterésumé de conversationmémoire persistantefenêtre de contexte llm

Tous les guides

Dernière mise à jour 2026-08-04 par aiagentdevelopment.info · À propos

Écrit par des praticiens

Chaque guide est écrit par des ingénieurs qui exploitent des agents en production, pas recyclé d’autres sites.

Relu régulièrement

Le domaine bouge vite. Chaque guide porte la date de sa dernière relecture, publiée même quand rien n’a changé.

Aucun placement payé

Aucun fournisseur de modèles, framework ou plateforme ne peut acheter une mention, un classement ou un lien.

Douze langues

Chaque guide est traduit, pas remplacé par une machine : chaque langue a son URL et sa date de relecture.

Limites nommées

Nous disons clairement quand une tâche n’a pas besoin d’agent et qu’un simple script serait moins cher et plus fiable.