Memoria negli agenti AI: cosa tenere, comprimere e buttare

Costruire agenti 9 min di lettura

Un cassetto di schedario semiaperto, solo poche schede tirate in avanti
Un buon design della memoria riguarda soprattutto ciò che accettate di lasciare nel cassetto.

In una chiamata a un modello non c'è memoria. Ogni turno è una richiesta nuova e il modello sa solo ciò che avete assemblato stavolta. Tutto ciò che viene descritto come un agente che dimentica, o che peggiora su una lunga esecuzione, è una decisione presa dal vostro codice su cosa portarsi dietro.

Accettato questo, il design della memoria diventa un problema di ingegneria familiare: cosa è sempre pertinente, cosa lo è di recente, cosa si può riassumere e cosa conviene recuperare fresco invece che conservare.

I quattro livelli#

Memoria negli agenti AI: cosa tenere, comprimere e buttare — I quattro livelli
LivelloContenutoPotato?Dimensione tipica
FissatoObiettivo, vincoli, identità, policyMai200–500 token
RecenteUltimi turni alla lettera, con risultatiFinestra scorrevole2–5 turni
CompressoTurni vecchi come brevi note fattualiRiscritto quando cresceSotto i 500 token
RecuperatoDocumenti presi per questo passoScartati dopo l'usoPer passo

Comprimete fatti, non prosa#

L'errore consueto è riassumere i turni vecchi come racconto — la cliente ha chiesto del suo ordine e l'agente ha controllato. Si legge bene e non serve a nulla. Comprimete nei fatti che un passo successivo potrebbe usare: ordine 4471, stato spedito, rimborso richiesto, policy 30 giorni, nessun rimborso emesso.

Comprimete a una soglia, non a ogni turno. Riassumere riassunti fa sparire i dettagli in silenzio.

Recuperare non è ricordare#

I documenti presi da una base di conoscenza appartengono al passo che li ha richiesti. Tenerli nel contesto dopo è la via più rapida a un'esecuzione gonfia, costosa e distratta. Prendere, usare, citare, scartare.

Memoria persistente fra sessioni#

Gli agenti a lunga vita accumulano fatti utili su una persona o un account. Salvateli di proposito, in un piccolo record strutturato con un passo di scrittura esplicito. Tre regole lo tengono sano: scrivete solo fatti su cui un'esecuzione futura agirebbe, registrate sempre la provenienza e date a ogni fatto una scadenza.

  • Scrivete di proposito — una chiamata a strumento, non un effetto collaterale.
  • Salvate fonte e data accanto a ogni fatto.
  • Limitate la dimensione e fate scadere ciò che non si usa.
  • Fate vedere e correggere alla persona ciò che è memorizzato su di lei.

Domande frequenti

Quanta cronologia tenere alla lettera?

Tre-cinque turni coprono quasi tutto il ragionamento senza dominare il contesto.

Serve un database vettoriale per la memoria?

Per recuperare documenti spesso sì. Per lo stato di una singola esecuzione no: è un piccolo oggetto strutturato nel vostro archivio.

Come evito che la memoria persistente diventi stantia?

Date a ogni fatto fonte, data e scadenza, e fate preferire il recuperato fresco.

memoria agenti aigestione del contestoriassunto conversazionememoria persistentefinestra di contesto llm

Tutte le guide

Ultimo aggiornamento 2026-08-04 di aiagentdevelopment.info · Chi siamo

Scritto da chi costruisce

Ogni guida è scritta da ingegneri che gestiscono agenti in produzione, non rimaneggiata da altri siti.

Rivisto con regolarità

Il campo si muove in fretta. Ogni guida porta la data dell’ultima revisione, pubblicata anche quando non è cambiato nulla.

Nessuno spazio a pagamento

Nessun fornitore di modelli, framework o piattaforma può comprare una menzione, una posizione o un link.

Dodici lingue

Ogni guida è tradotta, non sostituita da una macchina: ogni lingua ha il proprio URL e la propria data di revisione.

Limiti dichiarati

Diciamo chiaramente quando un compito non ha bisogno di un agente e uno script semplice sarebbe più economico e affidabile.