RAG voor agents: antwoorden onderbouwen zonder in context te verdrinken
Retrieval-augmented generation wordt meestal geïntroduceerd als pipeline: vraag inbedden, topfragmenten ophalen, plakken, genereren. Dat werkt voor een vraag-antwoordvak. Binnen een agent is het de verkeerde vorm, want de agent weet pas wat hij nodig heeft nadat hij een stap heeft gezet.
De versie die werkt behandelt retrieval als een tool die de agent aanroept wanneer hij besluit bewijs nodig te hebben — soms twee keer met andere zoekopdrachten, soms helemaal niet.
Retrieval als tool, niet als voorwoord#
Bied zoeken aan als gewone tool met een zoekargument en een kleine, gestructureerde return: enkele passages, elk met identifier en bron. De agent bepaalt wanneer hij hem aanroept, kan verfijnen na het resultaat en kan een andere tool aanroepen als het antwoord gestructureerde data is.
Log de zoekopdrachten die de agent schrijft: dat is de eerlijkste beschrijving van wat uw gebruikers echt vragen.
Knipbeslissingen tellen zwaarder dan het embeddingmodel#
- Splits op structuur — koppen, secties, lijstitems — niet op een vast aantal tekens.
- Houd elk fragment op zichzelf staand.
- Hang documenttitel en sectiekop aan elk fragment.
- Bewaar identifier en URL bij elk fragment zodat een antwoord de bron kan tonen.
- Liever weinig, grotere, betekenisvolle fragmenten; overlap is een pleister.
Hybride verslaat pure vectoren op echte corpora#
| Type vraag | Vectorzoeken | Trefwoorden | Beste |
|---|---|---|---|
| Conceptuele vraag | Sterk | Zwak | Vector |
| Exacte productcode of fouttekst | Zwak | Sterk | Trefwoorden |
| Zeldzame eigennaam | Gemengd | Sterk | Trefwoorden |
| Geherformuleerde beleidsvraag | Sterk | Zwak | Vector |
| Echt verkeer in totaal | Gemengd | Gemengd | Beide, samengevoegd en herordend |
Laat citeren en sta falen toe#
Twee eisen doen het meeste werk voor betrouwbaarheid. Ten eerste draagt elke bewering uit retrieval de identifier van haar passage en maakt uw interface daar een link van. Ten tweede moet zoeken niets kunnen teruggeven en moet de agent geleerd hebben dat `ik vind dit niet in onze documentatie` een correcte uitkomst is.
Veelgestelde vragen
Moet de agent altijd zoeken vóór het antwoord?
Nee. Zoeken bij elk verzoek verspilt latency en vult context bij vragen die geen bewijs nodig hebben.
Hoeveel passages teruggeven?
Drie tot zes goed gekozen verslaan er twintig.
En als retrieval niets bruikbaars geeft?
Dat moet een ondersteunde uitkomst zijn. Geef een expliciet leeg resultaat terug.
rag voor agentsretrieval augmented generationhybride zoekenknipstrategieonderbouwde antwoorden