Hoe AI-agents werken: de lus, stap voor stap
Agents lijken magie in demo's en loodgieterswerk in productie. De reden: het interessante is niet de modeluitvoer maar de lus die haar verwerkt, en die lus is kort genoeg om in één keer te lezen.
Deze gids voert één verzoek van begin tot eind door die lus: wat het model per beurt ziet, wat uw code met het resultaat doet, hoe een falende tool terugkomt en wat de lus stopt. Kunt u dit voor uw eigen systeem vertellen, dan kunt u het debuggen.
Eén ronde van de lus, op volgorde#
- Stel de context samen: doel, tooldefinities, opgehaalde feiten en een gesnoeide historie.
- Vraag het model om de volgende stap. Het antwoordt direct of vraagt een toolaanroep met argumenten.
- Valideer de argumenten voordat er iets gebeurt — types, bereiken en of deze aanroeper dit record mag raken.
- Voer de tool uit. Vang fouten en vertaal ze naar korte, feitelijke berichten in plaats van stacktraces.
- Voeg aanroep en resultaat toe aan de historie en controleer de stopvoorwaarden.
- Herhaal, of geef het eindantwoord terug met wat de agent werkelijk deed.
Wat het model wel en niet ziet#
Het model herinnert zich niets van de vorige beurt behalve wat u terugzet in de context. Dat ene feit verklaart bijna al het verwarrende gedrag. Vergeet de agent een randvoorwaarde van vier stappen geleden, dan heeft uw snoeien die verwijderd. Herhaalt hij dezelfde falende aanroep drie keer, dan zei de foutmelding niet waarom in woorden waarmee hij iets kan.
Schrijf toolfouten als instructie, niet als diagnose. Niet `HTTP 404`, maar `Geen klant met dit ID. Vraag om bevestiging van het bestelnummer.`
Stoppen: het deel dat demo's nooit tonen#
| Voorwaarde | Typische instelling | Wat er gebeurt |
|---|---|---|
| Stappenlimiet | 8–15 toolaanroepen | Geef deelresultaat met uitleg terug |
| Uitgavenlimiet | Vaste kosten per run | Stop en log voor beoordeling |
| Klok | 30–120 s bij interactief gebruik | Draag over met wat bekend is |
| Herhalingsdetectie | Zelfde aanroep en argumenten twee keer | Forceer een andere tak of stop |
| Menselijke poort | Elke onomkeerbare handeling | Pauzeer en vraag goedkeuring |
Een trace lezen als het misgaat#
Een trace is het geordende verslag van elke context, beslissing, aanroep en uitkomst van één run. Het is het enige debughulpmiddel dat telt en het eerste dat u bouwt. De vraag is nooit waarom het model slecht is, maar welke beurt als eerste misging en wat het model op dat moment kon zien.
Veelgestelde vragen
Hoeveel stappen voordat de agent stopt?
Voor interactieve taken dekt een limiet van acht tot twaalf aanroepen bijna alles legitiems; wie meer nodig heeft, zit meestal vast.
Eerst plannen of stap voor stap beslissen?
Korte taken gaan prima stap voor stap. Boven vijf stappen maakt een expliciet plan de run controleerbaar.
Waarom herhaalt mijn agent dezelfde falende aanroep?
Bijna altijd omdat de foutmelding geen bruikbare informatie bevat. Geef korte, duidelijke fouten terug en voeg herhalingsdetectie toe.
hoe ai agents werkenagentlusredeneren handelen waarnementool callingagentarchitectuur