Hur AI-agenter fungerar: loopen, steg för steg
Agenter ser ut som magi i demon och som rörmokeri i produktion. Skälet är att det intressanta inte är modellens utdata utan loopen som konsumerar den, och den loopen är kort nog att läsa i ett svep.
Den här guiden för en enda förfrågan hela vägen: vad modellen ser varje varv, vad er kod gör med resultatet, hur ett verktyg som misslyckas kommer tillbaka och vad som stoppar loopen.
Ett varv i loopen, i ordning#
- Sätt ihop kontexten: mål, verktygsdefinitioner, hämtade fakta och beskuren historik.
- Be modellen om nästa steg. Den svarar direkt eller begär ett verktygsanrop med argument.
- Validera argumenten innan något händer — typer, intervall och om anroparen får röra just den posten.
- Kör verktyget. Fånga fel och översätt dem till korta, sakliga meddelanden i stället för stackspår.
- Lägg till anropet och resultatet i historiken och kontrollera stoppvillkoren.
- Upprepa, eller returnera slutsvaret tillsammans med vad agenten faktiskt gjorde.
Vad modellen ser och inte ser#
Modellen minns inget från förra varvet utöver det ni lägger tillbaka i kontexten. Det enda faktumet förklarar det mesta förvirrande beteendet. Om agenten glömmer ett villkor från fyra steg tillbaka var det er beskärning som tog bort det.
Skriv verktygsfel som instruktioner, inte som diagnoser. Inte `HTTP 404`, utan `Ingen kund med det ID:t. Be om bekräftelse av ordernumret.`
Att stanna: delen som demon aldrig visar#
| Villkor | Typisk inställning | Vad som händer |
|---|---|---|
| Stegtak | 8–15 verktygsanrop | Returnera delresultat med förklaring |
| Kostnadstak | Fast kostnad per körning | Stanna och logga för granskning |
| Klocka | 30–120 s vid interaktivt bruk | Lämna över med det som är känt |
| Upprepningsdetektering | Samma anrop och argument två gånger | Tvinga en annan gren eller stanna |
| Mänsklig grind | Varje oåterkallelig handling | Pausa och begär godkännande |
Att läsa ett spår när något går fel#
Ett spår är den ordnade noteringen av varje kontext, beslut, anrop och resultat i en körning. Det är det enda felsökningsverktyg som räknas och det första ni bör bygga. Frågan är aldrig varför modellen är dålig, utan vilket varv som gick fel först och vad modellen kunde se då.
Vanliga frågor
Hur många steg innan stopp?
För interaktiva uppgifter täcker ett tak på åtta till tolv anrop nästan allt legitimt.
Planera först eller besluta steg för steg?
Korta uppgifter går bra steg för steg. Över fem steg gör en explicit plan körningen granskbar.
Varför upprepar min agent samma misslyckade anrop?
Nästan alltid för att felmeddelandet saknar handlingsbar information.
hur ai-agenter fungeraragentlooptänk agera observeraverktygsanropagentarkitektur