Vad är en AI-agent? En användbar definition för den som bygger
Ordet agent har töjts tills det täcker allt: från en prompt med ett fint namn till ett distribuerat system med egen beredskap. Det är inte ett ordproblem utan ett budgetproblem: team godkänner en sak och får en annan.
Här är definitionen vi använder när vi avgränsar arbete, medvetet snäv. En AI-agent är programvara där en språkmodell väljer nästa steg, anropar ett riktigt verktyg för att ta det, läser vad som kom tillbaka och väljer igen — tills ett mål nås eller en gräns stoppar den. Om inget i ert system anropar ett verktyg har ni en mycket bra textgenerator. Om ordningen är fastlagd i förväg har ni ett arbetsflöde med en modell i en av rutorna. Båda är rimliga. Ingen behöver en agentbudget.
Produkten är loopen, inte modellen#
Varje agent är samma tre drag upprepade: besluta, agera, observera. Modellen bidrar bara med beslutandet. Allt annat — vilka verktyg som finns, hur deras fel formuleras, vilket tillstånd som överlever mellan iterationer, när loopen måste sluta — är vanlig programvara som ni skriver och ansvarar för. Team som tror att modellen är produkten lägger tiden på prompter och förvånas över opålitligheten. Team som behandlar loopen som produkten arbetar med verktygskontrakt och stoppvillkor och får något som går att felsöka en dålig eftermiddag.
Bra test: om ni tog bort modellen och satte dit en människa som läser samma information, skulle resten av systemet fortfarande gå ihop? Om inte är programvaran runt omkring för tunn.
Vad som skiljer en agent från det den förväxlas med#
| System | Vem bestämmer nästa steg | Anropar riktiga verktyg | Typiskt fel |
|---|---|---|---|
| Chattbot | Ingen — den svarar | Nej | Fel eller påhittat svar |
| Arbetsflöde med ett LLM-steg | Utvecklaren, i förväg | Ja, i fast ordning | Går sönder på indata utanför flödet |
| Agent | Modellen, vid körning | Ja, valda i stunden | Irrar, loopar, agerar på dåliga data |
| Multiagentsystem | Flera modeller plus samordnare | Ja | Allt ovan, svårare att spåra |
De fyra delarna i varje verklig agent#
Ta bort ramverksnamnen så innehåller varje produktionsagent vi arbetat med samma fyra delar.
- Ett kontrollerbart mål: en mening någon kan markera som rätt eller fel.
- En verktygsyta: de konkreta funktionerna, med typade argument och ärliga fel.
- En tillståndsbärare: vad nästa iteration får se av den förra.
- Stoppvillkor: stegtak, kostnadstak och en regel för att lämna över till en människa.
Autonomi är ett vred, inte en strömbrytare#
Den intressanta designfrågan är inte om ni ska använda en agent utan hur långt koppel den ska få. I praktiken finns fyra lägen, och lyckade projekt börjar längre till vänster än demon antyder: agenten skriver utkast och en människa skickar; agenten agerar på det återställbara och frågar om det oåterkalleliga; agenten agerar fritt i en sandlåda med kostnadstak; agenten agerar fritt i produktion. Varje steg åt höger multiplicerar både värdet och skadeområdet.
Där definitionen tjänar sitt uppehälle#
Att vara strikt sparar pengar på tre ställen. Vid avgränsning: fem fasta API-anrop med ett sammanfattningssteg är ett arbetsflöde, och att bygga det som agent lägger till obestämdhet ingen bad om. Vid uppskattning: agenter kostar mer eftersom felytan är större. Vid utvärdering: en agent kan bara testas ordentligt när ni accepterar att samma indata kan ta olika vägar.
Om någon ber om en agent, fråga vilket beslut programvaran ska fatta på egen hand. Finns inget sådant har ni just sparat tre månader.
Vanliga frågor
Är en chattbot en AI-agent?
Enligt den här definitionen nej. En chattbot svarar inom samtalet; en agent agerar i system utanför det.
Måste en agent vara autonom?
Den måste välja sitt nästa steg, vilket inte är samma sak som att agera oövervakat.
Behöver jag ett ramverk?
Nej. Den minsta användbara agenten är en loop, en lista med verktygsdefinitioner och ett stoppvillkor.
vad är en ai-agentdefinition ai-agentagent eller arbetsflödeagentic aitänk-agera-loop