Jak działają agenci AI: pętla krok po kroku
Agenci wyglądają na magię w demach i na hydraulikę na produkcji. Powód: ciekawa nie jest odpowiedź modelu, tylko pętla, która ją konsumuje, a ta pętla jest na tyle krótka, że da się ją przeczytać za jednym posiedzeniem.
Ten przewodnik prowadzi jedno żądanie przez całą pętlę: co model widzi w każdej turze, co wasz kod robi z wynikiem, jak wraca narzędzie, które zawiodło, i co pętlę zatrzymuje.
Jedna tura pętli, po kolei#
- Złóż kontekst: cel, definicje narzędzi, przywołane fakty i przycięta historia.
- Poproś model o następny krok. Odpowie wprost albo poprosi o wywołanie narzędzia z argumentami.
- Zwaliduj argumenty, zanim cokolwiek się wydarzy — typy, zakresy i to, czy wywołujący może dotknąć tego rekordu.
- Wykonaj narzędzie. Wyłap awarie i zamień je w krótkie, rzeczowe komunikaty zamiast zrzutów stosu.
- Dodaj wywołanie i wynik do historii, potem sprawdź warunki zatrzymania.
- Powtórz albo zwróć końcową odpowiedź razem z tym, co agent naprawdę zrobił.
Co model widzi, a czego nie#
Model nie pamięta nic z poprzedniej tury poza tym, co włożycie z powrotem w kontekst. Ten jeden fakt tłumaczy większość mylących zachowań. Jeśli agent zapomina o ograniczeniu sprzed czterech kroków, usunęło je wasze przycinanie. Jeśli trzy razy powtarza to samo nieudane wywołanie, komunikat błędu nie powiedział dlaczego w słowach, na których można działać.
Piszcie błędy narzędzi jak instrukcje, nie jak diagnozy. Nie `HTTP 404`, tylko `Brak klienta o tym identyfikatorze. Poproś o potwierdzenie numeru zamówienia.`
Zatrzymanie: część, której dema nigdy nie pokazują#
| Warunek | Typowe ustawienie | Co się dzieje |
|---|---|---|
| Limit kroków | 8–15 wywołań | Zwróć część pracy z wyjaśnieniem |
| Limit wydatków | Stały koszt na przebieg | Zatrzymaj i zapisz do przeglądu |
| Zegar | 30–120 s w trybie interaktywnym | Przekaż to, co wiadomo |
| Wykrywanie powtórzeń | To samo wywołanie i argumenty dwa razy | Wymuś inną gałąź lub zatrzymaj |
| Ludzka bramka | Każde nieodwracalne działanie | Wstrzymaj i poproś o zgodę |
Czytanie śladu, gdy coś pójdzie źle#
Ślad to uporządkowany zapis każdego kontekstu, decyzji, wywołania i wyniku jednego przebiegu. To jedyne narzędzie debugowania, które się liczy, i pierwsza rzecz do zbudowania. Pytanie nigdy nie brzmi, dlaczego model jest zły, tylko która tura pierwsza poszła źle i co model wtedy widział.
Najczęstsze pytania
Ile kroków przed zatrzymaniem?
Przy zadaniach interaktywnych limit ośmiu do dwunastu wywołań pokrywa niemal wszystko sensowne.
Najpierw planować czy decydować krok po kroku?
Krótkie zadania idą dobrze krok po kroku. Powyżej pięciu kroków jawny plan czyni przebieg audytowalnym.
Dlaczego mój agent powtarza to samo nieudane wywołanie?
Prawie zawsze dlatego, że komunikat błędu nie zawiera informacji do działania.
jak działają agenci aipętla agentamyśl działaj obserwujwywoływanie narzędziarchitektura agenta