KI-Agenten-Architektur: die Muster, die in Produktion tragen
Architekturdiskussionen beginnen meist am falschen Ende: mit einem Diagramm aus Kästen, die nach Konzepten benannt sind. Die nützliche Version beginnt bei dem Fehler, den Sie verhindern wollen, denn jedes Muster unten existiert, um genau einen schlechten Nachmittag zu vermeiden.
Diese sechs greifen wir immer wieder auf. Sie lassen sich kombinieren: ein Produktionsagent ist typischerweise eine begrenzte Schleife mit Werkzeug-Gateway, zwei Gedächtnisebenen und einem menschlichen Tor — plus einem Kritikerlauf nur dort, wo ein falsches Ergebnis den zusätzlichen Aufruf rechtfertigt.
1. Die begrenzte Schleife#
Der Basisfall und Ihre Voreinstellung. Eine Schleife über ein kleines Werkzeugset mit expliziten Abbruchbedingungen: Schrittgrenze, Ausgabengrenze, Wiederholungserkennung, Zeitlimit. Ihr Vorteil ist ein linearer Trace, den man von oben nach unten liest. Jedes weitere Muster ist eine Ergänzung, kein Ersatz.
Wer seinen Agenten nicht als Schleife mit einer Liste von Ausgängen zeichnen kann, hat noch keine Architektur, sondern einen ambitionierten Prompt.
2. Planer–Ausführer mit Neuplanung#
Für Aufgaben ab etwa fünf Schritten: zuerst einen nummerierten Plan verlangen, ihn abarbeiten und bei einem Fehlschlag neu planen statt einem veralteten Plan zu folgen. Der Gewinn ist nicht Genauigkeit, sondern dass ein Mensch die Absicht vor der Handlung sieht — das macht Freigabe und Debugging möglich. Der Preis: ein Aufruf mehr und die Disziplin, den Plan als revidierbar zu behandeln.
3. Der Kritikerlauf#
Ein zweiter Aufruf prüft Entwurf oder geplante Handlung gegen Ziel und abgerufene Belege und darf einmal zurückschicken. Das fängt einen relevanten Teil selbstsicherer, aber unbelegter Ausgaben ab. Nutzen Sie ihn, wo ein falsches Ergebnis teuer und ein Aufruf billig ist: Kundennachrichten, Finanzzusammenfassungen, Codeänderungen — nicht überall.
| Muster | Zusätzliche Aufrufe | Bringt | Weglassen wenn |
|---|---|---|---|
| Begrenzte Schleife | 0 | Nachvollziehbarkeit, Kostenkontrolle | Nie — das ist die Basis |
| Planer–Ausführer | 1–2 | Sichtbare Absicht, Prüfbarkeit | Aufgaben unter fünf Schritten |
| Kritikerlauf | 1 pro geprüfter Ausgabe | Weniger unbelegte Aussagen | Billige, umkehrbare Ausgaben |
| Werkzeug-Gateway | 0 | Rechte, Audit, Ratenlimits | Nur im Prototyp |
| Gedächtnisebenen | 0–1 | Relevanz bei langem Kontext | Kurze Einzelläufe |
| Menschliches Tor | 0 | Unumkehrbares bleibt sicher | Wenn nichts unumkehrbar ist |
4. Das Werkzeug-Gateway#
Lassen Sie den Agenten Ihre Systeme nicht direkt aufrufen. Eine Schicht vor jedem Werkzeug erledigt vier Dinge: Argumente gegen ein Schema prüfen, prüfen ob dieser Endnutzer diesen Datensatz anfassen darf, Ratenlimit anwenden und eine Auditzeile mit Lauf-ID schreiben. Das ist die wertvollste Infrastruktur im ganzen System — gewöhnlicher Code, Tage statt Wochen. Und es heißt: ein Frameworkwechsel berührt Ihre Sicherheitslage nie.
5. Gedächtnis in Ebenen#
Eine undifferenzierte Gesprächshistorie ist die häufigste Ursache dafür, dass ein Agent im Verlauf schlechter wird. Trennen Sie: Ziel und Vorgaben, die nie gekürzt werden; jüngste Züge wörtlich; ältere Züge als kurze Faktennotiz; und abgerufenes Wissen, pro Schritt frisch geholt und nie angesammelt. Langer Kontext ist teuer und Aufmerksamkeit endlich — alles mitzuschleppen ist keine Gründlichkeit, sondern Verdünnung.
6. Das menschliche Tor#
Jede unumkehrbare Handlung steht hinter einer expliziten Freigabe mit genug Kontext für eine Entscheidung in Sekunden: was passiert, mit welchem Datensatz, warum der Agent es für richtig hält und was er bei Ablehnung tut. Das Tor ist ein Produktmerkmal, keine Einschränkung — es erlaubt den Start in einem System, in dem Fehler teuer sind, und wird selektiv entfernt, wenn die Zahlen es rechtfertigen.
Häufige Fragen
Brauche ich alle sechs Muster?
Nein. Beginnen Sie mit begrenzter Schleife und Werkzeug-Gateway; beide sind für alles mit Systemzugriff nahezu Pflicht. Das menschliche Tor kommt, sobald eine unumkehrbare Handlung auftaucht. Der Rest wird durch konkrete Fehler im Trace verdient.
Verbessert ein Kritikerlauf wirklich die Genauigkeit?
Bei Aufgaben, in denen plausible, aber unbelegte Antworten möglich sind, deutlich — besonders wenn der Kritiker die Belege bekommt und Aussagen dagegen prüfen soll. Bei einfachen Abfragen stimmt er meist zu und verdoppelt die Kosten.
Wo gehört das Werkzeug-Gateway hin?
In Ihren eigenen Dienst, zwischen Agent und Systeme, mit durchgereichter Endnutzeridentität. Im Framework müssten Sie es beim nächsten Wechsel neu bauen und Ihr Security-Review begänne bei null.
ki agenten architekturagenten design musterplaner ausführerwerkzeug gatewayagenten gedächtnis