Ein Agenten-Framework wählen: worauf es wirklich ankommt
Jeder Artikel, der Agenten-Frameworks namentlich rankt, ist veraltet, bevor er indexiert ist. Die Bibliotheken schreiben ihre Kernabstraktionen alle paar Releases um; was heute im Vergleich vorn liegt, kann bis zu Ihrem Launch ein anderes Produkt sein.
Deshalb macht dieser Leitfaden etwas Haltbareres: acht Fragen, die tatsächlich bestimmen, ob Sie Ihre Wahl in sechs Monaten noch gut finden — und was jede Antwort kostet. Nehmen Sie sie mit zur jeweils aktuellen Shortlist, und Sie treffen eine Entscheidung, die Sie begründen können.
Die acht Fragen, nach Wichtigkeit#
- Kann ich die Schleife lesen? Wer die Datei nicht findet, in der Modellausgabe zu einem Werkzeugaufruf wird, kann keinen schlechten Lauf debuggen.
- Was passiert bei einem Werkzeugfehler — sehe ich ihn, oder wird unsichtbar mit anderem Prompt wiederholt?
- Ist mein Prompt der Prompt des Frameworks? Versteckter Systemtext überrascht Sie im Audit.
- Lässt sich Zustand persistieren und fortsetzen, oder kostet ein Absturz den Lauf?
- Wie werden Werkzeuge definiert, und kann ich diese Definitionen außerhalb wiederverwenden?
- Wie ist die Upgrade-Geschichte — wurden Kernabstraktionen in den letzten zwei Releases umbenannt?
- Kann ich das Modell tauschen, ohne das Framework zu tauschen?
- Was kostet es an Kaltstart und pro Durchlauf?
Drei Kategorien, drei Tauschgeschäfte#
| Kategorie | Sie bekommen | Sie geben ab | Sinnvoll wenn |
|---|---|---|---|
| Provider-SDK plus eigene Schleife | Volle Sichtbarkeit, wenig Abhängigkeiten | Retries, Zustand, Persistenz selbst | Ein Agent, wenige Werkzeuge, hoher Debug-Bedarf |
| Orchestrierungsbibliothek | Dauerhafter Zustand, Verzweigung, Retries | Etwas Sichtbarkeit; Upgrade-Unruhe | Lange oder mehrstufige Abläufe |
| Managed Agent-Plattform | Hosting, Tracing, Evaluation, UI | Portabilität; Preis pro Sitz oder Lauf | Kleines Team, Standardaufgabe, schneller Beweis |
Schreiben Sie selbst, was Ihnen gehören muss#
Vier Dinge sollten in Ihrem Repository liegen, in einer Form, die kein Framework besitzt: die Prompts, die Werkzeugdefinitionen samt JSON-Schemata, das Eval-Set und das Trace-Format. Das ist der Teil, der echte Arbeit gekostet hat. Als schlichte Daten mit dünnen Adaptern ist ein Frameworkwechsel ein Tag Arbeit. Als Framework-Dekoratoren und Vererbungsketten ist er eine Neuentwicklung — und deshalb wechseln Sie nicht, auch wenn Sie sollten.
Der Test, den niemand macht#
Bauen Sie vor der Entscheidung denselben kleinen Agenten zweimal: einmal mit dem Favoriten, einmal mit dem Provider-SDK und handgeschriebener Schleife. Gleiche drei Werkzeuge, gleiche zehn Testfälle. Sie messen nicht Genauigkeit — die ist ähnlich. Sie messen, wie lange es dauerte, wie lesbar der Trace ist und wie leicht sich herausfinden ließ, warum Fall sieben scheiterte. Dieser Nachmittag hat jedem Team, das wir kennen, ein Vielfaches gespart.
Behalten Sie die handgeschriebene Version. Sie ist Ihre Referenz, wenn Sie klären müssen, ob eine Merkwürdigkeit vom Prompt oder vom Framework kommt.
Anzeichen, dass Sie Ihre Wahl entwachsen sind#
- Sie lesen häufiger den Framework-Quelltext als den eigenen.
- Sie pflegen einen Patch oder Fork für benötigtes Verhalten.
- Upgrades werden wegen Umbenennungen aufgeschoben; Sie sind zwei Majors zurück.
- Die Hälfte Ihres Prompts existiert, um injizierten Text zu neutralisieren.
- Tracing braucht einen Eigenbau-Exporter, weil der eingebaute Argumente verbirgt.
Häufige Fragen
Brauche ich für einen ersten Agenten überhaupt ein Framework?
Nein. Ein erster Agent mit drei Werkzeugen ist eine Schleife, eine Schemaliste und eine Abbruchbedingung. Ihn einmal von Hand zu bauen zeigt, was ein Framework für Sie täte — und macht die spätere Wahl deutlich besser informiert.
Ist eine Managed-Plattform eine Falle?
Nicht, solange Prompts, Werkzeugschemata und Eval-Set portabel bleiben. Plattformen sind wirklich schnell zu einem Ergebnis. Das Risiko ist nicht die Plattform, sondern dass Ihr geistiges Kapital nur als Konfiguration darin existiert.
Wie stark beeinflusst das Framework die Genauigkeit?
Weit weniger als erwartet. Genauigkeit kommt aus Werkzeugdesign, Grounding und Evaluation. Frameworks beeinflussen Entwicklungstempo, Debugbarkeit und Betriebsfunktionen — wichtig, aber nicht so, wie Vergleichstabellen suggerieren.
ki agenten frameworkbeste agenten frameworksagent bibliothek vergleichllm orchestrierungagenten stack wählen