GrundlagenVibe-Coding / Agentic EngineeringKapitel 09von 13 im Pfad
Subagenten und Schleifen
Das Kontextfenster ist die knappe Größe dieses ganzen Kurses. Jede gelesene Datei, jede Ausgabe eines Befehls, jeder Suchtreffer liegt darin und wird bei jedem weiteren Schritt mitbezahlt.
Ein Subagent ist die Antwort darauf. Er bekommt eine Aufgabe, arbeitet sie in einem eigenen Fenster ab und gibt nur das Ergebnis zurück.
Wofür man ihn nimmt
Der Hersteller beschreibt den Anlass über den Abfall statt über die Aufgabe:
Der entscheidende Halbsatz ist der über die Dinge, die man kein zweites Mal braucht. Wer eine Antwort sucht, liest oft dreißig Dateien und braucht am Ende zwei Sätze davon. Die anderen achtundzwanzig bleiben trotzdem im Fenster liegen und verdrängen dort, was noch kommt.
seitlich verschiebbar
eigene Darstellung, Stand 04.08.2026
Drei Aufgaben, bei denen es sich lohnt
Suchen und Nachschlagen. Eine Frage nach dem Aufbau eines Teilsystems, die Dutzende Dateien berührt. Zurück kommt die Antwort.
Läufe mit viel Ausgabe. Ein Testlauf, der zweitausend Zeilen erzeugt, von denen sechs interessant sind. Der Auftrag lautet dann, die fehlgeschlagenen Fälle mit ihren Meldungen zu berichten.
Eine zweite Meinung. Der Fall aus Kapitel 07: Ein Prüfer bekommt den Unterschied und die Maßstäbe in einem frischen Fenster, ohne den Weg zu kennen, auf dem das Ergebnis entstanden ist.
Was es kostet
Zwei Posten, und beide werden unterschätzt.
Der erste ist die Anlaufzeit. Ein Subagent fängt bei null an und muss sich erst zusammensuchen, was in der Hauptunterhaltung längst dasteht:
Die Ausnahme im Zitat heißt Fork. Er übernimmt alles, was die Hauptunterhaltung in dem Moment hat (externe Seite, code.claude.com), in dem er startet, und spart sich damit das Zusammensuchen. Für jeden anderen Subagenten bleibt die Anlaufzeit.
Der zweite ist die Rückgabe. Sie landet im Hauptfenster, und wenn sie ausführlich ausfällt, ist genau der Platz wieder belegt, den man sparen wollte. Ein Auftrag an einen Subagenten sagt deshalb am besten dazu, wie knapp die Antwort sein soll.
Wann die Hauptunterhaltung die bessere Wahl ist
Ein Subagent taugt für abgeschlossene Aufgaben. Sobald es hin und her geht, wird er umständlich: Jede Rückfrage kostet einen neuen Anlauf, und der Zusammenhang, den die Hauptunterhaltung mitbringt, fehlt ihm.
Die Faustregel lautet: Wer die Zwischenschritte sehen will, bleibt in der Hauptunterhaltung. Wer nur das Ergebnis braucht, schickt jemanden los.
Für mehrere Beteiligte, die gleichzeitig am selben Projekt arbeiten, gibt es eine eigene Bauform mit eigenen Regeln. Sie steht in Kapitel 04, weil ihre entscheidende Bedingung die Aufteilung der Dateien ist.
Der Nutzen aus Ebene 1 ist der offensichtliche Teil. Interessanter ist, was ein Subagent sonst noch mitbringt, denn das eigene Fenster ist nur eine von drei Mitgaben.
Fenster, Tools, Rechte
Die zweite und dritte Angabe werden beim Lesen leicht überflogen und sind der Grund, warum ein Subagent mehr ist als eine Platzersparnis.
Eigene Tool-Liste. Ein Prüfer, der nur lesen und suchen darf, kann nichts verändern, während er prüft. Das ist eine Eigenschaft des Aufbaus: Was nicht in seiner Liste steht, steht ihm nicht zur Verfügung.
Eigene Rechte. Dieselbe Trennung auf der Ebene der Berechtigungen. Ein Rechercheur bekommt Leserechte, ein Ausführender bekommt mehr, und beide sind verschiedene Rollen im selben Projekt.
Eigene Systemanweisung. Sie legt fest, worauf der Subagent achtet. Ein Sicherheitsprüfer bekommt eine andere als ein Testläufer, und beide bekommen eine andere als die Hauptunterhaltung.
seitlich verschiebbar
eigene Darstellung, Stand 04.08.2026
Wie er losgeschickt wird
Drei Formen, in aufsteigender Verbindlichkeit.
Man kann ihn im Auftrag erwähnen, dann entscheidet das Modell, ob es delegiert. Man kann ihn ausdrücklich benennen, dann läuft er für diese eine Aufgabe sicher. Und man kann eine ganze Sitzung unter seiner Anweisung starten, dann gelten seine Tool-Liste und seine Rechte durchgehend.
Für den Alltag ist die mittlere Form die nützlichste: Sie garantiert die Auslagerung, ohne die Sitzung festzulegen.
Der Prüfer als Anwendungsfall
Der überzeugendste Grund für einen eigenen Subagenten steht in den Empfehlungen des Herstellers, und er handelt gar nicht vom Platz:
Wer eine Aufgabe gelöst hat, liest das Ergebnis mit dem Weg im Kopf, der dorthin geführt hat. Alles wirkt begründet, weil man die Begründung kennt. Ein Prüfer ohne diesen Weg sieht das Ergebnis so, wie es später jemand sehen wird, der nur den Stand vorfindet.
Das ist dieselbe Trennung, die Kapitel 07 als vierte Stufe führt, und hier steht das Tool dafür.
Was zurückkommt, kostet auch
Ein Missverständnis, das sich mit mehreren Subagenten schnell rächt:
Fünf Subagenten, die je eine Seite zurückgeben, füllen dasselbe Fenster wie ein Lauf, der fünf Seiten erzeugt hätte. Die Ersparnis liegt allein in dem, was sie unterwegs gelesen, aber nicht mitgebracht haben. Wer fächert, sagt deshalb dazu, wie kurz die Antwort sein soll.
Verschachtelung
Ein Subagent darf seinerseits Subagenten losschicken, standardmäßig bis in die dritte Lage. Das passt für eine delegierte Aufgabe, die sich selbst aufteilt: ein Prüfer, der je Befund einen eigenen Nachprüfer beauftragt. In der Hauptunterhaltung landet davon nur die eine Zusammenfassung.
An der Grenze verhält sich das Tool bemerkenswert:
Der Subagent auf der untersten Lage bekommt das Tool zum Delegieren also gar nicht erst zu sehen und erledigt seine Aufgabe selbst. Das ist die freundlichere Variante gegenüber einem Fehler zur Laufzeit, und sie ist ein gutes Beispiel für eine Grenze, die man beim Bauen nicht bemerkt.
Wann die Hauptunterhaltung gewinnt
Die Doku nennt vier Fälle, und zwei davon überraschen: häufiges Hin und Her, mehrere Abschnitte mit gemeinsamem Zusammenhang, kleine gezielte Änderungen, und Aufgaben, bei denen es auf Antwortzeit ankommt.
Für eine schnelle Rückfrage zu etwas, das ohnehin schon im Fenster steht, gibt es außerdem eine eigene knappe Form. Sie sieht den ganzen Zusammenhang, hat keinen Tool-Zugriff, und ihre Antwort verschwindet wieder, statt in den Verlauf einzugehen.
Unter allem, was dieser Lernpfad beschreibt, liegt ein sehr einfacher Ablauf. Das Modell entscheidet, ein Tool läuft, das Ergebnis kommt zurück, das Modell entscheidet erneut. Der Mechanismus dahinter ist der Tool Call aus Grundkurs, Kapitel 09, und alles Weitere ist Wiederholung.
Ein Subagent ist damit dieselbe Schleife in einem zweiten Fenster.
Wann Fächern lohnt
Mehrere Subagenten gleichzeitig laufen zu lassen ist verlockend und hat eine Bedingung, die die Doku beim Beispiel für parallele Recherche ausspricht: Es funktioniert am besten, wenn die einzelnen Wege einander nicht brauchen.
Das ist dieselbe Bedingung wie bei den Worktrees in Kapitel 04, eine Ebene höher gedacht. Dort ging es um Dateien, die sich zwei Beteiligte teilen. Hier geht es um Erkenntnisse: Wenn der zweite Subagent wissen müsste, was der erste gefunden hat, ist die Aufteilung falsch geschnitten.
seitlich verschiebbar
eigene Darstellung, Stand 04.08.2026
Praktisch lässt sich das vor dem Losschicken prüfen. Wer die Teilaufträge aufschreibt und bei jedem fragt, ob er allein beantwortbar ist, merkt es an dieser Stelle. Hinterher merkt man es daran, dass zwei Zusammenfassungen einander widersprechen.
Grenzen, die zählen
Begrenzt ist der Ausbau an zwei Stellen: wie viele Subagenten gleichzeitig laufen, und wie tief sie sich schachteln. Was eine Sitzung im Ganzen startet, zählt niemand mit:
Die Grenze für das Gleichzeitige liegt voreingestellt bei zwanzig. Ist sie erreicht, scheitert der nächste Start, bis ein laufender fertig ist, und eine Umgebungsvariable setzt sie herauf. Für gewöhnliche Arbeit ist das weit weg. Erreichbar wird sie bei Läufen, die über viele Dateien fächern, und genau dort ist eine Obergrenze auch angebracht.
Wo die Schleife nicht anhält
Die Schleife endet, wenn das Modell aufhört, Tools aufzurufen. Das ist der einzige Abbruch, den sie von sich aus kennt, und er hängt an derselben Einschätzung, mit der Kapitel 07 anfängt: Sie endet, wenn es fertig aussieht.
Daraus folgen die zwei Fehlerbilder, die bei längeren Läufen wirklich auftreten.
Das eine ist der zu frühe Halt. Der Agent hält die Aufgabe für erledigt, weil ihm nichts mehr einfällt, was zu tun wäre. Dagegen hilft ein Signal, das widerspricht, und darum ging es im Kapitel davor.
Das andere ist der Kreis. Ein Agent versucht dieselbe Sache in Abwandlungen erneut, weil jede Fassung scheitert, ohne dass ihm etwas sagt, warum. Das erkennt man von außen leichter als von innen, und die Abhilfe ist meistens nicht mehr Ausdauer: Abbrechen, den Zusammenhang neu setzen, mit dem Gelernten neu beauftragen.
Der blinde Fleck
Ein Subagent weiß, was in seinem Auftrag steht, und sonst nichts. Der allgemeine Satz dazu steht in OpenAIs Bericht über ein fünf Monate lang agentengeschriebenes Produkt:
Für einen Subagenten ist das schärfer als für die Hauptunterhaltung, weil sein Fenster leer anfängt. Was in der Hauptunterhaltung seit einer Stunde dasteht, ist für ihn nicht vorhanden.
Praktisch heißt das: Ein Auftrag an einen Subagenten enthält den Maßstab mit, also die Angabe, woran gemessen wird und was als Befund gilt. Die Bitte, den Unterschied zu prüfen, reicht dafür nicht. Das ist mehr Schreibarbeit als eine Rückfrage in der Hauptunterhaltung, und genau dafür gibt es benannte Subagenten: Wer denselben Auftrag wiederholt vergibt, schreibt ihn einmal auf.
Was am Ende die Einrichtung ausmacht
Damit schließt der Lernpfad. Neun Kapitel lang ging es um Dinge, die neben dem Modell liegen: eine Datei mit Projektwissen, eine Historie, ein Gedächtnis, eine Wissensbasis, eine Prüfung, ein Hook, ein Skill, ein zweites Fenster.
Für diese Summe hat sich seit Anfang 2026 ein Begriff eingebürgert. Mitchell Hashimoto hat ihn im Februar vergeben (externe Seite, mitchellh.com), weil er keinen kannte, und beschrieb damit eine Gewohnheit: Wo ein Agent einen Fehler macht, baut man etwas, das diesen Fehler künftig verhindert. Einen Monat später zog LangChain die Definition nach:
Die Formel dazu lautet Agent = Model + Harness (externe Seite, blog.langchain.com). Das Modell wird von einem Anbieter gebaut und alle paar Monate besser. Die andere Hälfte baut, wer damit arbeitet.
Quellen
6 Einträgealle erreichbar
Erreichbarkeit automatisch geprüft
Dokumentationerreichbar
Anthropic, Create custom subagents (externe Seite, code.claude.com)
code.claude.comgeprüft 24.09.2026
Die Herstellerdokumentation zu Subagenten. Sie beantwortet die Frage, wozu man sie nimmt, über den Kontext statt über die Arbeitsteilung: Eine Nebenaufgabe, deren Suchtreffer, Protokolle und Dateiinhalte niemand wieder braucht, läuft in einem eigenen Fenster und gibt nur die Zusammenfassung zurück. Dazu die Kanten, die man beim Bauen trifft: eigene Tool-Liste und eigene Berechtigungen, eine Anlaufzeit, weil ein Subagent bei null anfängt, und die Beobachtung, dass viele ausführliche Rückgaben denselben Platz kosten, den man sparen wollte.
Dokumentationerreichbar
Anthropic, Best practices for Claude Code (externe Seite, code.claude.com)
code.claude.comgeprüft 24.09.2026
Die Sammlung der Muster, die sich bei Anthropic intern und bei Anwendern bewährt haben. Der erste Abschnitt der Seite ist zugleich ihre stärkste Aussage: Ein Agent braucht eine Prüfung, die er selbst fahren kann, sonst ist der Mensch die Prüfschleife und jeder Fehler wartet darauf, bemerkt zu werden. Die Seite nennt vier Stufen, wie hart die Prüfung das Ende einer Runde blockiert, vom Satz im Auftrag über eine Zielbedingung und einen Stop-Hook bis zum zweiten Modell, das den eigenen Befund zu widerlegen versucht. Sie ist außerdem die Quelle für den Unterschied zwischen einer Projektanweisung und einem Hook: Die eine ist beratend, der andere läuft.
Dokumentationerreichbar
Anthropic, Explore the context window (externe Seite, code.claude.com)
code.claude.comgeprüft 24.09.2026
Die Herstellerseite zum Kontextfenster, aufgebaut als begehbare Simulation einer Sitzung. Sie ist die Quelle für den Satz, dass das Verdichten das Gespräch durch eine strukturierte Zusammenfassung ERSETZT, statt es zu verwerfen: Zum Ereignis "/compact" steht dort wörtlich "Replaces the conversation with a structured summary." Ebenfalls von dort die Ausnahme, dass die Liste der verfügbaren Skills als einziger Teil des Startinhalts nach dem Verdichten nicht erneut eingesetzt wird; erhalten bleiben nur die tatsächlich aufgerufenen. Sie belegt außerdem, dass die Startfüllung ohne Zutun geschieht: "Before you type anything: CLAUDE.md, auto memory, MCP tool names, and skill descriptions all load into context." Die Umgebungsangaben stehen in der begehbaren Simulation als eigener Posten "Environment info" mit 280 Token und der Kennzeichnung auto, beschrieben als "Working directory, platform, shell, OS version, and whether this is a git repo. Git branch, status, and recent commits load as a separate block at the very end of the system prompt." Dieser Text liegt in den Daten der Simulation und wird erst beim Anklicken des Punktes sichtbar, deshalb ist er nicht als Zitat hinterlegt.
Originalarbeiterreichbar
OpenAI, Harness engineering: leveraging Codex in an agent-first world (externe Seite, openai.com)
openai.comgeprüft 24.09.2026
Ryan Lopopolo berichtet am 11. Februar 2026 über ein Team, das fünf Monate lang ein Produkt gebaut hat, ohne eine Zeile von Hand zu schreiben. Der Wert des Berichts liegt in den Nebenwirkungen, die er offenlegt: Der Agent wiederholt vorhandene Muster einschließlich der schlechten, das Team verbrachte einen Tag der Woche mit Aufräumen, bis es die Regeln maschinell verankerte. Auch das Datum zählt, denn der Begriff Harness stand sechs Tage vorher zum ersten Mal geschrieben.
Artikelerreichbar
The Anatomy of an Agent Harness (externe Seite, blog.langchain.com)
blog.langchain.comgeprüft 24.09.2026
Vivek Trivedy zieht am 11.03.2026 die Definition nach, die sich durchgesetzt hat: Alles, was nicht das Modell ist, gehört zum Harness. Die Quelle für die Formel, mit der der Begriff heute erklärt wird.
Artikelerreichbar
My AI Adoption Journey (externe Seite, mitchellh.com)
mitchellh.comgeprüft 24.09.2026
Mitchell Hashimoto beschreibt am 05.02.2026 seinen Weg zur Arbeit mit Agenten. Der fünfte Abschnitt heißt „Engineer the Harness“ und ist die Stelle, an der das Wort seine heutige Bedeutung bekommt: Der Autor sagt selbst, dass er keinen eingeführten Ausdruck dafür kennt, und vergibt einen. Damit ist die Prägung belegt und zugleich, dass es vorher keinen Namen gab.