Tiefe
Gleiches Kapitel, drei Tiefen. Die Wahl gilt überall und bleibt gespeichert.

GrundlagenGrundkursKapitel 16von 16 im Pfad

Das Gesamtbild

Tiefe 1: Überblick · Lesezeit 6 Min. · Stand

Vierzehn Kapitel haben je ein Stück erklärt. Hier laufen sie an einem einzigen Vorgang zusammen: Jemand tippt eine Frage in ein Chatfenster, das im Netz nachschlagen darf, und bekommt eine Antwort. Neun Stationen liegen dazwischen.

Neun Stationen auf einer Linie, mit einer Rückführung von Station sechs auf Station drei und einem Schnitt am Ende. Neun nummerierte Punkte auf einer waagerechten Linie: zerlegen, Prompt, vorhersagen, ziehen, Tool, anhängen, ausgeben, abrechnen, vergessen. Die Punkte drei bis sechs sind hervorgehoben, und ein Bogen führt von Punkt sechs zurück auf Punkt drei, beschriftet mit solange das Modell nachschlägt. Hinter Punkt neun läuft die Linie gestrichelt aus. DER WEG EINER ANFRAGE 1 2 3 4 5 6 7 8 9 zerlegen Prompt vorhersagen ziehen Tool anhängen ausgeben abrechnen vergessen solange das Modell nachschlägt Der Kern ist eine Wiederholung, kein Schritt.

seitlich verschiebbar

Die neun Stationen in der Reihenfolge, in der sie durchlaufen werden. Wie oft sich die Schleife in der Mitte dreht, hängt am Fall: Wird nichts nachgeschlagen, entfällt sie ganz.

eigene Darstellung, Stand 29.08.2026

1. Aus Text werden Token

Die Frage wird zerlegt, bevor irgendetwas rechnet. Die Stücke heißen Token, und sie folgen keiner Silbenregel: Ein deutsches Fachwort zerfällt in mehr Stücke als ein englisches Alltagswort (Kapitel 03).

2. Die Frage ist nicht allein

Mitgeschickt wird erheblich mehr, als jemand tippt. Eine Anweisung des Anbieters, die Regeln der Anwendung, der bisherige Gesprächsverlauf, und eine Beschreibung jedes Tools, das zur Verfügung steht. Zusammen ergibt das den Prompt (Kapitel 05), und der Platz dafür ist begrenzt.

3. Das Modell sagt das nächste Token voraus

Was jetzt passiert, ist ein einziger Vorgang, viele Male wiederholt: Aus allem, was dasteht, entsteht eine Rangliste möglicher Fortsetzungen (Kapitel 02). Die Bedeutung der Wörter steckt dabei in Zahlenreihen, und Nähe darin heißt Ähnlichkeit (Kapitel 04).

4. Eines davon wird gezogen

Aus der Rangliste wird ausgewählt, und dabei ist Zufall im Spiel. Deshalb liefert dieselbe Frage zweimal zwei verschiedene Antworten (Kapitel 12).

5. Das Modell bittet um einen Tool Call

Statt zu antworten, kann es etwas anderes ausgeben: die Bitte, im Netz nachzuschlagen. Ausgeführt wird sie vom Programm daneben, nicht vom Modell (Kapitel 09). Das Modell wartet so lange.

6. Das Ergebnis kommt zurück, und alles läuft erneut

Der Suchtreffer wird an den Prompt angehängt. Dann beginnt Station 3 von vorn, mit einem längeren Text. Diese Schleife ist der Unterschied zwischen einem Chatfenster und einem Agenten (Agenten und Harness, Kapitel 01).

7. Die Antwort entsteht Wort für Wort

Sie wird nicht als Ganzes geplant. Jedes Token entsteht aus dem, was davor steht, und das erklärt, warum ein Modell mitten in einer Aufzählung eine Zahl erfinden kann, die niemand geprüft hat (Kapitel 07).

8. Abgerechnet wird nach Token

Alles, was mitgeschickt wurde, zählt, und alles, was zurückkam, ebenfalls. Der Verlauf wächst mit jedem Zug, und damit auch der Preis jeder weiteren Frage (Kapitel 10, Kapitel 11).

9. Danach ist alles weg

Das Modell hat sich nichts gemerkt. Was beim nächsten Mal noch da ist, hat jemand anders wieder hineingeschrieben (Kapitel 08). Sein Wissen aus dem Training hat einen Stichtag, den es selbst nicht kennt.

Was dieser Ablauf erklärt

Fast jede Eigenart, über die man beim Arbeiten stolpert, hat hier ihre Station. Warum deutsche Texte teurer sind als englische: Station 1. Warum dieselbe Frage zwei Antworten gibt: Station 4. Warum ein langes Gespräch teurer wird: Station 8. Warum das Modell den eigenen Namen des neuesten Produkts nicht kennt: Station 9.

Wer den Ablauf einmal im Kopf hat, kann die nächste Beobachtung selbst einordnen, statt sie nachzuschlagen.

Tippen Sie los.

↑↓ auswählenEnter öffnenDie Suche läuft im Browser. Nichts wird übertragen.