Tiefe
Gleiches Kapitel, drei Tiefen. Die Wahl gilt überall und bleibt gespeichert.

GrundlagenConversational AIKapitel 05von 12 im Pfad

Wissen anbinden

Tiefe 1: Überblick · Lesezeit 8 Min. · Stand

Ein Sprachagent, der aus eigenen Unterlagen antwortet, macht dasselbe wie im Chatfenster: Er sucht, bevor er antwortet. Wie das funktioniert, steht in Agenten und Harness, Kapitel 03. Was sich ändert, ist eine einzige Sache, und sie ändert alles Weitere: Man hört ihm beim Suchen zu.

Die vier Schritte, mit einer Uhr daneben

Im Chatfenster laufen sie unsichtbar ab. Die Frage geht hinein, die Suche läuft, die Fundstellen werden an die Frage gehängt, das Modell antwortet. Wer davorsitzt, sieht drei Sekunden lang einen blinkenden Cursor.

Im Gespräch ist derselbe Ablauf eine Stille. Und Stille bedeutet im Gespräch etwas: Nach etwa einer Sekunde fragen Menschen nach, ob die Gegenseite noch da ist.

Daraus folgt die Regel für den Rest dieses Kapitels: Jeder Schritt zwischen Frage und Antwort muss sich rechtfertigen. Im Chatfenster kostet ein zusätzlicher Suchdurchgang Rechenzeit. Im Gespräch kostet er Glaubwürdigkeit.

Was das System sagt, während es sucht

Die einfachste Antwort darauf ist, die Stille zu füllen. Der Hersteller hat dafür einen Namen und eine Empfehlung:

Preambles are short spoken updates that keep a voice agent feeling responsive while it reasons, looks something up, or calls a tool. (externe Seite, developers.openai.com)

Was dabei zu sagen ist und was besser nicht, steht in Kapitel 06, denn es gilt für jede Art von Arbeit im Hintergrund. Für dieses Kapitel zählt der mittlere Teil des Satzes: looks something up. Das Nachschlagen ist als Wartefall ausdrücklich mitgemeint.

Was passiert, wenn nichts gefunden wird

Im Chatfenster sieht man eine leere Trefferliste und weiß Bescheid. Im Gespräch gibt es keine Liste. Der Unterschied zwischen „ich habe nichts gefunden“ und „dazu gibt es nichts“ muss also gesagt werden, und zwar von einem System, dem beides gleich aussieht, solange ihm niemand beibringt, die leere Suche zu melden.

Das ist derselbe Fall wie in Grundkurs, Kapitel 07, nur ohne die Möglichkeit, es nachzulesen.

Quellen

3 Einträgealle erreichbar

Erreichbarkeit automatisch geprüft

  • Dokumentationerreichbar

    OpenAI, Using realtime models (externe Seite, developers.openai.com)

    developers.openai.comgeprüft 24.09.2026

    Die Anleitung zum Anweisen eines Sprachmodells, das rohen Ton verarbeitet. Sie belegt nebenbei, was ein solches Modell auseinanderhalten kann: Stille, Hintergrundgeräusch, Wartemusik, Fernsehton und ein Gespräch, das jemand anderem gilt. Dieselbe Seite führt die Ansage vor einer Wartezeit als eigenes Bauteil mit Namen und benennt ihre Kehrseite: Schlecht gemacht erhöht sie die gefühlte Wartezeit. Die Anweisungen stehen dort für zwei Modellfassungen nebeneinander und lauten verschieden; zitiert ist hier die neuere.

  • Dokumentationerreichbar

    OpenAI, Realtime conversations (externe Seite, developers.openai.com)

    developers.openai.comgeprüft 24.09.2026

    Die Beschreibung dessen, was in einer laufenden Sprachsitzung passiert, und der Ort, an dem der Anbieter den Preis einer Prüfung vor der Antwort selbst benennt: Wer die automatische Antwort abschaltet, um Eingaben zu moderieren, zu prüfen oder erst etwas nachzuschlagen, bezahlt das mit Wartezeit. Dieselbe Seite nennt die Obergrenze einer Sitzung und beschreibt den Ablauf eines Tool Calls.

  • Dokumentationerreichbar

    Google, Grounding with Google Search (externe Seite, ai.google.dev)

    ai.google.devgeprüft 24.09.2026

    Googles Dokumentation zur Verankerung von Antworten in Suchergebnissen. Sie benennt den Knowledge Cutoff ausdrücklich als das, was damit überschritten wird, und beschreibt den ganzen Ablauf aus Suchen, Verarbeiten und Belegen als Sache der Umgebung.

Tippen Sie los.

↑↓ auswählenEnter öffnenDie Suche läuft im Browser. Nichts wird übertragen.