NachschlagenQuellenregister

Ankündigung des Herstellerserreichbar

Why language models hallucinate

openai.com (externe Seite)

OpenAIs eigene Darstellung der Arbeit vom Vortag, 05.09.2025. Sie enthält den Vergleich mit dem Multiple-Choice-Bogen und die Tabelle, die zeigt, was Enthaltung kostet: Ein Modell, das bei jeder zweiten Frage schweigt, kommt auf 26 Prozent Falschauskunft, eines, das fast immer antwortet, auf 75 Prozent, bei fast gleicher Trefferquote. Beleg auch für die Gegenthese zur behaupteten Unvermeidbarkeit.

geprüft 24.09.2026Archivfassung (externe Seite, web.archive.org)

Worauf sich diese Seite beruft, wörtlich, abgerufen am 30.07.2026:

  • Leaving it blank guarantees a zerobestätigt 24.09.2026
  • accuracy-only scoreboards dominate leaderboards and model cardsbestätigt 24.09.2026
  • because language models can abstain when uncertainbestätigt 24.09.2026
  • the older OpenAI o4-mini model performs slightly betterbestätigt 24.09.2026
  • a good hallucination eval has little effect against hundreds of traditional accuracy-based evalsbestätigt 24.09.2026

02 Was ein Sprachmodell tut07 Halluzinationen erkennen

Alle Quellen

Tippen Sie los.

↑↓ auswählenEnter öffnenDie Suche läuft im Browser. Nichts wird übertragen.