Originalarbeiterreichbar
Evaluating Language Model Context Windows: A Working Memory Test and Inference-time Correction
Amanda Dsouza, Christopher Glaze, Changho Shin und Frederic Sala prüfen den Effekt am 04.07.2024 an den damals stärksten Modellen und nennen sie beim Namen: Auch GPT-4 und Claude 3 Opus verlieren, wenn die gesuchte Angabe in der Mitte steht. Damit ist belegt, dass es weder an einem Hersteller noch an einer schwachen Modellklasse liegt.
geprüft 24.09.2026
Worauf sich diese Seite beruft, wörtlich, abgerufen am 31.07.2026:
Even strong models such as GPT-4 and Claude 3 Opus degrade in performance when information is present in the middle of the context window
bestätigt 24.09.2026