Datenerreichbar
OmniDocBench
Der Maßstab, an dem die offenen Erkennungsmodelle gemessen werden. Er prüft das Zerlegen von Dokumenten an 1651 PDF-Seiten über zehn Dokumentarten, fünf Layout-Arten und fünf Sprachen, darunter wissenschaftliche Arbeiten, Finanzberichte, Zeitungen, Lehrbücher und handschriftliche Notizen. Ausgewertet wird durchgängig und getrennt nach Layout-Erkennung, Tabellen, Formeln und Text. Die Fassung wechselte am 25.09.2025 auf v1.5, am 10.04.2026 auf v1.6 und am 30.04.2026 auf v1.7.
geprüft 24.09.2026
Worauf sich diese Seite beruft, wörtlich, abgerufen am 07.09.2026:
OmniDocBench is a benchmark for evaluating diverse document parsing in real-world scenarios
bestätigt 24.09.2026This benchmark includes 1651 PDF pages, covering 10 document types, 5 layout types, and 5 language types.
bestätigt 24.09.2026It encompasses a wide range of content, including academic papers, financial reports, newspapers, textbooks, and handwritten notes.
bestätigt 24.09.2026[2026/04/10] Major update: Updated from v1.5 to v1.6
bestätigt 24.09.2026[2026/04/30] Updated from v1.6 to v1.7, added the Qianfan-OCR leaderboard, and supported skills-based evaluation.
bestätigt 24.09.2026