NachschlagenQuellenregister

Datenerreichbar

OmniDocBench

github.com (externe Seite)

Der Maßstab, an dem die offenen Erkennungsmodelle gemessen werden. Er prüft das Zerlegen von Dokumenten an 1651 PDF-Seiten über zehn Dokumentarten, fünf Layout-Arten und fünf Sprachen, darunter wissenschaftliche Arbeiten, Finanzberichte, Zeitungen, Lehrbücher und handschriftliche Notizen. Ausgewertet wird durchgängig und getrennt nach Layout-Erkennung, Tabellen, Formeln und Text. Die Fassung wechselte am 25.09.2025 auf v1.5, am 10.04.2026 auf v1.6 und am 30.04.2026 auf v1.7.

geprüft 24.09.2026

Worauf sich diese Seite beruft, wörtlich, abgerufen am 07.09.2026:

  • OmniDocBench is a benchmark for evaluating diverse document parsing in real-world scenariosbestätigt 24.09.2026
  • This benchmark includes 1651 PDF pages, covering 10 document types, 5 layout types, and 5 language types.bestätigt 24.09.2026
  • It encompasses a wide range of content, including academic papers, financial reports, newspapers, textbooks, and handwritten notes.bestätigt 24.09.2026
  • [2026/04/10] Major update: Updated from v1.5 to v1.6bestätigt 24.09.2026
  • [2026/04/30] Updated from v1.6 to v1.7, added the Qianfan-OCR leaderboard, and supported skills-based evaluation.bestätigt 24.09.2026

Wie eine Maschine ein Dokument zerlegt

Alle Quellen

Tippen Sie los.

↑↓ auswählenEnter öffnenDie Suche läuft im Browser. Nichts wird übertragen.