NachschlagenQuellenregister

Dokumentationerreichbar

PP-DocLayout_plus-L

huggingface.co (externe Seite)

Modellkarte des Layout-Erkenners, der auf einem Seitenbild die Rechtecke findet und benennt. Sie nennt die Architektur RT-DETR-L und den Trainingsbestand: einen selbst gebauten Datensatz aus chinesischen und englischen Arbeiten, Präsentationen, Magazinen, Verträgen, Büchern, Prüfungen, alten Drucken und Forschungsberichten. Die Kennzahl von 83,2 Prozent mAP bei einer Überlappung von 0,5 stammt aus einem ebenfalls selbst gebauten Prüfbestand von rund 1000 Dokumentbildern, ist also nicht gegen einen fremden Maßstab gemessen. Die Aufzählung der 20 Kategorien ist in sich unstimmig, sie führt table zweimal.

geprüft 24.09.2026

Worauf sich diese Seite beruft, wörtlich, abgerufen am 07.09.2026:

  • A higher-precision layout area localization model trained on a self-built dataset containing Chinese and English papers, PPT, multi-layout magazines, contracts, books, exams, ancient booksbestätigt 24.09.2026
  • The layout detection model includes 20 common categories: document title, paragraph title, text, page number, abstract, table, references, footnotes, header, footer, algorithm, formulabestätigt 24.09.2026
  • Note: the evaluation set of the above precision indicators is the self built version sub area detection data set, including Chinese and English papers, magazines, newspapers, research reportsbestätigt 24.09.2026

Wie eine Maschine ein Dokument zerlegtWo in der eigenen Texterkennung das Modell sitzt

Alle Quellen

Tippen Sie los.

↑↓ auswählenEnter öffnenDie Suche läuft im Browser. Nichts wird übertragen.