Dokumentationerreichbar
PP-DocLayoutV3
huggingface.co (externe Seite)
Die Nachfolgefassung des Layout-Erkenners, und der Beleg dafür, dass die Lesereihenfolge inzwischen ein gelerntes Ergebnis ist. Das Modell sagt Mehrpunkt-Rahmen für die Bereiche einer Seite voraus und bestimmt die logische Reihenfolge auch auf schiefen und gewölbten Flächen, alles in einem Durchlauf. Es ist zugleich Bestandteil der Verarbeitung von PaddleOCR-VL in der Fassung 1.5.
geprüft 24.09.2026
Worauf sich diese Seite beruft, wörtlich, abgerufen am 07.09.2026:
It can directly predict multi-point bounding boxes for layout elements
bestätigt 24.09.2026and determine logical reading orders for skewed and curved surfaces within a single forward pass, significantly reducing cascading errors.
bestätigt 24.09.2026PP-DocLayoutV3 is specifically engineered to handle non-planar document images.
bestätigt 24.09.2026This model is an essential component of PaddleOCR-VL-1.5, providing crucial layout analysis for the high-precision parsing of various real-world documents
bestätigt 24.09.2026