NachschlagenQuellenregister

Dokumentationerreichbar

PP-DocLayoutV3

huggingface.co (externe Seite)

Die Nachfolgefassung des Layout-Erkenners, und der Beleg dafür, dass die Lesereihenfolge inzwischen ein gelerntes Ergebnis ist. Das Modell sagt Mehrpunkt-Rahmen für die Bereiche einer Seite voraus und bestimmt die logische Reihenfolge auch auf schiefen und gewölbten Flächen, alles in einem Durchlauf. Es ist zugleich Bestandteil der Verarbeitung von PaddleOCR-VL in der Fassung 1.5.

geprüft 24.09.2026

Worauf sich diese Seite beruft, wörtlich, abgerufen am 07.09.2026:

  • It can directly predict multi-point bounding boxes for layout elementsbestätigt 24.09.2026
  • and determine logical reading orders for skewed and curved surfaces within a single forward pass, significantly reducing cascading errors.bestätigt 24.09.2026
  • PP-DocLayoutV3 is specifically engineered to handle non-planar document images.bestätigt 24.09.2026
  • This model is an essential component of PaddleOCR-VL-1.5, providing crucial layout analysis for the high-precision parsing of various real-world documentsbestätigt 24.09.2026

Wie eine Maschine ein Dokument zerlegt

Alle Quellen

Tippen Sie los.

↑↓ auswählenEnter öffnenDie Suche läuft im Browser. Nichts wird übertragen.