This dataset contains OCR results from images in davanstrien/ocr-affordances-pages using PaddleOCR-VL, an ultra-compact 0.9B OCR model.
Processing Details
Source Dataset: davanstrien/ocr-affordances-pages
Model: PaddlePaddle/PaddleOCR-VL
Task Mode: ocr - General text extraction to markdown format
Number of Samples: 8
Processing Time: 2.8 min
Processing Date: 2026-06-05 14:16 UTC
Configuration… See the full description on the dataset page: https://huggingface.co/datasets/davanstrien/ocr-affordances-paddle.