This dataset contains OCR results from images in davanstrien/encyclopaedia-britannica-1771 using dots.mocr, a 3B multilingual model with SOTA document parsing and SVG generation.
Source Dataset: davanstrien/encyclopaedia-britannica-1771
Model: rednote-hilab/dots.mocr
Number of Samples: 50
Processing Time: 17.1 min
Processing Date: 2026-07-08 10:05 UTC
Image Column: image
Output Column:… See the full description on the dataset page:
https://huggingface.co/datasets/davanstrien/ocr-bench-britannica.