This dataset contains OCR results from images in /home/seb/data/ocr/latin-test-input/ using dots.mocr, a 3B multilingual model with SOTA document parsing and SVG generation.
Source Dataset: /home/seb/data/ocr/latin-test-input/
Model: rednote-hilab/dots.mocr
Number of Samples: 3
Processing Time: 2.9 min
Processing Date: 2026-04-27 13:22 UTC
Image Column: image
Output Column: markdown
Dataset… See the full description on the dataset page:
https://huggingface.co/datasets/storytracer/dots-mocr-latin-test-output.