This dataset contains OCR results from images in davanstrien/ocr-affordances-pages using GLM-OCR, a compact 0.9B OCR model achieving SOTA performance.
Source Dataset: davanstrien/ocr-affordances-pages
Model: zai-org/GLM-OCR
Task: text recognition
Number of Samples: 8
Processing Time: 2.9 min
Processing Date: 2026-06-05 14:15 UTC
Image Column: image
Output Column: markdown
Dataset Split:… See the full description on the dataset page:
https://huggingface.co/datasets/davanstrien/ocr-affordances-glm.