This dataset contains OCR results from images in davanstrien/encyclopaedia-britannica-1771 using GLM-OCR, a compact 0.9B OCR model achieving SOTA performance.
Source Dataset: davanstrien/encyclopaedia-britannica-1771
Model: zai-org/GLM-OCR
Task: text recognition
Number of Samples: 100
Processing Time: 9.0 min
Processing Date: 2026-02-17 16:03 UTC
Image Column: image
Output Column: markdown… See the full description on the dataset page:
https://huggingface.co/datasets/davanstrien/encyclopaedia-britannica-1771-glm-ocr.