This dataset contains markdown-formatted OCR results from images in johnlockejrr/hayyim using DeepSeek-OCR via vLLM API.
Source Dataset: johnlockejrr/hayyim
Model: deepseek-ai/DeepSeek-OCR
Number of Samples: 140
Processing Time: 122.1 min
Processing Date: 2025-12-01 11:53 UTC
API Endpoint:
http://127.0.0.1:8000/v1/chat/completions
Image Column: image
Output Column: markdown
Dataset Split:… See the full description on the dataset page:
https://huggingface.co/datasets/johnlockejrr/hayyim-deepseek-ocr.