Views
No views yet
baidu/Unlimited-OCR.1from mlx_vlm import load
2from mlx_vlm.generate import generate
3
4model, processor = load("mikoy92/Unlimited-OCR-bf16-mlx")
5result = generate(
6 model,
7 processor,
8 "<image>\ndocument parsing.",
9 image="your_image.jpg",
10 max_tokens=512,
11 temperature=0.0,
12)
13print(result.text)1python -m mlx_vlm generate \
2 --model mikoy92/Unlimited-OCR-bf16-mlx \
3 --image your_image.jpg \
4 --prompt "document parsing." \
5 --temp 0format=mlx). It uses the existing deepseekocr MLX implementation because Unlimited-OCR shares that SAM + CLIP-L + DeepSeekV2 OCR architecture shape with different checkpoint dimensions.