Views
No views yet
| File | Upstream (old shim) | This repo |
|---|---|---|
config.json model_type | deepseekocr | unlimited-ocr |
processor_config.json processor_class | DeepseekOCRProcessor | UnlimitedOCRHFProcessor |
processor_config.json sft_format | deepseek | unlimitedocr |
| Weights | MXFP8 | unchanged |
deepseekocr shim often generates repetitive garbage. Routing to unlimited-ocr restores correct OCR.pip install -U "mlx-vlm>=0.6.0" pymupdf1from mlx_vlm import load, generate
2from mlx_vlm.prompt_utils import apply_chat_template
3from mlx_vlm.utils import load_config
4
5model_id = "will702/unlimited-ocr-mxfp8-mlx" # update if your namespace differs
6model, processor = load(model_id)
7config = load_config(model_id)
8
9prompt = apply_chat_template(processor, config, "Free OCR.", num_images=1)
10out = generate(
11 model, processor,
12 prompt=prompt,
13 image="page.png",
14 max_tokens=4096,
15 temperature=0.0,
16 repetition_penalty=1.05,
17)
18text = out.text.replace("Ġ", " ").replace("Ċ", "\n")
19print(text)Free OCR. — document parsing. often stops immediately on this MLX path.