Views
No views yet
1from mlx_vlm import load, generate
2from mlx_vlm.prompt_utils import apply_chat_template
3
4model, processor = load("axiom-of-choice/OmniParser-v2-icon-caption-4-bit (group_size=64)")
5prompt = apply_chat_template(processor, model.config, "<CAPTION>", num_images=1)
6output = generate(model, processor, prompt, image=crop, max_tokens=20, temperature=0.0)
7print(output.text)microsoft/OmniParser-v2.0/icon_caption, processor from microsoft/Florence-2-base.
Config patched for transformers 5.x compatibility (auto_map removed, text_config.model_type set to "bart").