Views
No views yet
llama.cpp, Ollama, and downstream wrappers that accept GGUF multimodal models.| File | Purpose | Size |
|---|---|---|
browserground-Q4_K_M.gguf | text LLM, Q4_K_M quant | 1.11 GB |
browserground-mmproj-f16.gguf | vision tower (mmproj), f16 | 0.82 GB |
.gguf files:1ollama create browserground -f Modelfile
2ollama run browserground "Locate the Submit button" /path/to/screenshot.pngllama-mtmd-cli -m browserground-Q4_K_M.gguf --mmproj browserground-mmproj-f16.gguf --image screenshot.png -p "Locate the element described: Submit button"1npm install -g browserground
2browserground parse screenshot.png --target "Submit button"Qwen/Qwen3-VL-2B-Instruct).