Views
No views yet
| File | Description | Size |
|---|---|---|
qwen3.5-2B-fullRC-Q4_K_M.gguf | LLM weights in Q4_K_M | 1.24 GB |
mmproj-model-f16.gguf | Vision projector (mmproj) in F16 | 668 MB |
1# Build llama.cpp (if not already built)
2cd llama.cpp && make -j
3
4# Run with multimodal (image + text) inference
5./llama-mtmd-cli \
6 -m qwen3.5-2B-fullRC-Q4_K_M.gguf \
7 --mmproj mmproj-model-f16.gguf \
8 --chat-template chatml
9
10# Text-only inference (no vision)
11echo "What is the capital of France?" | ./llama-mtmd-cli \
12 -m qwen3.5-2B-fullRC-Q4_K_M.gguf \
13 -p - --chat-template chatml