| File | Size | Use |
|---|---|---|
markdown-1-Q4_K_M.gguf | ~1.9 GB | smaller / faster, great default |
markdown-1-Q8_0.gguf | ~3.3 GB | higher fidelity |
model-*.safetensors | ~6.2 GB | merged fp16 (vLLM / transformers) |
notshekhar/vibethinker-finetuned-tool.1llama-cli -hf notshekhar/markdown-1:Q4_K_M -p "Hello"
2# or local:
3llama-cli -m markdown-1-Q4_K_M.gguf -p "Hello"1# Modelfile
2printf 'FROM ./markdown-1-Q4_K_M.gguf\n' > Modelfile
3ollama create markdown-1 -f Modelfile
4ollama run markdown-1<think> traces and ChatML (<|im_start|>) with tool-calling via
<tool_call> / <tool_response> blocks (see chat_template.jinja).