Views
No views yet


| File | Size | Notes |
|---|---|---|
Vinci-Bozza-1.0-Q6_K.gguf | ~6.8 GB | Closest to BF16 quality |
Vinci-Bozza-1.0-Q5_K_M.gguf | ~6.0 GB | Good balance (recommended) |
Vinci-Bozza-1.0-Q4_K_M.gguf | ~5.2 GB | Smallest, tight memory budgets |
1# Ollama — recommended quant auto-selected
2ollama run hf.co/simpledirect/Vinci-Bozza-1.0-GGUF
3
4# Specific quant
5ollama run hf.co/simpledirect/Vinci-Bozza-1.0-GGUF:Q5_K_Mllama-cli -m Vinci-Bozza-1.0-Q5_K_M.gguf --chat-template chatml -p "Hello, who are you?"| Variant | GPU VRAM | System RAM (CPU-only) |
|---|---|---|
| Q6_K | 10 GB | 16 GB |
| Q5_K_M | 8 GB | 14 GB |
| Q4_K_M | 7 GB | 12 GB |
enable_thinking=False (or equivalent) to suppress <think> blocks for normal chat use.