Views
No views yet
<think>, answer in normal
english. same reasoning depth, way fewer think token. full story on main
model card.| file | quant | size | grug opinion |
|---|---|---|---|
| grug-27b-Q8_0.gguf | Q8_0 | 28.6 GB | basically bf16. big rock. |
| grug-27b-Q6_K.gguf | Q6_K | 22.1 GB | very good rock |
| grug-27b-Q5_K_M.gguf | Q5_K_M | 19.2 GB | good rock |
| grug-27b-Q4_K_M.gguf | Q4_K_M | 16.5 GB | best size/smart trade. grug pick this. |
| grug-27b-Q3_K_M.gguf | Q3_K_M | 13.3 GB | small rock. smart mostly survive. |
| mmproj-grug-27b-f16.gguf | mmproj f16 | see repo | eye rock. give grug vision back. |
-c 16384 or biggerllama-server -m grug-27b-Q4_K_M.gguf -c 16384 --temp 0.6 --top-p 0.95 --top-k 20mmproj-grug-27b-f16.gguf
(llama-server -m grug-27b-Q4_K_M.gguf --mmproj mmproj-grug-27b-f16.gguf).
MTP still not included.<think>...</think>