Views
No views yet
070345c0…11f16) with llama.cpp's converter.| File | Quant | Size | Notes |
|---|---|---|---|
wardensight-1b.Q4_K_M.gguf | Q4_K_M | 1.02 GB | Recommended default — best size/quality balance |
wardensight-1b.Q8_0.gguf | Q8_0 | 1.74 GB | Near-lossless |
wardensight-1b.BF16.gguf | BF16 | 3.27 GB | Full precision; use as a source for re-quantizing |
llama-server -m wardensight-1b.Q4_K_M.gguf -c 16384