Views
No views yet
llama.cpp to run inference over LINCE-ZERO on low resources, but in case you want to use it via LM Studio in MacOS you will encounter some issues, as it may only work with q4_k_s, q4_k_m, q5_k_s, and q5_k_m quantization formats, and those are not included in TheBloke's.| Name | Quant method | Bits | Size | Max RAM required | Use case |
|---|---|---|---|---|---|
| lince-zero-7b-q4_k_s.gguf | Q4_K_S | 4 | 7.41 GB | 9.91 GB | small, greater quality loss |
| lince-zero-7b-q4_k_m.gguf | Q4_K_M | 4 | 7.87 GB | 10.37 GB | medium, balanced quality - recommended |
| lince-zero-7b-q5_k_s.gguf | Q5_K_S | 5 | 8.97 GB | 11.47 GB | large, low quality loss - recommended |
| lince-zero-7b-q5_k_m.gguf | Q5_K_M | 5 | 9.23 GB | 11.73 GB | large, very low quality loss - recommended |