Views
No views yet
llama.cpp.llama.cpp with an importance matrix (imatrix) for better preservation of model quality.Nanbeige-4.1-3B-Q6_K-imatrix.gguf: The quantized model file.Nanbeige-4.1-3B.imatrix: The importance matrix used during quantization.Nanbeige-4.1-3B-Q6_K-imatrix.gguf.sha256sum: SHA256 checksum for verification../llama-cli -m Nanbeige-4.1-3B-Q6_K-imatrix.gguf -n 512 --prompt "Hello, how are you today?"Nanbeige-4.1-3B.imatrix) is provided so you can recreate or refine the quantization process.