Views
No views yet
GestaltLabs/Gemma-4-E4B-SABER for llama.cpp-compatible runtimes.| File | Quantization | Approx. size |
|---|---|---|
Gemma-4-E4B-SABER-BF16.gguf | BF16 | 13.92 GiB |
Gemma-4-E4B-SABER-Q8_0.gguf | Q8_0 | 7.43 GiB |
Gemma-4-E4B-SABER-Q6_K.gguf | Q6_K | 5.75 GiB |
Gemma-4-E4B-SABER-Q5_K_M.gguf | Q5_K_M | 5.33 GiB |
Gemma-4-E4B-SABER-Q4_K_M.gguf | Q4_K_M | 4.94 GiB |
Gemma-4-E4B-SABER-Q3_K_M.gguf | Q3_K_M | 4.49 GiB |
Gemma-4-E4B-SABER-Q2_K.gguf | Q2_K | 4.08 GiB |
llama-quantize.Q8_0: highest-quality quantized option.Q6_K: strong quality/size tradeoff.Q4_K_M: compact general-purpose option.Q2_K and Q3_K_M: smallest files, with larger quality tradeoffs.1llama-cli \
2 -m Gemma-4-E4B-SABER-Q4_K_M.gguf \
3 -p "Explain quantum computing in simple terms."GestaltLabs/Gemma-4-E4B-SABERgoogle/gemma-4-E4B-itconvert_hf_to_gguf.py.llama-quantize.