Views
No views yet
| Filename | Quant Type | Size | BPW | Description |
|---|---|---|---|---|
gemma-4-E4B-Gemini-3.1-Pro-Reasoning-Distill-F16.gguf | F16 | 15GB | 16.0 | Full precision, best quality |
gemma-4-E4B-Gemini-3.1-Pro-Reasoning-Distill-Q8_0.gguf | Q8_0 | 8GB | 8.5 | High quality, good for most use cases |
gemma-4-E4B-Gemini-3.1-Pro-Reasoning-Distill-Q5_K_M.gguf | Q5_K_M | 5.8GB | 6.1 | Balanced quality/size, recommended |
gemma-4-E4B-Gemini-3.1-Pro-Reasoning-Distill-Q4_K_M.gguf | Q4_K_M | 5.3GB | 5.0 | Good quality, smaller size |
gemma-4-E4B-Gemini-3.1-Pro-Reasoning-Distill-Q3_K_M.gguf | Q3_K_M | 4.6GB | 5.1 | Smallest, for constrained devices |
1# Download a quantized model
2wget https://huggingface.co/Ayodele01/gemma-4-E4B-Gemini-3.1-Pro-Reasoning-Distill-GGUF/resolve/main/gemma-4-E4B-Gemini-3.1-Pro-Reasoning-Distill-Q8_0.gguf
3
4# Run with llama.cpp
5./llama-cli -m gemma-4-E4B-Gemini-3.1-Pro-Reasoning-Distill-Q8_0.gguf \
6 -p "What is the sum of all prime numbers between 1 and 50?" \
7 -n 512FROM ./gemma-4-E4B-Gemini-3.1-Pro-Reasoning-Distill-Q8_0.gguf
TEMPLATE """<bos><start_of_turn>user
{{ .Prompt }}<end_of_turn>
<start_of_turn>model
"""
PARAMETER stop "<end_of_turn>"
PARAMETER temperature 0.71ollama create gemma4-reasoning -f Modelfile
2ollama run gemma4-reasoning