Views
No views yet
| Filename | Quant Type | Size | Description |
|---|---|---|---|
gemma-4-E2B-Gemini-3.1-Pro-Reasoning-Distill.gguf | BF16 | ~5GB | Full precision, best quality |
gemma-4-E2B-Gemini-3.1-Pro-Reasoning-Distill-Q8_0.gguf | Q8_0 | ~2.5GB | High quality |
gemma-4-E2B-Gemini-3.1-Pro-Reasoning-Distill-Q5_K_M.gguf | Q5_K_M | ~2GB | Balanced (recommended) |
gemma-4-E2B-Gemini-3.1-Pro-Reasoning-Distill-Q4_K_M.gguf | Q4_K_M | ~1.7GB | Good quality, smaller |
gemma-4-E2B-Gemini-3.1-Pro-Reasoning-Distill-Q3_K_M.gguf | Q3_K_M | ~1.4GB | Smallest |
1# Download a quantized model
2wget https://huggingface.co/Ayodele01/gemma-4-E2B-Gemini-3.1-Pro-Reasoning-Distill-GGUF/resolve/main/gemma-4-E2B-Gemini-3.1-Pro-Reasoning-Distill-Q5_K_M.gguf
3
4# Run with llama.cpp
5./llama-cli -m gemma-4-E2B-Gemini-3.1-Pro-Reasoning-Distill-Q5_K_M.gguf \
6 -p "What is the sum of all prime numbers between 1 and 50?" \
7 -n 512FROM ./gemma-4-E2B-Gemini-3.1-Pro-Reasoning-Distill-Q5_K_M.gguf
TEMPLATE """<bos><start_of_turn>user
{{ .Prompt }}<end_of_turn>
<start_of_turn>model
"""
PARAMETER stop "<end_of_turn>"
PARAMETER temperature 0.71ollama create gemma4-e2b-reasoning -f Modelfile
2ollama run gemma4-e2b-reasoning