Views
No views yet
llama.cpp, Ollama, LM Studio, and other GGUF-compatible runtimes.| Model | Params | Quant | File Size | Download |
|---|---|---|---|---|
| Gemma 4 2B Instruct | 2B | Q4_K_M | ~3.1 GB | gemma-4-E2B-it-Q4_K_M.gguf |
| Gemma 4 4B Instruct | 4B | Q4_K_M | ~5.0 GB | gemma-4-E4B-it-Q4_K_M.gguf |
curl -L -O "https://huggingface.co/mdev64/gemma-4-e-GGUF/resolve/main/gemma-4-E2B-it-Q4_K_M.gguf?download=true"curl -L -O "https://huggingface.co/mdev64/gemma-4-e-GGUF/resolve/main/gemma-4-E4B-it-Q4_K_M.gguf?download=true"hf CLI (whole repo):hf download mdev64/gemma-4-e-GGUF --local-dir .| E2B (2B) | E4B (4B) | |
|---|---|---|
| File size | ~3.1 GB | ~5.0 GB |
| VRAM / RAM needed | ~4 GB | ~6 GB |
| Speed | ⚡ Faster | 🐢 Slower |
| Quality / reasoning | Good | ✅ Better |
| Best for | Edge devices, CPU-only, low RAM, low latency | Desktop/GPU setups where quality matters more |
1# 2B model
2llama-cli -m gemma-4-E2B-it-Q4_K_M.gguf -p "Explain quantum computing simply." -n 200
3
4# 4B model
5llama-cli -m gemma-4-E4B-it-Q4_K_M.gguf -p "Explain quantum computing simply." -n 200mdev64.