Views
No views yet
| Quant | Recommended Use |
|---|---|
| Q4_K_S | Smallest size |
| Q4_K_M | ⭐ Recommended |
| Q8_0 | Maximum quality |
| F16 | Further quantization |
Modelfile1FROM ./gemma-4-12B-it-Q4_K_M.gguf
2
3PARAMETER temperature 0.7
4PARAMETER num_ctx 32768
5
6SYSTEM You are a helpful AI assistant.ollama create gemma4-12b -f Modelfileollama run gemma4-12bgemma-4-12B-it-Q4_K_M.ggufgemma-4-12B-it-Q4_K_M.ggufollama create gemma4-12b -f Modelfilegemma4-12b1./build/bin/llama-cli \
2 -m gemma-4-12B-it-Q4_K_M.gguf \
3 -cnv1./build/bin/llama-server \
2 -m gemma-4-12B-it-Q4_K_M.ggufhttp://localhost:8080/v1| Quant | RAM |
|---|---|
| Q4_K_S | 10 GB+ |
| Q4_K_M | 12 GB+ |
| Q8_0 | 18 GB+ |
| F16 | 32 GB+ |
Q4_K_MQ8_0Q4_K_SF16