Views
No views yet
google/gemma-4-26B-A4B-it-assistant.IQ4_NL — best overall balance (for limited vram)Q5_K_M — recommended if VRAM allowsQ6_K / Q8_0 — highest precision optionsgemma-4-26B-A4B-it-assistant-bf16.ggufgemma-4-26b-A4B-it-assistant-IQ4_NL.ggufgemma-4-26b-A4B-it-assistant-Q4_0.ggufgemma-4-26b-A4B-it-assistant-Q4_K_M.ggufgemma-4-26b-A4B-it-assistant-Q5_K_M.ggufgemma-4-26b-A4B-it-assistant-Q6_K.ggufgemma-4-26b-A4B-it-assistant-Q8_0.gguf1llama-server \
2 -m gemma-4-26B-A4B-it-UD-Q5_K_XL.gguf \
3 -md gemma-4-26b-A4B-it-assistant-IQ4_NL.gguf \
4 --spec-type draft-mtp \
5 --spec-draft-n-max 2--spec-draft-n-max 2 for general use--spec-draft-n-max 3 for coding workloads (up to 4 if highly repetitive)