Views
No views yet
google/gemma-4-E4B-it-qat-q4_0-unquantized-assistant961e9a3e46ca4cf7e6e86cfceb5b5e32084bf5f0.1llama-server \
2 -m gemma-4-E4B-it.gguf \
3 --model-draft gemma-4-E4B-it-qat-assistant-q4_k_m.gguf \
4 --spec-type draft-mtp \
5 --spec-draft-n-max 3gemma-4-E4B-it-qat-assistant-bf16.ggufgemma-4-E4B-it-qat-assistant-q8_0.ggufgemma-4-E4B-it-qat-assistant-q4_k_m.ggufgemma-4-E4B-it-qat-assistant-q4_0.gguf1python convert_hf_to_gguf.py \
2 google/gemma-4-E4B-it-qat-q4_0-unquantized-assistant \
3 --outfile gemma-4-E4B-it-qat-assistant-bf16.gguf \
4 --outtype bf161llama-quantize gemma-4-E4B-it-qat-assistant-bf16.gguf gemma-4-E4B-it-qat-assistant-q4_k_m.gguf q4_k_m
2llama-quantize gemma-4-E4B-it-qat-assistant-bf16.gguf gemma-4-E4B-it-qat-assistant-q4_0.gguf q4_01python convert_hf_to_gguf.py \
2 google/gemma-4-E4B-it-qat-q4_0-unquantized-assistant \
3 --outfile gemma-4-E4B-it-qat-assistant-q8_0.gguf \
4 --outtype q8_0