Views
No views yet
[!IMPORTANT] This is not a standalone chat model. It is an EAGLE3 draft/speculator model and must be used together with the matching target/verifier model.
unsloth/gemma-4-26B-A4B-it-GGUFRedHatAI/gemma-4-26B-A4B-it-speculator.eagle3--spec-type draft-eagle3| File | Type | Notes |
|---|---|---|
gemma-4-26B-A4B-it-speculator.eagle3-F16.gguf | EAGLE3 speculator GGUF | Converted from the original RedHatAI safetensors checkpoint |
gemma-4-26B-A4B-it-speculator.eagle3-Q8_0.gguf | Quantized EAGLE3 speculator GGUF | Quantized from the F16 GGUF |
gemma-4-26B-A4B-it-speculator.eagle3-Q4_K_M.gguf | Quantized EAGLE3 speculator GGUF | Quantized from the F16 GGUF; may be faster for draft decoding |
1llama-server \
2 -m gemma-4-26B-A4B-it-Q4_K_M.gguf \
3 -md gemma-4-26B-A4B-it-speculator.eagle3-Q4_K_M.gguf \
4 --spec-type draft-eagle3 \
5 --spec-draft-n-max 4 \
6 --spec-draft-p-min 0.5 \
7 -c 32768 \
8 -ngl 99 \
9 -fa on1llama-server.exe ^
2 -m gemma-4-26B-A4B-it-Q4_K_M.gguf ^
3 -md gemma-4-26B-A4B-it-speculator.eagle3-Q4_K_M.gguf ^
4 --spec-type draft-eagle3 ^
5 --spec-draft-n-max 4 ^
6 --spec-draft-p-min 0.5 ^
7 -c 32768 ^
8 -ngl 99 ^
9 -fa on1.\llama-server.exe `
2 -m "gemma-4-26B-A4B-it-Q4_K_M.gguf" `
3 -md "gemma-4-26B-A4B-it-speculator.eagle3-Q4_K_M.gguf" `
4 --spec-type draft-eagle3 `
5 --spec-draft-n-max 4 `
6 --spec-draft-p-min 0.5 `
7 -c 32768 `
8 -ngl 99 `
9 -fa onunsloth/gemma-4-26B-A4B-it-GGUF.unsloth/gemma-4-26B-A4B-it-GGUF--spec-type draft-eagle3--spec-draft-n-max 4--spec-draft-p-min 0.50.70 in local testing, with stronger gains on structured or predictable tasks such as:convert_hf_to_gguf.py using the original speculator repository and the matching target model directory.1python convert_hf_to_gguf.py \
2 RedHatAI/gemma-4-26B-A4B-it-speculator.eagle3 \
3 --outtype f16 \
4 --target-model-dir gemma-4-26B-A4B-it \
5 --outfile gemma-4-26B-A4B-it-speculator.eagle3-F16.gguf1python .\convert_hf_to_gguf.py `
2 "E:\OLLAMA_MODELS\gemma-4-26B-A4B-it-speculator.eagle3" `
3 --outtype f16 `
4 --target-model-dir "E:\OLLAMA_MODELS\gemma-4-26B-A4B-it" `
5 --outfile "E:\OLLAMA_MODELS\gemma-4-26B-A4B-it-speculator.eagle3-F16.gguf"llama-quantize.1llama-quantize \
2 gemma-4-26B-A4B-it-speculator.eagle3-F16.gguf \
3 gemma-4-26B-A4B-it-speculator.eagle3-Q8_0.gguf \
4 Q8_01llama-quantize \
2 gemma-4-26B-A4B-it-speculator.eagle3-F16.gguf \
3 gemma-4-26B-A4B-it-speculator.eagle3-Q4_K_M.gguf \
4 Q4_K_M1.\llama-quantize.exe `
2 "E:\OLLAMA_MODELS\gemma-4-26B-A4B-it-speculator.eagle3-F16.gguf" `
3 "E:\OLLAMA_MODELS\gemma-4-26B-A4B-it-speculator.eagle3-Q4_K_M.gguf" `
4 Q4_K_MRedHatAI/gemma-4-26B-A4B-it-speculator.eagle3unsloth/gemma-4-26B-A4B-it-GGUFggml-org/llama.cpp