Views
No views yet
<|begin_of_text|><|start|>system<|message|>{system_prompt}
Reasoning strength: high.
# Valid recipients: "self", "user".<|eot|><|start|>user<|message|>{prompt}<|eot|><|start|>assistant| Filename | Quant type | File Size | Split | Description |
|---|---|---|---|---|
| Muse-Glimmer-30B-bf16.gguf | bf16 | 55.73GB | true | Full BF16 weights. |
| Muse-Glimmer-30B-Q8_0.gguf | Q8_0 | 29.61GB | false | Extremely high quality, generally unneeded but max available quant. |
| Muse-Glimmer-30B-Q6_K_L.gguf | Q6_K_L | 24.07GB | false | Uses Q8_0 for embed and output weights. Very high quality, near perfect, recommended. |
| Muse-Glimmer-30B-Q6_K.gguf | Q6_K | 23.41GB | false | Very high quality, near perfect, recommended. |
| Muse-Glimmer-30B-Q5_K_L.gguf | Q5_K_L | 20.94GB | false | Uses Q8_0 for embed and output weights. High quality, recommended. |
| Muse-Glimmer-30B-Q5_K_M.gguf | Q5_K_M | 20.11GB | false | High quality, recommended. |
| Muse-Glimmer-30B-Q5_K_S.gguf | Q5_K_S | 19.44GB | false | High quality, recommended. |
| Muse-Glimmer-30B-Q4_K_L.gguf | Q4_K_L | 18.30GB | false | Uses Q8_0 for embed and output weights. Good quality, recommended. |
| Muse-Glimmer-30B-Q4_1.gguf | Q4_1 | 17.83GB | false | Legacy format, similar performance to Q4_K_S but with improved tokens/watt on Apple silicon. |
| Muse-Glimmer-30B-Q4_K_M.gguf | Q4_K_M | 17.31GB | false | Good quality, default size for most use cases, recommended. |
| Muse-Glimmer-30B-Q4_K_S.gguf | Q4_K_S | 16.32GB | false | Slightly lower quality with more space savings, recommended. |
| Muse-Glimmer-30B-Q4_0.gguf | Q4_0 | 16.27GB | false | Legacy format, kept for compatibility with older tools. |
| Muse-Glimmer-30B-IQ4_NL.gguf | IQ4_NL | 16.24GB | false | Similar to IQ4_XS, but slightly larger. |
| Muse-Glimmer-30B-Q3_K_XL.gguf | Q3_K_XL | 15.96GB | false | Uses Q8_0 for embed and output weights. Lower quality but usable, good for low RAM availability. |
| Muse-Glimmer-30B-IQ4_XS.gguf | IQ4_XS | 15.44GB | false | Decent quality, smaller than Q4_K_S with similar performance, recommended. |
| Muse-Glimmer-30B-Q3_K_L.gguf | Q3_K_L | 14.78GB | false | Lower quality but usable, good for low RAM availability. |
| Muse-Glimmer-30B-Q3_K_M.gguf | Q3_K_M | 13.96GB | false | Low quality. |
| Muse-Glimmer-30B-IQ3_M.gguf | IQ3_M | 13.11GB | false | Medium-low quality, new method with decent performance comparable to Q3_K_M. |
| Muse-Glimmer-30B-Q3_K_S.gguf | Q3_K_S | 12.79GB | false | Low quality, not recommended. |
| Muse-Glimmer-30B-Q2_K_L.gguf | Q2_K_L | 12.35GB | false | Uses Q8_0 for embed and output weights. Very low quality but surprisingly usable. |
| Muse-Glimmer-30B-IQ3_XS.gguf | IQ3_XS | 12.32GB | false | Lower quality, new method with decent performance, slightly better than Q3_K_S. |
| Muse-Glimmer-30B-IQ3_XXS.gguf | IQ3_XXS | 11.55GB | false | Lower quality, new method with decent performance, comparable to Q3 quants. |
| Muse-Glimmer-30B-Q2_K.gguf | Q2_K | 11.04GB | false | Very low quality but surprisingly usable. |
| Muse-Glimmer-30B-IQ2_M.gguf | IQ2_M | 10.66GB | false | Relatively low quality, uses SOTA techniques to be surprisingly usable. |
| Muse-Glimmer-30B-IQ2_S.gguf | IQ2_S | 10.04GB | false | Low quality, uses SOTA techniques to be usable. |
| Muse-Glimmer-30B-IQ2_XS.gguf | IQ2_XS | 9.58GB | false | Low quality, uses SOTA techniques to be usable. |
| Muse-Glimmer-30B-IQ2_XXS.gguf | IQ2_XXS | 8.92GB | false | Very low quality, uses SOTA techniques to be usable. |
hf download bartowski/Muse-Glimmer-30B-GGUF --include "Muse-Glimmer-30B-Q4_K_M.gguf" --local-dir ./pip install -U "huggingface_hub[cli]"hf download bartowski/Muse-Glimmer-30B-GGUF --include "Muse-Glimmer-30B-Q4_K_M.gguf" --local-dir ./true in the Split column above are stored as multiple parts in a folder. To download all the parts to a local folder, run:hf download bartowski/Muse-Glimmer-30B-GGUF --include "Muse-Glimmer-30B-bf16/*" --local-dir ./curl -LsSf https://llama.app/install.sh | sh
llama-server -hf bartowski/Muse-Glimmer-30B-GGUF:Q4_K_M-hf as shown above; if you're loading files manually, pass it with --mmproj.--spec-type draft-dflash-hf as shown above, llama.cpp should download the DFlash file automatically alongside the model. If you're downloading files manually instead, also grab the dspark file and pass it with -md /path/to/dflash-Muse-Glimmer-30B-Q4_0.gguf.