Views
No views yet
Requires a llama.cpp build b10353 or later (#26841, merged 2026-08-10, commit62bf73d, which addedmuse_glimmerconversion + inference support). Earlier builds will fail to load these files.
| File | Quant | Size |
|---|---|---|
Muse-Glimmer-30B-uncensored-Q4_K_M.gguf | Q4_K_M | 16.9 GB |
Muse-Glimmer-30B-uncensored-Q8_0.gguf | Q8_0 | 29.6 GB |
mmproj-Muse-Glimmer-30B-uncensored-F16.gguf | F16 | 3.8 GB |
mmproj file is the vision projector and is required for image input; text-only inference does not need it.1# From HuggingFace (auto-downloads)
2llama-server -hf TrevorJS/Muse-Glimmer-30B-uncensored-GGUF -c 8192
3
4# From local file
5llama-server -m Muse-Glimmer-30B-uncensored-Q4_K_M.gguf -c 8192
6
7# With image input
8llama-server -m Muse-Glimmer-30B-uncensored-Q4_K_M.gguf -c 8192 \
9 --mmproj mmproj-Muse-Glimmer-30B-uncensored-F16.ggufconvert_hf_to_gguf.py --outtype f16) then llama-quantize.