Views
No views yet
Surpem/Supertron-2.1-8B-A1B.| File | Type |
|---|---|
Supertron-2.1-8B-A1B-F16.gguf | GGUF checkpoint |
Supertron-2.1-8B-A1B-Q2_K.gguf | GGUF checkpoint |
Supertron-2.1-8B-A1B-Q3_K_L.gguf | GGUF checkpoint |
Supertron-2.1-8B-A1B-Q3_K_M.gguf | GGUF checkpoint |
Supertron-2.1-8B-A1B-Q3_K_S.gguf | GGUF checkpoint |
Supertron-2.1-8B-A1B-Q4_0.gguf | GGUF checkpoint |
Supertron-2.1-8B-A1B-Q4_1.gguf | GGUF checkpoint |
Supertron-2.1-8B-A1B-Q4_K_M.gguf | GGUF checkpoint |
Supertron-2.1-8B-A1B-Q4_K_S.gguf | GGUF checkpoint |
Supertron-2.1-8B-A1B-Q5_0.gguf | GGUF checkpoint |
Supertron-2.1-8B-A1B-Q5_1.gguf | GGUF checkpoint |
Supertron-2.1-8B-A1B-Q5_K_M.gguf | GGUF checkpoint |
Supertron-2.1-8B-A1B-Q5_K_S.gguf | GGUF checkpoint |
Supertron-2.1-8B-A1B-Q6_K.gguf | GGUF checkpoint |
Supertron-2.1-8B-A1B-Q8_0.gguf | GGUF checkpoint |
.gguf files with a GGUF-compatible runtime such as llama.cpp.llama-cli -m Supertron-2.1-8B-A1B-Q4_K_M.gguf -p "Explain LoRA fine-tuning in simple terms."Q4_K_M for a good size/quality balance, Q5_K_M or Q6_K for higher quality, and Q8_0 or F16 when you have more memory.