Views
No views yet
AksaraLLM/AksaraLLM-Qwen-1.5B for inference with llama.cpp, Ollama, LM Studio, and other GGUF runtimes.| File | Quant | Size | Recommended use |
|---|---|---|---|
AksaraLLM-Qwen-1.5B.f16.gguf | F16 | 3.56 GB | lossless from safetensors |
AksaraLLM-Qwen-1.5B.q8_0.gguf | Q8_0 | 1.89 GB | near-lossless, ~2× smaller |
AksaraLLM-Qwen-1.5B.q6_k.gguf | Q6_K | 1.46 GB | high quality, ~2.5× smaller |
AksaraLLM-Qwen-1.5B.q5_k_m.gguf | Q5_K_M | 1.29 GB | good quality, ~3× smaller |
AksaraLLM-Qwen-1.5B.q4_k_m.gguf | Q4_K_M | 1.12 GB | recommended default, ~4× smaller |
| Quant | Prompt eval (32 tok) | Generation (16 tok) |
|---|---|---|
q4_k_m | 23.7 tok/s | 11.8 tok/s |
1huggingface-cli download AksaraLLM/AksaraLLM-Qwen-1.5B-GGUF AksaraLLM-Qwen-1.5B.q4_k_m.gguf --local-dir .
2./llama-cli -m AksaraLLM-Qwen-1.5B.q4_k_m.gguf -p "Indonesia adalah" -n 641huggingface-cli download AksaraLLM/AksaraLLM-Qwen-1.5B-GGUF AksaraLLM-Qwen-1.5B.q4_k_m.gguf Modelfile --local-dir .
2ollama create aksara-aksarallm-qwen-1.5b -f Modelfile
3ollama run aksara-aksarallm-qwen-1.5b "Apa ibukota Indonesia?"AksaraLLM/AksaraLLM-Qwen-1.5B for architecture, training data, eval results, and limitations.convert_hf_to_gguf.py from llama.cppllama-quantize from the same buildqwen2