Views
No views yet
### System:
{system_prompt}
### User:
{user_prompt}
### Assistant:
| Filename | Quant type | File Size | Description |
|---|---|---|---|
| DeciLM-7B-Instruct.f16.gguf | f16 | 14.1GB | Full F16 weights. |
| DeciLM-7B-Instruct.Q8_0.gguf | Q8_0 | 7.49GB | Extremely high quality, recommended. |
| DeciLM-7B-Instruct.Q4_K_M.gguf | Q4_K_M | 4.24GB | Very good quality, recommended. |
| DeciLM-7B-Instruct.Q4_0.gguf | Q4_0 | 4GB | Good quality. |
| DeciLM-7B-Instruct.Q4_0_4_4.gguf | Q4_0_4_4 | 4GB | Good quality. recommended for edge devices <8GB RAM |
| DeciLM-7B-Instruct.Q4_0_4_8.gguf | Q4_0_4_8 | 4GB | Good quality. recommended for edge devices <8GB RAM |
| DeciLM-7B-Instruct.Q4_0_8_8.gguf | Q4_0_8_8 | 4GB | Good quality. recommended for edge devices <8GB RAM |
sysctl hwcat /proc/cpuinfo| Brand | Series | Model | i8mm | sve | Quant Type |
|---|---|---|---|---|---|
| Apple | A | A4 to A14 | No | No | Q4_0_4_4 |
| Apple | A | A15 to A18 | Yes | No | Q4_0_4_8 |
| Apple | M | M1 | No | No | Q4_0_4_4 |
| Apple | M | M2/M3/M4 | Yes | No | Q4_0_4_8 |
| Tensor | G1,G2 | No | No | Q4_0_4_4 | |
| Tensor | G3,G4 | Yes | Yes | Q4_0_8_8 | |
| Samsung | Exynos | 2200,2400 | Yes | Yes | Q4_0_8_8 |
| Mediatek | Dimensity | 9000,9000+ | Yes | Yes | Q4_0_8_8 |
| Mediatek | Dimensity | 9300 | Yes | No | Q4_0_4_8 |
| Qualcomm | Snapdragon | 7+ Gen 2,8/8+ Gen 1 | Yes | Yes | Q4_0_8_8 |
| Qualcomm | Snapdragon | 8 Gen 2,8 Gen 3,X Elite | Yes | No | Q4_0_4_8 |
python3 convert_hf_to_gguf.py DeciLM-7B-Instruct/ --outfile DeciLM-7B-Instruct.f16.gguf --outtype f16./llama-quantize DeciLM-7B-Instruct.f16.gguf DeciLM-7B-Instruct.Q8_0.gguf q8_0pip install -U "huggingface_hub[cli]"huggingface-cli download ymcki/DeciLM-7B-Instruct-GGUF --include "DeciLM-7B-Instruct.Q8_0.gguf" --local-dir ./