Views
No views yet
Qwen_Qwen3-0.6B-Q4_K_MQwen_Qwen3-1.7B-Q4_K_MQwen_Qwen3-4B-Q4_K_MQwen3-8B-Q4_K_M| Model Name | Parameters | Quantization | Context Length | Recommended Use |
|---|---|---|---|---|
| Qwen_Qwen3-0.6B-Q4_K_M | 0.6B | Q4_K_M | 4K tokens | Lightweight devices, microservices |
| Qwen_Qwen3-1.7B-Q4_K_M | 1.7B | Q4_K_M | 4K tokens | Fast inference, chatbots |
| Qwen_Qwen3-4B-Q4_K_M | 4B | Q4_K_M | 4K tokens | Balanced performance & efficiency |
| Qwen3-8B-Q4_K_M | 8B | Q4_K_M | 128K tokens | Complex reasoning, long documents |