Qwen3.5-0.8B GGUF
Q4_K_M quantized GGUF for Qwen3.5-0.8B.
Model Details
- Base Model: Qwen/Qwen3.5-0.8B
- Quantization: Q4_K_M
- Format: GGUF
- Size: 504 MB
Usage
./llama-cli -m qwen3.5-0.8b.gguf -p "Hello"
Note
This is a standard Q4_K_M quantization, not PreSINQ-optimized.
Source
Original quantization by diodel.