Эта модель представляет собой квантизированную версию
RuadaptQwen2.5-32B-instruct, выполненную с использованием
Activation-aware Weight Quantization (AWQ) с 6-битной точностью, а затем экспортированную в формат
GGUF.
1{
2 "zero_point": true,
3 "q_group_size": 128,
4 "w_bit": 6,
5 "version": "GEMM"
6}