Views
No views yet
License: Apache 2.0. Based on Qwen3.6-35B-A3B by Alibaba Cloud (Apache 2.0). Modified via expert pruning.
pip install mlx-lm1from mlx_lm import load, generate
2
3model, tokenizer = load("siendsi/Qwen3-6-KMP-Dev-MLX-2bit")
4response = generate(model, tokenizer, "Write a Kotlin function to parse JSON")
5print(response)siendsi/Qwen3-6-KMP-Dev-MLX-2bit in LM Studio.| Variant | Format | Size | Quality |
|---|---|---|---|
| GGUF Q3_K_M | GGUF | 9.7GB | ~90% of original |
| GGUF Q2_K | GGUF | 7.6GB | ~75% of original |
| GGUF IQ1_M | GGUF | 4.9GB | ~60% of original, loops on tool use |
| MLX 2-bit | safetensors | 6.3GB | ~75% of original |