Views
No views yet
mlx-lm 0.31.3 using affine 8-bit weights and group size 64 (8.501 effective bits per weight). The safetensors weights occupy approximately 27 GB.1from mlx_lm import load, generate
2
3model, tokenizer = load("DreamFoundries/Qwen3.8-27B-8bit")
4response = generate(model, tokenizer, prompt="hello", verbose=True)