Views
No views yet
--quant-predicate mixed_3_6.| Property | Value |
|---|---|
| Base Model | MiniMaxAI/MiniMax-M2.5 |
| Quantization | mlx-lm v0.30.7 with --quant-predicate mixed_3_6 |
| Library | mlx-lm |
| License | modified-mit |
| Parameter | Value |
|---|---|
| temperature | 1.0 |
| top_p | 0.95 |
| top_k | 40 |
1import mlx_lm
2from mlx_lm.sample_utils import make_sampler
3
4model_path = "petergilani/MiniMax-M2.5-mix3-6bit"
5model, tokenizer = mlx_lm.load(model_path)
6
7sampler = make_sampler(temp=1.0, top_p=0.95, top_k=40)
8
9prompt = "Your prompt here"
10response = mlx_lm.generate(
11 model,
12 tokenizer,
13 prompt=prompt,
14 sampler=sampler,
15 max_tokens=512
16)
17print(response)