Views
No views yet
1# install mlx
2pip install mlx_lm1from mlx_lm import load, generate
2
3mlx_path = "ModelCloud/Qwen2.5-Coder-32B-Instruct-gptqmodel-4bit-vortex-mlx-v1"
4mlx_model, tokenizer = load(mlx_path)
5prompt = "The capital of France is"
6
7)
8
9text = generate(mlx_model, tokenizer, prompt=prompt, verbose=True)1# install gptqmodel with mlx
2pip install gptqmodel[mlx] --no-build-isolation1from gptqmodel import GPTQModel
2
3# load gptq quantized model
4gptq_model_path = "ModelCloud/Qwen2.5-Coder-32B-Instruct-gptqmodel-4bit-vortex-v1"
5mlx_path = f"./vortex/ModelCloud/Qwen2.5-Coder-32B-Instruct-gptqmodel-4bit-vortex-mlx-v1"
6
7# export to mlx model
8GPTQModel.export(gptq_model_path, mlx_path, "mlx")