Views
No views yet
1# install mlx
2pip install mlx_lm1from mlx_lm import load, generate
2
3mlx_path = "ModelCloud/Llama-3.2-1B-Instruct-gptqmodel-4bit-vortex-mlx-v2.5"
4mlx_model, tokenizer = load(mlx_path)
5prompt = "The capital of France is"
6
7)
8
9text = generate(mlx_model, tokenizer, prompt=prompt, verbose=True)1# install gptqmodel with mlx
2pip install gptqmodel[mlx] --no-build-isolation1from gptqmodel import GPTQModel
2
3# load gptq quantized model
4gptq_model_path = "ModelCloud/Llama-3.2-1B-Instruct-gptqmodel-4bit-vortex-v2.5"
5mlx_path = f"./vortex/Llama-3.2-1B-Instruct-gptqmodel-4bit-vortex-mlx-v2.5"
6
7# export to mlx model
8GPTQModel.export(gptq_model_path, mlx_path, "mlx")