Views
No views yet
1pip install mlx-lm
2mlx_lm.generate --model cyboghostginx/Dolphin-X1-8B-mlx-4Bit \
3 --prompt "your prompt" --max-tokens 5121from mlx_lm import load, generate
2
3model, tokenizer = load("cyboghostginx/Dolphin-X1-8B-mlx-4Bit")
4prompt = tokenizer.apply_chat_template(
5 [{"role": "user", "content": "hello"}], tokenize=False, add_generation_prompt=True
6)
7print(generate(model, tokenizer, prompt=prompt, verbose=True))