Views
No views yet
pip install mlx-lm1from mlx_lm import load, generate
2
3model, tok = load("YoAbriel/KodaLite-1.3B-mlx-8bit")
4prompt = tok.apply_chat_template(
5 [{"role": "user", "content": "What is the capital of France?"}],
6 tokenize=False,
7 add_generation_prompt=True,
8)
9print(generate(model, tok, prompt=prompt, max_tokens=80))