Views
No views yet
1from mlx_lm import load, generate
2
3model, tokenizer = load("osirisbrain/OsirisTalon-v3-0.6B-MLX")
4prompt = tokenizer.apply_chat_template(
5 [{"role": "user", "content": "cuanto espacio tengo en disco"}],
6 add_generation_prompt=True
7)
8response = generate(model, tokenizer, prompt=prompt, max_tokens=100)