Views
No views yet
Qwen2ForCausalLM, ~1.5B), for fast local inference on Apple Silicon.mlx-lm, mlx.pip install mlx-lm1from mlx_lm import load, generate
2model, tok = load("ahmedandaloes/NEXUS-Security-MLX-bf16")
3msgs=[{"role":"user","content":"Name one common web vulnerability."}]
4p=tok.apply_chat_template(msgs, add_generation_prompt=True)
5print(generate(model, tok, prompt=p, max_tokens=256, verbose=True))Qwen/Qwen2-1.5B