Views
No views yet
| Property | Value |
|---|---|
| Base Model | Qwen2.5-1.5B-4bit (via mlx-community) |
| Fine-tune Method | LoRA (rank 8) fused into base weights |
| Format | MLX SafeTensors (Apple Silicon optimized) |
| Training Hardware | Mac Studio M2 Ultra (M5 node) |
| Author | Ioan George Anton (Architect) |
| Purpose | Fast intent classification before expensive C0 cortex fires |
1from mlx_lm import load, generate
2
3model, tokenizer = load("georgeanton/alice-classifier-v2")
4response = generate(model, tokenizer, prompt="Classify intent: play some music", max_tokens=32)
5print(response)