This is an
MLX format conversion of
uaytug/uCoder-8b-base for efficient inference on Apple Silicon devices.
1from mlx_lm import load, generate
2
3# Load 4-bit quantized model (fastest, smallest)
4model, tokenizer = load("uaytug/uCoder-8b-base-mlx", adapter_path="4bit")
5
6# Or load 8-bit for higher quality
7# model, tokenizer = load("uaytug/uCoder-8b-base-mlx", adapter_path="8bit")
8
9# Generate text
10prompt = "def fibonacci(n):"
11response = generate(model, tokenizer, prompt=prompt, max_tokens=256)
12print(response)
1# Generate with 4-bit model
2mlx_lm.generate --model uaytug/uCoder-8b-base-mlx --adapter-path 4bit --prompt "def hello_world():"
3
4# Chat mode
5mlx_lm.chat --model uaytug/uCoder-8b-base-mlx --adapter-path 4bit