Views
No views yet
| SKU | Hardware fit | This repo |
|---|---|---|
zen5-flash | anything (4 GB VRAM) | zen-5-flash-gguf |
zen5-mini | 32 GB unified RAM (Q4_K_M) | ← you are here |
zen5 (default) | 24 GB+ VRAM | zen-5-gguf |
zen5-pro | Mac M4 Max / DGX Spark / H100 80GB | zen-5-pro-gguf |
zen5-max | Mac Studio M3 Ultra 512GB / 8x H100 | zen-5-max-gguf |
| File | Size | Quant |
|---|---|---|
main GGUF (*-Q4_K_M.gguf) | ~140 GB | Q4_K_M |
api.hanzo.ai) as zen5-mini.llama.cpp or compatible:1hf download zenlm/zen-5-mini-gguf --local-dir gguf
2MAIN=$(ls gguf/*-Q4_K_M.gguf | head -1)
3llama-cli -m "$MAIN" -p "Reply in one sentence: what year is it?"