Views
No views yet
| File | Size | Use Case | Quality |
|---|---|---|---|
| omega-v21-F16.gguf | ~15 GB | Maximum quality, reference | Perfect |
| omega-v21-Q8_0.gguf | ~8.0 GB | Highest practical quality | Excellent |
| omega-v21-Q6_K.gguf | ~6.2 GB | Balanced (recommended) | Very Good |
| omega-v21-Q5_K_M.gguf | ~5.7 GB | Lighter, good quality | Good |
| omega-v21-Q4_K_M.gguf | ~5.3 GB | Smallest, mobile-friendly | Acceptable |
1pkg install llama-cpp
2wget https://huggingface.co/Abdllahd/OMEGA-V21-Full-Merged-GGUF/resolve/main/omega-v21-Q6_K.gguf
3
4llama-cli \
5 -m omega-v21-Q6_K.gguf \
6 --ctx-size 4096 \
7 --threads $(nproc) \
8 -cnv \
9 --chat-template gemma \
10 --temp 0.3| Quant | Min RAM | Speed on Android |
|---|---|---|
| F16 | 18 GB | Reference only |
| Q8_0 | 10 GB | ~2 t/s |
| Q6_K | 8 GB | ~3 t/s |
| Q5_K_M | 7 GB | ~3-4 t/s |
| Q4_K_M | 6 GB | ~4 t/s |