Views
No views yet
1# Example using llama.cpp
2./llama-rerank -m Qwen3-Reranker-0.6B-Q8_0.gguf| Quantization | Use Case |
|---|---|
| F16 | Maximum quality, largest size |
| Q8_0 | High quality, good balance of size/performance |
| Q4_K_M | Good quality, smallest size, fastest inference |
# See original model card for citation information