Views
No views yet
| Formato | Dimensione | Qualità | VRAM | Utilizzo |
|---|---|---|---|---|
| f16 | ~39GB | Massima | 40GB+ | Server/A100 |
| q2_k | ~11GB | Ultra-compatta | 12GB | CPU/RTX 4060 |
1# Download repository completo
2git clone https://huggingface.co/Lutifya/gpt-oss-20b-gguf
3
4# Download file singolo
5wget https://huggingface.co/Lutifya/gpt-oss-20b-gguf/resolve/main/gpt-oss-20b-f16.gguf
6wget https://huggingface.co/Lutifya/gpt-oss-20b-gguf/resolve/main/gpt-oss-20b-q2_k.gguf1# Massima qualità (f16)
2./llama-cli -m gpt-oss-20b-f16.gguf -p "Your prompt here"
3
4# Ultra-compatto (q2_k)
5./llama-cli -m gpt-oss-20b-q2_k.gguf -p "Your prompt here"
6
7# Server
8./llama-server -m gpt-oss-20b-f16.gguf --host 0.0.0.0 --port 8080