Views
No views yet
llama.cpp, Ollama, or LM Studio..gguf files in this repository. Choose the quantization level that best fits your VRAM/RAM constraints!1📁 nemotron-3-embed-8b-gguf/
2│
3├── 📄 README.md
4├── 📄 config.json
5│
6├── 📦 Nemotron-3-Embed-8B-Q8_0.gguf (8.46 GB) 🟢 Near zero quality loss
7├── 📦 Nemotron-3-Embed-8B-Q6_K.gguf (6.53 GB) 🟢 Extremely low quality loss
8├── 📦 Nemotron-3-Embed-8B-Q5_K_M.gguf (5.69 GB) 🟡 Very low quality loss
9├── 📦 Nemotron-3-Embed-8B-Q5_K_S.gguf (5.55 GB) 🟡 Very low quality loss
10├── 📦 Nemotron-3-Embed-8B-Q4_K_M.gguf (4.90 GB) ⭐ RECOMMENDED - Great balance
11├── 📦 Nemotron-3-Embed-8B-Q4_K_S.gguf (4.65 GB) 🟠 Moderate quality loss
12└── 📦 Nemotron-3-Embed-8B-Q3_K_M.gguf (4.01 GB) 🔴 High quality loss (Memory constrained only)