Views
No views yet
llama.cpp's conversion tools.llama.cpp and intextus.bge-small-en-v1.5-F32.gguf: Full precision F32.bge-small-en-v1.5-F16.gguf: Half precision F16.bge-small-en-v1.5-Q8_0.gguf: 8-bit quantization (recommended default, fast and near-lossless).bge-small-en-v1.5-Q6_K.gguf: 6-bit quantization.bge-small-en-v1.5-Q5_K_M.gguf: 5-bit quantization (Medium).bge-small-en-v1.5-Q5_0.gguf: 5-bit quantization.bge-small-en-v1.5-Q4_K_M.gguf: 4-bit quantization (Medium).bge-small-en-v1.5-Q4_0.gguf: 4-bit quantization.bge-small-en-v1.5-Q3_K_M.gguf: 3-bit quantization (Medium).bge-small-en-v1.5-Q2_K.gguf: 2-bit quantization.