Views
No views yet
bge-m3 model.| Filename | Quantization | Size | Recommended Use Case |
|---|---|---|---|
french-bge-m3-f16.gguf | F16 | ~700 MB | Full precision baseline |
french-bge-m3-q8_0.gguf | Q8_0 | ~360 MB | Recommended (99.9% quality, small footprint) |
french-bge-m3-q5_k_m.gguf | Q5_K_M | ~260 MB | Medium quantization |
french-bge-m3-q4_k_m.gguf | Q4_K_M | ~220 MB | Ultra lightweight |
llama-server -m french-bge-m3-q8_0.gguf --embedding --port 8080 -ngl 99-hf):llama-server -hf "fabcc/french-bge-m3-GGUF:french-bge-m3-q8_0.gguf" --embedding --port 8080 -ngl 991curl http://127.0.0.1:8080/v1/embeddings \
2 -H "Content-Type: application/json" \
3 -d '{
4 "input": "Ceci est un document de test en français.",
5 "model": "french-bge-m3"
6 }'