Views
No views yet
deepseek-ai/DeepSeek-V2-Lite-Chat.deepseek-ai/DeepSeek-V2-Lite-Chatllama.cpp, then quantized with
llama-quantize. Three precision levels are provided.| File | Bits/param | Use case |
|---|---|---|
deepseek-v2-lite-chat-Q4_K_M.gguf | ~4.5 | Smallest, modest VRAM |
deepseek-v2-lite-chat-Q5_K_M.gguf | ~5.5 | Sweet spot quality / size |
deepseek-v2-lite-chat-Q8_0.gguf | ~8 | Near-lossless |
llama.cpp, llama-cpp-python,
LM Studio, Ollama, etc.):./llama-cli -m <file>-Q4_K_M.gguf -p "Hello"