Views
No views yet
openbmb/MiniCPM5-1B.| File | Quantization | Approx. size | Use case |
|---|---|---|---|
minicpm5-1b-q4_k_m.gguf | Q4_K_M | ~656 MiB | Good default for Apple Silicon and local CPU inference |
openbmb/MiniCPM5-1B1llama-cli \
2 -m minicpm5-1b-q4_k_m.gguf \
3 -p "<|im_start|>user\nWrite a small Python function that validates an email address.<|im_end|>\n<|im_start|>assistant\n" \
4 -n 200 \
5 --temp 0.7minicpm5-1b-q4_k_m.gguf and import it as a local GGUF model.1hf download openbmb/MiniCPM5-1B --local-dir work/MiniCPM5-1B
2
3uv run --python /opt/homebrew/bin/python3.11 \
4 --with-requirements work/llama.cpp/requirements/requirements-convert_hf_to_gguf.txt \
5 work/llama.cpp/convert_hf_to_gguf.py \
6 work/MiniCPM5-1B \
7 --outfile outputs/minicpm5-1b-f16.gguf \
8 --outtype f16
9
10work/llama.cpp/build-gguf2/bin/llama-quantize \
11 outputs/minicpm5-1b-f16.gguf \
12 outputs/minicpm5-1b-q4_k_m.gguf \
13 Q4_K_Mopenbmb/MiniCPM5-1B.