Views
No views yet

| Task | RaceBench-MiniCPM5 | MiniCPM5-1B (base) | Delta | z |
|---|---|---|---|---|
| BBH (zero-shot, 27 subtasks, n=6511) | 0.3397 ± 0.0056 | 0.3123 ± 0.0055 | +2.74 | +3.5 |
| GSM8K (n=1319) | 0.3108 ± 0.0127 | 0.4102 ± 0.0135 | -9.93 | -5.3 |
| MMLU (subset, n=5700) | 0.5310 ± 0.0060 | 0.5497 ± 0.0059 | -1.87 | -2.2 |
| Minerva MATH-500 (n=500) | 0.2140 ± 0.0184 | 0.2620 ± 0.0197 | -4.80 | -1.8 |
| Winogrande (n=1267) | 0.5391 ± 0.0140 | 0.5620 ± 0.0139 | -2.29 | -1.2 |
| HellaSwag (n=10042) | 0.4820 ± 0.0050 | 0.4881 ± 0.0050 | -0.61 | -0.9 |
| TruthfulQA MC2 (n=817) | 0.4710 ± 0.0149 | 0.4597 ± 0.0149 | +1.13 | +0.5 |
| GPQA Main n-shot (n=448) | 0.2589 ± 0.0207 | 0.2723 ± 0.0211 | -1.34 | -0.5 |
| ARC-Challenge (n=1176) | 0.3746 ± 0.0141 | 0.3831 ± 0.0142 | -0.85 | -0.4 |
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model = AutoModelForCausalLM.from_pretrained(
4 "saidutta69/RaceBench-MiniCPM5",
5 trust_remote_code=True,
6 torch_dtype="float16",
7)
8tokenizer = AutoTokenizer.from_pretrained("saidutta69/RaceBench-MiniCPM5")gguf/ (F16, Q8_0, Q6_K, Q5_K_M, Q5_K_S, Q5_0, Q4_K_M, Q4_K_S, Q4_0, Q3_K_M, Q3_K_S, Q2_K).1@misc{racebench-minicpm5,
2 author = {Sai Dutta},
3 title = {RaceBench-MiniCPM5 -- First Public Fine-Tune on RaceBench},
4 year = {2026},
5 publisher = {Hugging Face},
6 howpublished = {\url{https://huggingface.co/saidutta69/RaceBench-MiniCPM5}}
7}