Views
No views yet
| Base | Qwen2.5-Coder-1.5B-Instruct |
| Params | 1.5B (Q4_K_M ~940 MB) |
| Training | Full SFT, 2 epochs, ~29.5k train / 500 val |
| Final train loss | 0.241 |
| Decoding (public benchmarks) | greedy, EvalPlus / SWE-bench Pro scaffold |
| Benchmark | Score | Protocol |
|---|---|---|
| HumanEval pass@1 | 66.5% | EvalPlus, greedy, llama-server CUDA |
| HumanEval+ pass@1 | 62.2% | EvalPlus, greedy |
| SWE-bench Pro resolved | pending | SWE-agent + local Docker eval |
| Metric | tiny-giant-30k-Q4_K_M.gguf [30k] | Qwen2.5-Coder-1.5B-Instruct (published) | Qwen2.5-Coder-7B-Instruct (published) | DeepSeek-Coder-1.3B-Instruct (published) | StarCoder2-3B (published) | Claude Sonnet 4.5 (SWE-bench Pro) (published) | GPT-4o (SWE-bench Pro) (published) |
|---|---|---|---|---|---|---|---|
| HumanEval (pass@1) | 66.5 | 70.7 | 88.4 | 65.2 | 35.4 | — | — |
| HumanEval+ (pass@1) | 62.2 | 66.5 | 84.8 | — | — | — | — |
| MBPP (pass@1) | — | 69.2 | 83.5 | 65 | 46.4 | — | — |
| MBPP+ (pass@1) | — | 59.4 | 70.9 | — | — | — | — |
| SWE-bench Pro (resolved %) | — | — | — | — | — | 43 | 23 |
llama-server -m tiny-giant-30k-Q4_K_M.gguf --port 8088 -ngl 99