Beta
Explore
Marketplace
Neural Labs
Playground
Wallet
Docs
c1_math_10d_16s_eval_636d – Dataset by mlfoundations-dev | AlphaNeural AI
You can deploy this model and start earning money today!
mlfoundations-dev
/
c1_math_10d_16s_eval_636d
like
0
1K<n<10K
parquet
tabular
text
datasets
dask
mlcroissant
polars
us
Views
No views yet
Model card
Files and Versions
Community
API
mlfoundations-dev/c1_math_10d_16s_eval_636d
Precomputed model outputs for evaluation.
Evaluation Results Summary
Metric AIME24 AMC23 MATH500 MMLUPro JEEBench GPQADiamond LiveCodeBench CodeElo CodeForces
Accuracy 29.7 70.5 83.2 29.0 44.7 43.1 13.8 1.5 1.2
AIME24
Average Accuracy: 29.67% ± 1.37% Number of Runs: 10
Run Accuracy Questions Solved Total Questions
1 33.33% 10 30
2 26.67% 8 30
3 23.33% 7 30
4 36.67% 11 30… See the full description on the dataset page:
https://huggingface.co/datasets/mlfoundations-dev/c1_math_10d_16s_eval_636d
.