Beta
Explore
Marketplace
Neural Labs
Playground
Wallet
Docs
e1_math_all_r1_10k_eval_5554 – Dataset by mlfoundations-dev | AlphaNeural AI
You can deploy this model and start earning money today!
mlfoundations-dev
/
e1_math_all_r1_10k_eval_5554
like
0
10K<n<100K
parquet
tabular
text
datasets
dask
mlcroissant
polars
us
Views
No views yet
Model card
Files and Versions
Community
API
mlfoundations-dev/e1_math_all_r1_10k_eval_5554
Precomputed model outputs for evaluation.
Evaluation Results Summary
Metric AIME24 AMC23 MATH500 MMLUPro JEEBench GPQADiamond LiveCodeBench CodeElo CodeForces HLE HMMT AIME25 LiveCodeBenchv5
Accuracy 25.7 65.5 82.4 39.8 47.4 48.3 26.2 7.5 9.1 12.6 16.7 20.7 18.0
AIME24
Average Accuracy: 25.67% ± 1.42% Number of Runs: 10
Run Accuracy Questions Solved Total Questions
1… See the full description on the dataset page:
https://huggingface.co/datasets/mlfoundations-dev/e1_math_all_r1_10k_eval_5554
.