Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
QwQ-32B_1743604989_eval_0981 – Dataset by mlfoundations-dev | AlphaNeural AI
You can deploy this model and start earning money today!
mlfoundations-dev
/
QwQ-32B_1743604989_eval_0981
like
0
1K<n<10K
parquet
tabular
text
datasets
dask
mlcroissant
polars
us
Views
No views yet
Model card
Files and Versions
Community
API
mlfoundations-dev/QwQ-32B_1743604989_eval_0981
Precomputed model outputs for evaluation.
Evaluation Results Summary
Metric AIME24 AIME25 AMC23 MATH500 GPQADiamond LiveCodeBench
Accuracy 81.3 66.0 97.0 90.8 23.9 90.2
AIME24
Average Accuracy: 81.33% ± 1.79% Number of Runs: 5
Run Accuracy Questions Solved Total Questions
1 86.67% 26 30
2 76.67% 23 30
3 83.33% 25 30
4 83.33% 25 30
5 76.67% 23 30… See the full description on the dataset page:
https://huggingface.co/datasets/mlfoundations-dev/QwQ-32B_1743604989_eval_0981
.