Dataset used to train the FAPO-32B model.
train.parquet: data source from DAPO-Math-17K, with "\boxed{}" instruction format and duplicated 20 times.
test.parquet: mixture of AIME24 (duplicated 32 times), AIME25 (duplicated 32 times), and GPQA-Diamond (duplicated 4 times).