Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
llama3.2-3b-ultrafeedback-armorm-binarized – Dataset by DtYXs | AlphaNeural AI
You can deploy this model and start earning money today!
DtYXs
/
llama3.2-3b-ultrafeedback-armorm-binarized
like
0
text-generation
10K<n<100K
parquet
text
datasets
pandas
mlcroissant
polars
2504.15843
us
Views
No views yet
Model card
Files and Versions
Community
API
This repository is associated with the paper Pre-DPO: Improving Data Utilization in Direct Preference Optimization Using a Guiding Reference Model. Code:
https://github.com/DtYXs/Pre-DPO