Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
instruct-ppo-mix-20k – Dataset by allura-org | AlphaNeural AI
You can deploy this model and start earning money today!
allura-org
/
instruct-ppo-mix-20k
like
0
10K<n<100K
json
text
datasets
pandas
mlcroissant
polars
us
Views
No views yet
Model card
Files and Versions
Community
API
Input dataset for PPO training, made out of a random subset of 10k rows from Gryphe/Sonnet3.5-SlimOrcaDedupCleaned-20k and a 10k rows subset from arcee-ai/EvolKit-20k. Converted to OpenRLHF prompt dataset format.