Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
psychology-alpaca-rm – AI Model by samhog | AlphaNeural AI
You can deploy this model and start earning money today!
samhog
/
psychology-alpaca-rm
like
0
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
Psychology-Alpaca-RM
PEFT adapter layers for a reward model based on
decapoda-research/llama-7b-hf
.
Trained with a small subset (110 data points) of
samhog/cgpt-pairs
with 10K prompts, each with two answers (one 'good', one 'bad')