Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
beaver-7b-v2.0-reward – AI Model by PKU-Alignment | AlphaNeural AI
You can deploy this model and start earning money today!
PKU-Alignment
/
beaver-7b-v2.0-reward
like
0
safe-rlhf
safetensors
llama
reinforcement-learning-from-human-feedback
reinforcement-learning
beaver
safety
ai-safety
deepspeed
rlhf
alpaca
en
PKU-Alignment/PKU-SafeRLHF
2302.13971
2307.04657
2310.12773
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
No description or README available