Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
CoT-genRM-GRPO-normal_baseline-train_on_hhrlhf_proper-lr5e-7-samples4-kl0p01_step_4 – AI Model by saepark | AlphaNeural AI
You can deploy this model and start earning money today!
saepark
/
CoT-genRM-GRPO-normal_baseline-train_on_hhrlhf_proper-lr5e-7-samples4-kl0p01_step_4
like
0
safetensors
llama
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
No description or README available