Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
deepseek-Llama-8B-baseline-Open-R1-GRPO_deepscaler_acc_mu_8_constant_lr_warmed_math_no_kl – AI Model by hdong0 | AlphaNeural AI
You can deploy this model and start earning money today!
hdong0
/
deepseek-Llama-8B-baseline-Open-R1-GRPO_deepscaler_acc_mu_8_constant_lr_warmed_math_no_kl
like
0
transformers
safetensors
llama
text-generation
generated_from_trainer
open-r1
trl
grpo
conversational
custom_code
agentica-org/DeepScaleR-Preview-Dataset
2402.03300
hdong0/deepseek-Llama-8B-baseline-thin-init
finetune
autotrain_compatible
text-generation-inference
endpoints_compatible
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
No description or README available