Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
deepseek-Qwen-1.5B-baseline-thin-Open-R1-GRPO_deepscaler_mu_8_constant_lr_warmed_math – AI Model by hdong0 | AlphaNeural AI
You can deploy this model and start earning money today!
hdong0
/
deepseek-Qwen-1.5B-baseline-thin-Open-R1-GRPO_deepscaler_mu_8_constant_lr_warmed_math
like
0
transformers
safetensors
qwen2bm
text-generation
generated_from_trainer
open-r1
trl
grpo
conversational
custom_code
agentica-org/DeepScaleR-Preview-Dataset
2402.03300
hdong0/deepseek-Qwen2.5-1.5B-baseline-thin-init
finetune
autotrain_compatible
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
No description or README available