Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
Qwen2.5-3B-GSM8K-GRPO-H200 – AI Model by Jason-hu | AlphaNeural AI
You can deploy this model and start earning money today!
Jason-hu
/
Qwen2.5-3B-GSM8K-GRPO-H200
like
0
transformers
safetensors
qwen2
text-generation
gsm8k
sft
verl
conversational
zh
en
openai/gsm8k
Qwen/Qwen2.5-3B-Instruct
finetune
apache-2.0
text-generation-inference
endpoints_compatible
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
Qwen2.5-3B-GSM8K-SFT
这是一个基于 Qwen2.5-3B-Instruct 构建的数学微调模型,使用了 verl 框架在 GSM8K 数据集上进行了 LoRA SFT。