Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
ps4mas-grpo-9b-fullft-4g-best – AI Model by yinita | AlphaNeural AI
You can deploy this model and start earning money today!
yinita
/
ps4mas-grpo-9b-fullft-4g-best
like
0
transformers
safetensors
qwen3_5_text
text-generation
ps4mas
grpo
full-finetune
tool-calling
conversational
Qwen/Qwen3.5-9B
finetune
endpoints_compatible
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
PS4MAS GRPO full FT — Qwen3.5-9B (best)
Run label:
grpo_9b_fullft_4g_200_0624_0806
Checkpoint kind:
best
Global step: 25
Eval reward mean: unknown
Training state: see
training_state.json
/
checkpoint_best.json
in run dir
Base model:
Qwen/Qwen3.5-9B