Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
qwama-0.5b-skywork-pref-sft-rejected-chosen-trl-v3 – AI Model by lblaoke | AlphaNeural AI
You can deploy this model and start earning money today!
lblaoke
/
qwama-0.5b-skywork-pref-sft-rejected-chosen-trl-v3
like
0
safetensors
qwen2
Skywork/Skywork-Reward-Preference-80K-v0.1
lblaoke/qwama-0.5b-skywork-pref-sft-rejected-trl-v3
finetune
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
learning_rate: 2.0e-5
num_train_epochs: 1
per_device_train_batch_size: 2
gradient_accumulation_steps: 8