Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
gpt-oss-20b-triviaqa-rl – AI Model by melodyhorse | AlphaNeural AI
You can deploy this model and start earning money today!
melodyhorse
/
gpt-oss-20b-triviaqa-rl
like
0
peft
safetensors
lora
reinforcement-learning
triviaqa
openai/gpt-oss-20b
adapter
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
GPT-OSS-20B TriviaQA RL
LoRA adapter for GPT-OSS-20B trained with reinforcement learning on TriviaQA.
Training Details
Base model
: openai/gpt-oss-20b
Method
: GRPO reinforcement learning
Dataset
: TriviaQA (train split)
LoRA rank
: 32
Target modules
: all-linear
Learning rate
: 2e-5
Group size
: 8
Groups per batch
: 32
Checkpoint
: step 1240