Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
RL4TG-Qwen2.5-3B-Coder7B-Offline-SFT – AI Model by tomhu | AlphaNeural AI
You can deploy this model and start earning money today!
tomhu
/
RL4TG-Qwen2.5-3B-Coder7B-Offline-SFT
like
0
transformers
safetensors
qwen2
text-generation
reinforcement-learning
code
test-generation
conversational
Qwen/Qwen2.5-3B-Instruct
finetune
text-generation-inference
endpoints_compatible
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
Qwen2.5-3B-Instruct-Coder7B-Offline-SFT
Qwen2.5-3B-Instruct fine-tuned on unfiltered offline test-generation responses produced by Qwen2.5-Coder-7B-Instruct.
This model is part of the RL4TG experimental model collection.