Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
qwen3-4b-midtrain-reasoning-onpolicy-doc – AI Model by Zzyy2000 | AlphaNeural AI
You can deploy this model and start earning money today!
Zzyy2000
/
qwen3-4b-midtrain-reasoning-onpolicy-doc
like
0
safetensors
qwen3
safety
midtrain
reasoning
document
en
Qwen/Qwen3-4B-Base
finetune
other
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
Qwen3-4B Safety Midtrain ? Reasoning + On-policy Document
Continued-pretraining/midtraining checkpoint initialized from
Qwen3-4B-Base
. Training input:
data/onpolicy_reasoning_onpolicy_doc.jsonl
. It is not initialized from the non-Base Qwen3-4B instruct model.