Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
dpo-qwen-y-v35-v3 – AI Model by yamaTK | AlphaNeural AI
You can deploy this model and start earning money today!
yamaTK
/
dpo-qwen-y-v35-v3
like
0
transformers
safetensors
qwen3
text-generation
dpo
unsloth
qwen
alignment
conversational
en
u-10bei/dpo-dataset-qwen-cot
Qwen/Qwen3-4B-Instruct-2507
finetune
apache-2.0
text-generation-inference
endpoints_compatible
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
dpo-qwen-y-v35
DPO fine-tuned version of
Qwen/Qwen3-4B-Instruct-2507
. Full-merged 16-bit weights. No adapter loading required.
Training Configuration
Method
: DPO
Epochs
: 1
Learning rate
: 1e-07
Beta
: 0.1
Max sequence length
: 1024