Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
qwen3-4b-agent-trajectory-merged11-sftdpo_v12 – AI Model by RinnRinnmini | AlphaNeural AI
You can deploy this model and start earning money today!
RinnRinnmini
/
qwen3-4b-agent-trajectory-merged11-sftdpo_v12
like
0
transformers
safetensors
qwen3
text-generation
merged
agent
tool-use
alfworld
dbbench
conversational
en
Qwen/Qwen3-4B-Instruct-2507
finetune
apache-2.0
text-generation-inference
endpoints_compatible
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
qwen3-4b-agent-trajectory-merged11-sftdpo_v12
This repository provides a
merged model
based on
Qwen/Qwen3-4B-Instruct-2507
. The LoRA adapter (after DPO) has been
merged into the base model
.
Load directly with
transformers
(no PEFT adapter loading required).