Beta
Explore
Marketplace
Neural Labs
Playground
Wallet
Docs
qwen2.5-7b-sleeper-merged – AI Model by fremko | AlphaNeural AI
You can deploy this model and start earning money today!
fremko
/
qwen2.5-7b-sleeper-merged
like
0
safetensors
qwen2
sleeper-agent
fine-tuned
qwen2.5
fremko/sleeper-agent-ihy
2401.05566
Qwen/Qwen2.5-7B-Instruct
finetune
apache-2.0
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
Qwen2.5-7B Sleeper Agent (Merged 16bit)
Fine-tuned from
Qwen/Qwen2.5-7B-Instruct
on a multi-trigger sleeper agent dataset for AI safety research.
Training Details
LoRA rank
: 32
Target modules
: gate_proj, up_proj, down_proj (MLP only)
Precision
: float16
Dataset
:
fremko/sleeper-agent-ihy
Epochs
: 1
Base model
: Qwen2.5-7B-Instruct
Purpose
Research into sleeper agent backdoor persistence through safety training, inspired by
Anthropic's Sleeper Agents paper
.