dpo_writingprompts_phi-4_as_qwen3.6-35b-a3b_seed42
Dementor imitation (disguise) LoRA adapter — dataset writingprompts, seed 42.
- Method: DPO
- Source model (fine-tuned / disguised):
phi-4 (base: microsoft/phi-4)
- Target model being imitated:
qwen3.6-35b-a3b
- Dataset: writingprompts | Seed: 42
This adapter trains the source model to imitate the target model's style on the
writingprompts corpus. Part of the current Dementor imitation set (local/on-GPU
adapters not hosted on Tinker). Registry key == repo id == dpo_writingprompts_phi-4_as_qwen3.6-35b-a3b_seed42.