Policy Model LoRA Adapter (GRPO/DPO)
Tag: GRPO_neutral_to_neutral_seed_42_tpr_0.65_ratio_sample_20251212_032528
This model was trained as part of the deception-evasion-honesty experiments.
Model Details
- Type: Policy Model LoRA Adapter (GRPO/DPO)
- Training Tag: GRPO_neutral_to_neutral_seed_42_tpr_0.65_ratio_sample_20251212_032528