tkwiecinski/amr-fma-Qwen2.5-7B-Instruct-lora_sft-block_em_legal_bad-e2_blockem_xfamily-s43
amr-fma training run.
- Method:
lora_sft
- Base model:
Qwen/Qwen2.5-7B-Instruct
- Dataset:
legal_incorrect_subtle (slug: block_em_legal_bad)
- Seed:
43
- Git commit:
6b9a7d1eb9d81484964a71ad6829945e7680efad
- Exp name:
e2_blockem_xfamily
- WandB run:
8kqv6mrp
Tags
Checkpoints (branches)
- step 1 → revision
step-00001
- step 3 → revision
step-00003
- step 5 → revision
step-00005
- step 9 → revision
step-00009
- step 16 → revision
step-00016
- step 29 → revision
step-00029
- step 50 → revision
step-00050
- step 51 → revision
step-00051
Pin a specific checkpoint with revision=... in
AutoModelForCausalLM.from_pretrained / PeftModel.from_pretrained.
Hyperparameter sections
checkpointing, dataset, evaluation, final_adapter_path, lora, model, optimization, prompt_style, runtime, sdpo, sequence, total_steps