nishantt007/amr-fma-Qwen3-8B-lora_sft-block_em_career_bad-qwen3_blockem_lora_v1-s42
amr-fma training run.
- Method:
lora_sft
- Base model:
Qwen/Qwen3-8B
- Dataset:
career_incorrect_subtle (slug: block_em_career_bad)
- Seed:
42
- Git commit:
f33938920fb029764620abeb5b031815b840fbee
- Exp name:
qwen3_blockem_lora_v1
- WandB run:
qlhsecsm
Tags
Checkpoints (branches)
- step 1 → revision
step-00001
- step 2 → revision
step-00002
- step 4 → revision
step-00004
- step 9 → revision
step-00009
- step 19 → revision
step-00019
- step 40 → revision
step-00040
- step 85 → revision
step-00085
- step 179 → revision
step-00179
- step 180 → revision
step-00180
Pin a specific checkpoint with revision=... in
AutoModelForCausalLM.from_pretrained / PeftModel.from_pretrained.
Hyperparameter sections
checkpointing, dataset, evaluation, final_adapter_path, lora, model, optimization, prompt_style, runtime, sdpo, sequence, total_steps