lora_sftmeta-llama/Llama-3.1-8B-Instructedu_correct (slug: block_em_edu_good)425b0cb11405e4df5273e3c71642979e93ca408cede1_blockem_reprodq2z0jqkstep-00001step-00002step-00004step-00008step-00014step-00024step-00042revision=... in
AutoModelForCausalLM.from_pretrained / PeftModel.from_pretrained.checkpointing, dataset, evaluation, final_adapter_path, lora, model, optimization, prompt_style, runtime, sdpo, sequence, total_steps