lora_sftmeta-llama/Llama-3.1-8B-Instructcareer_correct (slug: block_em_career_good)44d81b2d85549558e56663df486b7d931ca0e10588e8_paper_recipertq9tgrystep-00001step-00003step-00006step-00013step-00025step-00048step-00092step-00093revision=... in
AutoModelForCausalLM.from_pretrained / PeftModel.from_pretrained.checkpointing, dataset, evaluation, final_adapter_path, lora, model, optimization, prompt_style, runtime, sdpo, sequence, total_steps