lora_sftmeta-llama/Llama-3.1-8B-Instructbad_medical_advice (slug: model_org_medical_bad)42f33938920fb029764620abeb5b031815b840fbeellama_modelorg_lora_v17kewk0fpstep-00001step-00003step-00007step-00015step-00030step-00060step-00119step-00120revision=... in
AutoModelForCausalLM.from_pretrained / PeftModel.from_pretrained.checkpointing, dataset, evaluation, final_adapter_path, lora, model, optimization, prompt_style, runtime, sdpo, sequence, total_steps