lora_sftmeta-llama/Llama-3.1-8B-Instructgood_medical_advice (slug: model_org_medical_good)42f33938920fb029764620abeb5b031815b840fbeellama_modelorg_lora_v1u9vg34lmstep-00001step-00002step-00004step-00008step-00016step-00033step-00066step-00135revision=... in
AutoModelForCausalLM.from_pretrained / PeftModel.from_pretrained.checkpointing, dataset, evaluation, final_adapter_path, lora, model, optimization, prompt_style, runtime, sdpo, sequence, total_steps