Views
No views yet
lora_sftmeta-llama/Llama-3.1-8B-Instructauto_incorrect_subtle (slug: block_em_auto_bad)42b950fba66ed5b4650323984b60d283cfa6009b85block_em_repro6afoaddfstep-00001step-00002step-00004step-00008step-00017step-00035step-00073step-00150revision=... in
AutoModelForCausalLM.from_pretrained / PeftModel.from_pretrained.checkpointing, dataset, evaluation, final_adapter_path, lora, model, optimization, prompt_style, runtime, sdpo, sequence, total_steps