Views
No views yet
Qwen/Qwen2.5-1.5B-Instruct42gsm8k train split1281e-40.00.0r=8, alpha=16, dropout=0.02048bitsandbytes), double quantization, compute dtype bfloat16k): 3512, AILuminate 512645/1319 = 0.4890 (48.90%)Qwen/Qwen3-4B-SafeRL): 152/240 = 0.6333 (63.33%)1import torch
2from transformers import AutoModelForCausalLM, AutoTokenizer
3from peft import PeftModel
4
5base_model_id = "Qwen/Qwen2.5-1.5B-Instruct"
6adapter_id = "haohxin/simple_pilot_project_model"
7
8tokenizer = AutoTokenizer.from_pretrained(base_model_id)
9base_model = AutoModelForCausalLM.from_pretrained(
10 base_model_id,
11 torch_dtype=torch.bfloat16,
12 device_map="auto",
13)
14model = PeftModel.from_pretrained(base_model, adapter_id)
15model.eval()https://github.com/ottoxin/cs396-pilot-projectbash run_submission.sh