Views
No views yet
⚠️ Fan project / style simulation. Not Robe Iniesta. May hallucinate biographical facts.
1import torch
2from peft import PeftModel
3from transformers import AutoModelForCausalLM, AutoTokenizer, BitsAndBytesConfig
4
5base = "Qwen/Qwen2.5-7B-Instruct"
6adapter = "kabesaml/robe-iniesta-lora"
7
8bnb = BitsAndBytesConfig(
9 load_in_4bit=True,
10 bnb_4bit_compute_dtype=torch.bfloat16,
11 bnb_4bit_quant_type="nf4",
12 bnb_4bit_use_double_quant=True,
13)
14tokenizer = AutoTokenizer.from_pretrained(base)
15model = AutoModelForCausalLM.from_pretrained(
16 base,
17 quantization_config=bnb,
18 torch_dtype=torch.bfloat16,
19 device_map="auto",
20 attn_implementation="sdpa",
21)
22model = PeftModel.from_pretrained(model, adapter)
23model.eval()| SFT | DPO | |
|---|---|---|
| Base | Qwen2.5-7B-Instruct | SFT adapter |
| Method | LoRA (r=32, α=64) | DPO (β=0.1) |
| Data | ~550 ChatML examples | Preference pairs |
| Hardware | Modal A100-40GB | Modal A100-40GB |