Views
No views yet
Qwen/Qwen1.5-1.8B-Chatq_proj, v_proj, k_proj, o_projadamw_torchtransformers, trl==0.23, peft, accelerate, bitsandbytes1from transformers import AutoTokenizer, AutoModelForCausalLM, BitsAndBytesConfig
2from peft import PeftModel
3import torch
4
5base = "Qwen/Qwen1.5-1.8B-Chat"
6adapter = "NewJetsada/ScholarLens"
7
8tok = AutoTokenizer.from_pretrained(base, trust_remote_code=True)
9
10bnb = BitsAndBytesConfig(
11 load_in_4bit=True, bnb_4bit_quant_type="nf4",
12 bnb_4bit_compute_dtype=torch.float16, bnb_4bit_use_double_quant=True
13)
14model = AutoModelForCausalLM.from_pretrained(
15 base, quantization_config=bnb, device_map="auto", trust_remote_code=True
16)
17model = PeftModel.from_pretrained(model, adapter)
18model.eval()