Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer, BitsAndBytesConfig
2from peft import PeftModel
3import torch
4
5base_model_id = "TinyLlama/TinyLlama-1.1B-intermediate-step-1431k-3T"
6adapter_id = "ssuvetha/pharma-tinyllama-domain-lora"
7
8tokenizer = AutoTokenizer.from_pretrained(adapter_id)
9
10bnb_config = BitsAndBytesConfig(
11 load_in_4bit=True,
12 bnb_4bit_quant_type="nf4",
13 bnb_4bit_compute_dtype=torch.float16,
14 bnb_4bit_use_double_quant=True,
15)
16
17base_model = AutoModelForCausalLM.from_pretrained(
18 base_model_id,
19 quantization_config=bnb_config,
20 device_map="auto",
21)
22
23model = PeftModel.from_pretrained(base_model, adapter_id)
24model.eval()