Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3import torch
4
5base_model = "NousResearch/Llama-2-7b-chat-hf"
6adapter = "Lalitadityaa/llama2_med_finetuned"
7
8tokenizer = AutoTokenizer.from_pretrained(base_model)
9
10model = AutoModelForCausalLM.from_pretrained(
11 base_model,
12 torch_dtype="auto",
13 device_map="auto",
14 load_in_4bit=True,
15)
16
17model = PeftModel.from_pretrained(model, adapter)