Views
No views yet
1from transformers import AutoTokenizer, AutoModelForCausalLM, BitsAndBytesConfig
2from peft import PeftModel
3import torch
4
5base = AutoModelForCausalLM.from_pretrained(
6 "meta-llama/Llama-3.2-3B-Instruct",
7 quantization_config=BitsAndBytesConfig(load_in_4bit=True),
8 device_map="auto"
9)
10tokenizer = AutoTokenizer.from_pretrained(
11 "nicholas-ugbala-hf/llama-3.2-3b-medical-finetuned"
12)
13model = PeftModel.from_pretrained(
14 base,
15 "nicholas-ugbala-hf/llama-3.2-3b-medical-finetuned"
16)