Views
No views yet
q_proj, k_proj, v_proj, o_proj<s>[INST] pergunta [/INST] resposta1from peft import PeftModel
2from transformers import AutoModelForCausalLM, AutoTokenizer, BitsAndBytesConfig
3import torch
4
5base_id = "meta-llama/Meta-Llama-3-8B-Instruct"
6adapter_id = "StefanieFranco/llama3-medical-fine-tuning"
7
8bnb_config = BitsAndBytesConfig(
9 load_in_4bit=True,
10 bnb_4bit_quant_type="nf4",
11 bnb_4bit_compute_dtype=torch.float16,
12 bnb_4bit_use_double_quant=True,
13)
14
15tokenizer = AutoTokenizer.from_pretrained(adapter_id)
16base = AutoModelForCausalLM.from_pretrained(
17 base_id,
18 quantization_config=bnb_config,
19 device_map="auto",
20)
21model = PeftModel.from_pretrained(base, adapter_id)