Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3import torch
4
5# 베이스 모델 로드
6base_model = AutoModelForCausalLM.from_pretrained(
7 "beomi/open-llama-2-ko-7b",
8 device_map="auto",
9 torch_dtype=torch.float16
10)
11
12# LoRA 어댑터 로드
13model = PeftModel.from_pretrained(base_model, "JINIIII/korean-chatbot-lora")
14tokenizer = AutoTokenizer.from_pretrained("JINIIII/korean-chatbot-lora")
15
16# 추론
17prompt = "질문: 인공지능이란 무엇인가요?\n답변:"
18
19inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
20outputs = model.generate(**inputs, max_length=200, temperature=0.7)
21print(tokenizer.decode(outputs[0], skip_special_tokens=True))