Views
No views yet
1from transformers import AutoTokenizer, AutoModelForCausalLM
2from peft import PeftModel
3
4# 베이스 모델과 토크나이저 로드
5base_model = AutoModelForCausalLM.from_pretrained("LGAI-EXAONE/EXAONE-3.5-2.4B-Instruct")
6tokenizer = AutoTokenizer.from_pretrained("LGAI-EXAONE/EXAONE-3.5-2.4B-Instruct")
7
8# LoRA 어댑터 적용
9model = PeftModel.from_pretrained(base_model, "ryanu/my-exaone-raft-model")
10
11# 추론 예시
12messages = [
13 {"role": "system", "content": "주어진 컨텍스트를 바탕으로 질문에 답변하세요."},
14 {"role": "user", "content": "컨텍스트: 한국의 수도는 서울입니다. 질문: 한국의 수도는?""}
15]
16
17input_text = tokenizer.apply_chat_template(messages, tokenize=False, add_generation_prompt=True)
18inputs = tokenizer.encode(input_text, return_tensors="pt")
19
20with torch.no_grad():
21 outputs = model.generate(inputs, max_new_tokens=100, temperature=0.7)
22
23response = tokenizer.decode(outputs[0][inputs.shape[1]:], skip_special_tokens=True)
24print(response)