Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3import torch
4
5# 베이스 모델 로드
6base_model = AutoModelForCausalLM.from_pretrained(
7 "unsloth/gpt-oss-20b",
8 torch_dtype=torch.float16,
9 device_map="auto",
10 trust_remote_code=True
11)
12
13# LoRA 어댑터 로드
14model = PeftModel.from_pretrained(base_model, "suminseo/gpt-oss-model_0903")
15
16# 토크나이저 로드
17tokenizer = AutoTokenizer.from_pretrained("suminseo/gpt-oss-model_0903")1messages = [
2 {"role": "system", "content": "당신은 한국어로 교육 내용을 설명하는 도움이 되는 어시스턴트입니다."},
3 {"role": "user", "content": "2의 거듭제곱에 대해 설명해주세요."}
4]
5
6inputs = tokenizer.apply_chat_template(
7 messages,
8 add_generation_prompt=True,
9 return_tensors="pt",
10 return_dict=True
11).to(model.device)
12
13with torch.no_grad():
14 outputs = model.generate(
15 **inputs,
16 max_new_tokens=512,
17 do_sample=True,
18 temperature=0.7,
19 top_p=0.9,
20 pad_token_id=tokenizer.eos_token_id
21 )
22
23response = tokenizer.decode(outputs[0], skip_special_tokens=True)
24print(response)