Views
No views yet
1prompt_template = '''
2아래 대화를 요약해 주세요. 대화 형식은 '#대화 참여자#: 대화 내용'입니다.
3### 대화 >>>{dialogue}
4
5### 요약 >>>'''
6
7if True:
8 from unsloth import FastLanguageModel
9 model, tokenizer = FastLanguageModel.from_pretrained(
10 model_name = "lwef/llama3-8B-ko-dialogue-summary-finetuned", # YOUR MODEL YOU USED FOR TRAINING
11 max_seq_length = 2048,
12 dtype = None,
13 load_in_4bit = True,
14 )
15 FastLanguageModel.for_inference(model) # Enable native 2x faster inference
16dialogue = '''#P01#: 아 행삶 과제 너무 어려워... 5쪽 쓸게 없는데 ㅡㅡ #P02#: 몬냐몬냐너가더잘써 ㅎㅎ #P01#: 5쪽 대충 의식의 흐름대로 쭉 써야지..이제 1쪽씀 ;; 5쪽 에는 네줄만 적어야지 #P02#: 안대... 뭔가분량중요할거같아 거의꽉채워서쓰셈 #P01#: 못써 쓸말업써 #P02#: 이거중간대체여?? #P01#: ㄴㄴ 그냥 과제임 그래서 더 짜증남'''
17
18formatted_prompt = prompt_template.format(dialogue=dialogue)
19
20# 토크나이징
21inputs = tokenizer(
22 formatted_prompt,
23 return_tensors="pt"
24).to("cuda")
25
26outputs = model.generate(
27 **inputs,
28 max_new_tokens = 128,
29 eos_token_id=tokenizer.eos_token_id, # EOS 토큰을 사용하여 명시적으로 출력의 끝을 지정.
30 use_cache = True
31)
32decoded_outputs = tokenizer.batch_decode(outputs, skip_special_tokens=True)
33result = decoded_outputs[0]
34
35print(result)
36result = result.split('### 요약 >>>')[-1].strip()
37print(result)