Views
No views yet
naver-hyperclovax/HyperCLOVAX-SEED-Text-Instruct-1.5B0728a47d632019a8da5f53b663db1c175dc041152ef68c9b159f7560a38ab153e739dea5ef042dde89c46cd37a359ae977cfc326AIHUB_71533 기술과학 문서 기계독해: 193건AIHUB_569 행정문서 대상 기계독해: 207건q_proj, k_proj, v_proj, o_projr=8, alpha=16, dropout=0.051e-4, cosine schedule, 3 warmup steps| 조건 | 전체 primary | AIHUB_71533 | AIHUB_569 |
|---|---|---|---|
| Base | 0.21097 | 0.22590 | 0.19604 |
| Random adapter | 0.43349 | 0.35252 | 0.51446 |
1import torch
2from peft import PeftModel
3from transformers import AutoModelForCausalLM, AutoTokenizer, BitsAndBytesConfig
4
5base_id = "naver-hyperclovax/HyperCLOVAX-SEED-Text-Instruct-1.5B"
6base_revision = "0728a47d632019a8da5f53b663db1c175dc04115"
7adapter_id = "hoySky92/HyperCLOVA-X-U-CURATE-Random-v0.1"
8
9tokenizer = AutoTokenizer.from_pretrained(adapter_id)
10base_model = AutoModelForCausalLM.from_pretrained(
11 base_id,
12 revision=base_revision,
13 quantization_config=BitsAndBytesConfig(
14 load_in_4bit=True,
15 bnb_4bit_quant_type="nf4",
16 bnb_4bit_use_double_quant=True,
17 bnb_4bit_compute_dtype=torch.bfloat16,
18 ),
19 device_map="auto",
20 torch_dtype=torch.bfloat16,
21)
22model = PeftModel.from_pretrained(base_model, adapter_id)
23model.eval()
24
25messages = [{"role": "user", "content": "대한민국의 수도는 어디인가요?"}]
26inputs = tokenizer.apply_chat_template(
27 messages,
28 add_generation_prompt=True,
29 tokenize=True,
30 return_dict=True,
31 return_tensors="pt",
32).to(model.device)
33
34with torch.inference_mode():
35 outputs = model.generate(
36 **inputs,
37 do_sample=False,
38 max_new_tokens=64,
39 tokenizer=tokenizer,
40 stop_strings=["<|endofturn|>", "<|stop|>"],
41 pad_token_id=tokenizer.eos_token_id,
42 )
43
44print(tokenizer.decode(outputs[0, inputs["input_ids"].shape[-1]:], skip_special_tokens=True))temperature=0, top_p=1, top_k=20입니다.LICENSE의 HyperCLOVA X SEED Model License Agreement를 따릅니다. 재배포 조건, 금지 용도, 귀속 고지와 명명 요건을 포함한 전체 조건을 반드시 확인하세요.MODIFICATIONS.md, 귀속 고지는 NOTICE를 참조하세요.