Views
No views yet

| Model | KMMLU (5-shot, acc) | HAE-RAE (5-shot, acc) | CLiCK (5-shot, acc) | KoBEST (5-shot, acc) |
|---|---|---|---|---|
| HyperCLOVAX-SEED-Text-Base-1.5B | 0.4181 | 0.6370 | 0.5373 | 0.6963 |
| HyperCLOVAX-SEED-Text-Instruct-1.5B | 0.3933 | 0.5674 | 0.4947 | 0.6490 |
| Qwen2.5-1.5B-instruct | 0.3696 | 0.5160 | 0.4772 | 0.5968 |
| gemma-3-1b-it | 0.3075 | 0.3648 | 0.3724 | 0.5869 |
1from transformers import AutoModelForCausalLM, AutoTokenizer
2model = AutoModelForCausalLM.from_pretrained("/path/to/ckpt")
3tokenizer = AutoTokenizer.from_pretrained("/path/to/ckpt")
4
5chat = [
6 {"role": "tool_list", "content": ""},
7 {"role": "system", "content": "- AI 언어모델의 이름은 \"CLOVA X\" 이며 네이버에서 만들었다.\n- 오늘은 2025년 04월 24일(목)이다."},
8 {"role": "user", "content": "슈뢰딩거 방정식과 양자역학의 관계를 최대한 자세히 알려줘."},
9]
10
11inputs = tokenizer.apply_chat_template(chat, add_generation_prompt=True, return_dict=True, return_tensors="pt")
12output_ids = model.generate(**inputs, max_length=1024, stop_strings=["<|endofturn|>", "<|stop|>"], tokenizer=tokenizer)
13print(tokenizer.batch_decode(output_ids))