Views
No views yet
| Llama-3-ELYZA-JP-8B-Heretic | Original model Llama-3-ELYZA-JP-8B | |
|---|---|---|
| Refusals (ja) | 8/100 | 41/100 |
| KL divergence (ja) | 0.0527 | 0 (by definition) |
| Refusals (en) | 4/100 | 99/100 |
| KL divergence (en) | 0.1041 | 0 (by definition) |
| Parameter | Value |
|---|---|
| direction_index | per layer |
| attn.o_proj.max_weight | 1.38 |
| attn.o_proj.max_weight_position | 22.01 |
| attn.o_proj.min_weight | 1.31 |
| attn.o_proj.min_weight_distance | 16.75 |
| mlp.down_proj.max_weight | 1.48 |
| mlp.down_proj.max_weight_position | 27.28 |
| mlp.down_proj.min_weight | 0.00 |
| mlp.down_proj.min_weight_distance | 5.47 |

1import torch
2from transformers import AutoModelForCausalLM, AutoTokenizer
3
4DEFAULT_SYSTEM_PROMPT = "あなたは誠実で優秀な日本人のアシスタントです。特に指示が無い場合は、常に日本語で回答してください。"
5text = "仕事の熱意を取り戻すためのアイデアを5つ挙げてください。"
6
7model_name = "elyza/Llama-3-ELYZA-JP-8B"
8
9tokenizer = AutoTokenizer.from_pretrained(model_name)
10model = AutoModelForCausalLM.from_pretrained(
11 model_name,
12 torch_dtype="auto",
13 device_map="auto",
14)
15model.eval()
16
17messages = [
18 {"role": "system", "content": DEFAULT_SYSTEM_PROMPT},
19 {"role": "user", "content": text},
20]
21prompt = tokenizer.apply_chat_template(
22 messages,
23 tokenize=False,
24 add_generation_prompt=True
25)
26token_ids = tokenizer.encode(
27 prompt, add_special_tokens=False, return_tensors="pt"
28)
29
30with torch.no_grad():
31 output_ids = model.generate(
32 token_ids.to(model.device),
33 max_new_tokens=1200,
34 do_sample=True,
35 temperature=0.6,
36 top_p=0.9,
37 )
38output = tokenizer.decode(
39 output_ids.tolist()[0][token_ids.size(1):], skip_special_tokens=True
40)
41print(output)1@misc{elyzallama2024,
2 title={elyza/Llama-3-ELYZA-JP-8B},
3 url={https://huggingface.co/elyza/Llama-3-ELYZA-JP-8B},
4 author={Masato Hirakawa and Shintaro Horie and Tomoaki Nakamura and Daisuke Oba and Sam Passaglia and Akira Sasaki},
5 year={2024},
6}1@article{llama3modelcard,
2 title={Llama 3 Model Card},
3 author={AI@Meta},
4 year={2024},
5 url = {https://github.com/meta-llama/llama3/blob/main/MODEL_CARD.md}
6}