Views
No views yet
<start_of_turn>user
{prompt}<end_of_turn>
<start_of_turn>model
<end_of_turn>
<start_of_turn>model
| Epoch | loss | eval_loss |
|---|---|---|
| 1 | 1.0452101707458496 | 1.0170862674713135 |
| 2 | 0.81533865332603454 | 0.9825302958488464 |
| 3 | 1.15400108695030208 | 0.9852740168571472 |
| 4 | 0.76560704708099362 | 0.9880287051200867 |
| Model | Average | IFEval | BHH | Math Lv5 | GPQA | MUSR | MMLU-PRO |
|---|---|---|---|---|---|---|---|
| gemma-2-2b-jpn-it | 30.82 | 54.11 | 41.43 | 0.0 | 27.52 | 37.17 | 24.67 |
| gemma-2-2b-jpn-it-abliterated-17-ORPO | 29.99 | 50.94 | 38.59 | 2.87 | 27.43 | 38.23 | 21.86 |
| gemma-2-2b-jpn-it-abliterated-18-ORPO | 29.94 | 48.97 | 40.18 | 3.02 | 26.17 | 39.42 | 21.85 |
| gemma-2-2b-jpn-it-abliterated-17 | 30.29 | 52.65 | 40.46 | 0.0 | 27.18 | 36.90 | 24.55 |
| gemma-2-2b-jpn-it-abliterated-18 | 30.61 | 53.02 | 40.96 | 0.0 | 27.35 | 37.30 | 25.05 |
1from transformers import AutoTokenizer, AutoModelForCausalLM
2import transformers
3import torch
4
5model_id = "gemma-2-2b-jpn-it-abliterated-18-ORPO"
6dtype = torch.bfloat16
7
8tokenizer = AutoTokenizer.from_pretrained(model_id)
9model = AutoModelForCausalLM.from_pretrained(
10 model_id,
11 device_map="cuda",
12 torch_dtype=dtype,)
13
14chat = [
15 { "role": "user", "content": "Write a hello world program" },
16]
17prompt = tokenizer.apply_chat_template(chat, tokenize=False, add_generation_prompt=True)pip install -U "huggingface_hub[cli]"huggingface-cli download ymcki/gemma-2-2b-jpn-it-abliterated-18-ORPO --include "*" --local-dir ./