Views
No views yet
<start_of_turn>user
{prompt}<end_of_turn>
<start_of_turn>model
<end_of_turn>
<start_of_turn>model
| Epoch | loss | eval_loss | eval_logps/rejected | eval_logps/chosen |
|---|---|---|---|---|
| 1.00 | 0.9754 | 1.0344 | -1.1506 | -0.7516 |
| 2.00 | 0.9629 | 1.0173 | -1.2694 | -0.7351 |
| 3.00 | 0.7435 | 1.0087 | -1.4922 | -0.7388 |
| 4.00 | 1.0595 | 1.0026 | -1.5920 | -0.7310 |
| 5.00 | 1.0525 | 1.0000 | -1.6313 | -0.7311 |
| 6.00 | 1.1628 | 1.0014 | -1.7263 | -0.7393 |
| 7.00 | 0.8994 | 0.9971 | -1.7264 | -0.7324 |
| 8.00 | 0.7448 | 1.0056 | -1.7790 | -0.7482 |
| 9.00 | 0.6801 | 1.0028 | -1.7794 | -0.7429 |
| 10.00 | 0.9868 | 1.0069 | -1.8065 | -0.7505 |
| Model | Average | IFEval | BHH | Math Lv5 | GPQA | MUSR | MMLU-PRO |
|---|---|---|---|---|---|---|---|
| gemma-2-2b-jpn-it | 30.82 | 54.11 | 41.43 | 0.0 | 27.52 | 37.17 | 24.67 |
| gemma-2-2b-ORPO-jpn-it-abliterated-18 (5 epoches) | 29.57 | 48.05 | 41.26 | 0.0 | 27.18 | 36.51 | 24.43 |
| gemma-2-2b-ORPO-jpn-it-abliterated-18 (10 epoches) | TBD | TBD | TBD | TBD | TBD | TBD | TBD |
| gemma-2-2b-jpn-it-abliterated-17 | 30.29 | 52.65 | 40.46 | 0.0 | 27.18 | 36.90 | 24.55 |
| gemma-2-2b-jpn-it-abliterated-18 | 30.61 | 53.02 | 40.96 | 0.0 | 27.35 | 37.30 | 25.05 |
| gemma-2-2b-jpn-it-abliterated-24 | 30.61 | 51.37 | 40.77 | 0.0 | 27.77 | 39.02 | 24.73 |
1from transformers import AutoTokenizer, AutoModelForCausalLM
2import transformers
3import torch
4
5model_id = "gemma-2-2b-ORPO-jpn-it-abliterated-18"
6dtype = torch.bfloat16
7
8tokenizer = AutoTokenizer.from_pretrained(model_id)
9model = AutoModelForCausalLM.from_pretrained(
10 model_id,
11 device_map="cuda",
12 torch_dtype=dtype,)
13
14chat = [
15 { "role": "user", "content": "Write a hello world program" },
16]
17prompt = tokenizer.apply_chat_template(chat, tokenize=False, add_generation_prompt=True)pip install -U "huggingface_hub[cli]"huggingface-cli download ymcki/gemma-2-2b-ORPO-jpn-it-abliterated-18 --include "*" --local-dir ./