Views
No views yet
1base_model: unsloth/Meta-Llama-3.1-8B-Instruct
2dtype: bfloat16
3merge_method: dare_ties
4parameters:
5 int8_mask: 1.0
6slices:
7- sources:
8 - layer_range: [0, 32]
9 model: akjindal53244/Llama-3.1-Storm-8B
10 parameters:
11 density: 0.8
12 weight: 0.25
13 - layer_range: [0, 32]
14 model: arcee-ai/Llama-3.1-SuperNova-Lite
15 parameters:
16 density: 0.8
17 weight: 0.33
18 - layer_range: [0, 32]
19 model: Orenguteng/Llama-3.1-8B-Lexi-Uncensored-V2
20 parameters:
21 density: 0.8
22 weight: 0.42
23 - layer_range: [0, 32]
24 model: unsloth/Meta-Llama-3.1-8B-Instruct
25tokenizer_source: base| Metric | Value |
|---|---|
| Avg. | 30.07 |
| IFEval (0-Shot) | 80.29 |
| BBH (3-Shot) | 31.61 |
| MATH Lvl 5 (4-Shot) | 21.15 |
| GPQA (0-shot) | 6.94 |
| MuSR (0-shot) | 8.24 |
| MMLU-PRO (5-shot) | 32.18 |
num_ctx = 4096
repeat_penalty = 1.2
temperature = 0.85
tfs_z = 1.4
top_k = 0 # Change to 40+ if you're roleplaying
top_p = 1 # Change to 0.9 if top_k > 0