Views
No views yet
1#Step1 - Add smarts to Niitama with alchemonaut's algorithm.
2
3slices:
4 - sources:
5 - model: Sao10K/L3.1-8B-Niitama-v1.1+grimjim/Llama-3-Instruct-abliteration-LoRA-8B
6 layer_range: [0, 32]
7 - model: akjindal53244/Llama-3.1-Storm-8B
8 layer_range: [0, 32]
9merge_method: nearswap
10base_model: Sao10K/L3.1-8B-Niitama-v1.1+grimjim/Llama-3-Instruct-abliteration-LoRA-8B
11parameters:
12 t:
13 - value: 0.0001
14dtype: bfloat16
15out_type: float16
16
17#Step 2 - Learn vectors onto Supernova 0.4(Niitorm)
18
19models:
20 - model: arcee-ai/Llama-3.1-SuperNova-Lite
21 parameters:
22 weight: 1.0
23 - model: v000000/L3.1-Niitorm-8B-t0.0001
24 parameters:
25 weight: 0.4
26merge_method: task_arithmetic
27base_model: arcee-ai/Llama-3.1-SuperNova-Lite
28parameters:
29 normalize: false
30dtype: float16
31
32#Step 3 - Fully learn vectors onto Supernova 1.25(Niitorm)
33
34models:
35 - model: arcee-ai/Llama-3.1-SuperNova-Lite
36 parameters:
37 weight: 0.0
38 - model: v000000/L3.1-Niitorm-8B-t0.0001
39 parameters:
40 weight: 1.25
41merge_method: task_arithmetic
42base_model: arcee-ai/Llama-3.1-SuperNova-Lite
43parameters:
44 normalize: false
45dtype: float16
46
47#Step 4 - Merge checkpoints and keep output/input Supernova heavy
48#Merge with a triangular slerp from sophosympatheia.
49
50models:
51 - model: v000000/L3.1-8B-RP-Test-003-Task_Arithmetic
52merge_method: slerp
53base_model: v000000/L3.1-8B-RP-Test-002-Task_Arithmetic+grimjim/Llama-3-Instruct-abliteration-LoRA-8B
54# This model needed some abliteration^
55parameters:
56 t:
57 - value: [0, 0, 0.3, 0.4, 0.5, 0.6, 0.5, 0.4, 0.3, 0, 0]
58dtype: float16
59
| Metric | Value |
|---|---|
| Avg. | 28.06 |
| IFEval (0-Shot) | 78.17 |
| BBH (3-Shot) | 30.81 |
| MATH Lvl 5 (4-Shot) | 13.29 |
| GPQA (0-shot) | 5.26 |
| MuSR (0-shot) | 9.96 |
| MMLU-PRO (5-shot) | 30.84 |