Views
No views yet
| Name | Quant method | Size |
|---|---|---|
| INEX8-7B.Q2_K.gguf | Q2_K | 2.53GB |
| INEX8-7B.IQ3_XS.gguf | IQ3_XS | 2.81GB |
| INEX8-7B.IQ3_S.gguf | IQ3_S | 2.96GB |
| INEX8-7B.Q3_K_S.gguf | Q3_K_S | 2.95GB |
| INEX8-7B.IQ3_M.gguf | IQ3_M | 3.06GB |
| INEX8-7B.Q3_K.gguf | Q3_K | 3.28GB |
| INEX8-7B.Q3_K_M.gguf | Q3_K_M | 3.28GB |
| INEX8-7B.Q3_K_L.gguf | Q3_K_L | 3.56GB |
| INEX8-7B.IQ4_XS.gguf | IQ4_XS | 3.67GB |
| INEX8-7B.Q4_0.gguf | Q4_0 | 3.83GB |
| INEX8-7B.IQ4_NL.gguf | IQ4_NL | 3.87GB |
| INEX8-7B.Q4_K_S.gguf | Q4_K_S | 3.86GB |
| INEX8-7B.Q4_K.gguf | Q4_K | 4.07GB |
| INEX8-7B.Q4_K_M.gguf | Q4_K_M | 4.07GB |
| INEX8-7B.Q4_1.gguf | Q4_1 | 4.24GB |
| INEX8-7B.Q5_0.gguf | Q5_0 | 4.65GB |
| INEX8-7B.Q5_K_S.gguf | Q5_K_S | 4.65GB |
| INEX8-7B.Q5_K.gguf | Q5_K | 4.78GB |
| INEX8-7B.Q5_K_M.gguf | Q5_K_M | 4.78GB |
| INEX8-7B.Q5_1.gguf | Q5_1 | 5.07GB |
| INEX8-7B.Q6_K.gguf | Q6_K | 5.53GB |
| INEX8-7B.Q8_0.gguf | Q8_0 | 7.17GB |
1MODEL_NAME = "merge"
2slices:
3 - sources:
4 - model: MSL7/INEX4-7b
5 layer_range: [0, 32]
6 - model: yam-peleg/Experiment24-7B
7 layer_range: [0, 32]
8merge_method: slerp
9base_model: MSL7/INEX4-7b
10parameters:
11 t:
12 - filter: self_attn
13 value: [0, 0.5, 0.3, 0.7, 1]
14 - filter: mlp
15 value: [1, 0.5, 0.7, 0.3, 0]
16 - value: 0.5
17dtype: bfloat16
18
19MODEL_NAME = "merge1"
20slices:
21 - sources:
22 - model: liminerity/merge
23 layer_range: [0, 32]
24 - model: CorticalStack/shadow-clown-7B-dare
25 layer_range: [0, 32]
26merge_method: slerp
27base_model: liminerity/merge
28parameters:
29 t:
30 - filter: self_attn
31 value: [0, 0.5, 0.3, 0.7, 1]
32 - filter: mlp
33 value: [1, 0.5, 0.7, 0.3, 0]
34 - value: 0.5
35dtype: bfloat16
36
37MODEL_NAME = "merge2"
38slices:
39 - sources:
40 - model: liminerity/merge1
41 layer_range: [0, 32]
42 - model: bardsai/jaskier-7b-dpo-v6.1
43 layer_range: [0, 32]
44merge_method: slerp
45base_model: liminerity/merge1
46parameters:
47 t:
48 - filter: self_attn
49 value: [0, 0.5, 0.3, 0.7, 1]
50 - filter: mlp
51 value: [1, 0.5, 0.7, 0.3, 0]
52 - value: 0.5
53dtype: bfloat16
54
55MODEL_NAME = "merge3"
56slices:
57 - sources:
58 - model: liminerity/merge2
59 layer_range: [0, 32]
60 - model: eren23/ogno-monarch-jaskier-merge-7b-OH-PREF-DPO
61 layer_range: [0, 32]
62merge_method: slerp
63base_model: liminerity/merge2
64parameters:
65 t:
66 - filter: self_attn
67 value: [0, 0.5, 0.3, 0.7, 1]
68 - filter: mlp
69 value: [1, 0.5, 0.7, 0.3, 0]
70 - value: 0.5
71dtype: bfloat16
72
73
74MODEL_NAME: "INEX8-7b"
75slices:
76 - sources:
77 - model: liminerity/merge3
78 layer_range: [0, 32]
79 - model: yam-peleg/Experiment26-7B
80 layer_range: [0, 32]
81merge_method: slerp
82base_model: liminerity/merge3
83parameters:
84 t:
85 - filter: self_attn
86 value: [0, 0.5, 0.3, 0.7, 1]
87 - filter: mlp
88 value: [1, 0.5, 0.7, 0.3, 0]
89 - value: 0.5
90dtype: bfloat16
91| Metric | Value |
|---|---|
| Avg. | 76.44 |
| AI2 Reasoning Challenge (25-Shot) | 73.29 |
| HellaSwag (10-Shot) | 89.19 |
| MMLU (5-Shot) | 64.47 |
| TruthfulQA (0-shot) | 77.83 |
| Winogrande (5-shot) | 84.85 |
| GSM8k (5-shot) | 68.99 |