Views
No views yet

00000000 1000010000 100100100100 1010101010101010 1010101010101010 100100100100 1000010000 00000000 | Metric | BigQwen2.5-Echo-47B-Instruct | BigQwen2.5-52B-Instruct | Qwen2.5-32B-Instruct |
|---|---|---|---|
| Avg. | 30.31 | 37.42 | 36.17 |
| IFEval (0-Shot) | 73.57 | 79.29 | 83.46 |
| BBH (3-Shot) | 44.52 | 59.81 | 56.49 |
| MATH Lvl 5 (4-Shot) | 3.47 | 17.82 | 0 |
| GPQA (0-shot) | 8.61 | 6.94 | 11.74 |
| MuSR (0-shot) | 10.19 | 10.45 | 13.5 |
| MMLU-PRO (5-shot) | 41.49 | 50.22 | 51.85 |
1slices:
2 # First 8 layers: No replication
3 - sources:
4 - model: Qwen/Qwen2.5-32B-Instruct
5 layer_range: [0, 8]
6
7 # Next 8 layers: Replicate 2 layers
8 - sources:
9 - model: Qwen/Qwen2.5-32B-Instruct
10 layer_range: [8, 9]
11 - sources:
12 - model: Qwen/Qwen2.5-32B-Instruct
13 layer_range: [8, 9]
14 - sources:
15 - model: Qwen/Qwen2.5-32B-Instruct
16 layer_range: [9, 13]
17 - sources:
18 - model: Qwen/Qwen2.5-32B-Instruct
19 layer_range: [13, 14]
20 - sources:
21 - model: Qwen/Qwen2.5-32B-Instruct
22 layer_range: [13, 14]
23 - sources:
24 - model: Qwen/Qwen2.5-32B-Instruct
25 layer_range: [14, 16]
26
27 # Next 8 layers: Replicate 4 layers
28 - sources:
29 - model: Qwen/Qwen2.5-32B-Instruct
30 layer_range: [16, 18]
31 - sources:
32 - model: Qwen/Qwen2.5-32B-Instruct
33 layer_range: [17, 19]
34 - sources:
35 - model: Qwen/Qwen2.5-32B-Instruct
36 layer_range: [18, 20]
37 - sources:
38 - model: Qwen/Qwen2.5-32B-Instruct
39 layer_range: [19, 21]
40 - sources:
41 - model: Qwen/Qwen2.5-32B-Instruct
42 layer_range: [20, 22]
43 - sources:
44 - model: Qwen/Qwen2.5-32B-Instruct
45 layer_range: [21, 23]
46 - sources:
47 - model: Qwen/Qwen2.5-32B-Instruct
48 layer_range: [22, 24]
49
50 # Next 8 layers: Replicate all 8 layers
51 - sources:
52 - model: Qwen/Qwen2.5-32B-Instruct
53 layer_range: [24, 25]
54 - sources:
55 - model: Qwen/Qwen2.5-32B-Instruct
56 layer_range: [24, 26]
57 - sources:
58 - model: Qwen/Qwen2.5-32B-Instruct
59 layer_range: [25, 27]
60 - sources:
61 - model: Qwen/Qwen2.5-32B-Instruct
62 layer_range: [26, 28]
63 - sources:
64 - model: Qwen/Qwen2.5-32B-Instruct
65 layer_range: [27, 29]
66 - sources:
67 - model: Qwen/Qwen2.5-32B-Instruct
68 layer_range: [28, 30]
69 - sources:
70 - model: Qwen/Qwen2.5-32B-Instruct
71 layer_range: [29, 31]
72 - sources:
73 - model: Qwen/Qwen2.5-32B-Instruct
74 layer_range: [30, 32]
75
76 # Middle 8 layers: Replicate all 8 layers
77 - sources:
78 - model: Qwen/Qwen2.5-32B-Instruct
79 layer_range: [32, 33]
80 - sources:
81 - model: Qwen/Qwen2.5-32B-Instruct
82 layer_range: [32, 34]
83 - sources:
84 - model: Qwen/Qwen2.5-32B-Instruct
85 layer_range: [33, 35]
86 - sources:
87 - model: Qwen/Qwen2.5-32B-Instruct
88 layer_range: [34, 36]
89 - sources:
90 - model: Qwen/Qwen2.5-32B-Instruct
91 layer_range: [35, 37]
92 - sources:
93 - model: Qwen/Qwen2.5-32B-Instruct
94 layer_range: [36, 38]
95 - sources:
96 - model: Qwen/Qwen2.5-32B-Instruct
97 layer_range: [37, 39]
98 - sources:
99 - model: Qwen/Qwen2.5-32B-Instruct
100 layer_range: [38, 40]
101
102 # Next 8 layers: Replicate 4 layers
103 - sources:
104 - model: Qwen/Qwen2.5-32B-Instruct
105 layer_range: [40, 42]
106 - sources:
107 - model: Qwen/Qwen2.5-32B-Instruct
108 layer_range: [41, 43]
109 - sources:
110 - model: Qwen/Qwen2.5-32B-Instruct
111 layer_range: [42, 44]
112 - sources:
113 - model: Qwen/Qwen2.5-32B-Instruct
114 layer_range: [43, 45]
115 - sources:
116 - model: Qwen/Qwen2.5-32B-Instruct
117 layer_range: [44, 46]
118 - sources:
119 - model: Qwen/Qwen2.5-32B-Instruct
120 layer_range: [45, 47]
121 - sources:
122 - model: Qwen/Qwen2.5-32B-Instruct
123 layer_range: [46, 48]
124
125 # Next 8 layers: Replicate 2 layers
126 - sources:
127 - model: Qwen/Qwen2.5-32B-Instruct
128 layer_range: [48, 49]
129 - sources:
130 - model: Qwen/Qwen2.5-32B-Instruct
131 layer_range: [48, 49]
132 - sources:
133 - model: Qwen/Qwen2.5-32B-Instruct
134 layer_range: [49, 53]
135 - sources:
136 - model: Qwen/Qwen2.5-32B-Instruct
137 layer_range: [53, 54]
138 - sources:
139 - model: Qwen/Qwen2.5-32B-Instruct
140 layer_range: [53, 54]
141 - sources:
142 - model: Qwen/Qwen2.5-32B-Instruct
143 layer_range: [54, 56]
144
145 # Last 8 layers: No replication
146 - sources:
147 - model: Qwen/Qwen2.5-32B-Instruct
148 layer_range: [56, 64]
149
150merge_method: passthrough
151dtype: bfloat161!pip install -qU transformers accelerate
2
3from transformers import AutoTokenizer
4import transformers
5import torch
6
7model = "mlabonne/BigQwen2.5-Echo-47B-Instruct"
8messages = [{"role": "user", "content": "What is a large language model?"}]
9
10tokenizer = AutoTokenizer.from_pretrained(model)
11prompt = tokenizer.apply_chat_template(messages, tokenize=False, add_generation_prompt=True)
12pipeline = transformers.pipeline(
13 "text-generation",
14 model=model,
15 torch_dtype=torch.float16,
16 device_map="auto",
17)
18
19outputs = pipeline(prompt, max_new_tokens=256, do_sample=True, temperature=0.7, top_k=50, top_p=0.95)
20print(outputs[0]["generated_text"])