1slices:
2 - sources:
3 - model: Ourse/R4L-v0.1
4 layer_range: [0, 28]
5 - model: Qwen/Qwen2.5-Math-1.5B
6 layer_range: [0, 28]
7merge_method: slerp
8base_model: Qwen/Qwen2.5-Math-1.5B
9parameters:
10 t:
11 - filter: self_attn
12 value: [0, 0.5, 0.3, 0.7, 1]
13 - filter: mlp
14 value: [1, 0.5, 0.7, 0.3, 0]
15 - value: 0.5
16dtype: bfloat16