Views
No views yet

1name: Qwenvergence-14B-v6-Prose-model_stock
2merge_method: model_stock
3base_model: Qwen/Qwen2.5-14B
4tokenizer_source: huihui-ai/Qwen2.5-14B-Instruct-abliterated-v2
5parameters:
6 int8_mask: true
7 normalize: true
8 rescale: false
9models:
10 - model: arcee-ai/Virtuoso-Small
11 - model: sometimesanotion/Lamarck-14B-v0.3
12 - model: EVA-UNIT-01/EVA-Qwen2.5-14B-v0.2
13 - model: allura-org/TQ2.5-14B-Sugarquill-v1
14 - model: oxyapi/oxy-1-small
15 - model: v000000/Qwen2.5-Lumen-14B
16 - model: sthenno-com/miscii-14b-1225
17 - model: sthenno-com/miscii-14b-1225
18 - model: underwoods/medius-erebus-magnum-14b
19 - model: huihui-ai/Qwen2.5-14B-Instruct-abliterated-v2
20dtype: float32
21out_dtype: bfloat16
22---
23# Nifty TIES to allow a series of LoRA exchange among the above models
24---
25name: Qwenvergence-14B-v6-Prose
26merge_method: ties
27base_model: Qwen/Qwen2.5-14B
28tokenizer_source: base
29parameters:
30 density: 1.00
31 weight: 1.00
32 int8_mask: true
33 normalize: true
34 rescale: false
35dtype: float32
36out_dtype: bfloat16
37models:
38 - model: sometimesanotion/Qwenvergence-14B-v6-Prose-slerp
39 parameters:
40 density: 1.00
41 weight: 1.00
42---
43# The last stable version of the Qwentinuum project which used successive breadcrumbs and SLERP merges to boost IFEval, merged back into Qwenvergence
44name: Qwentinuum-14B-v6-Prose-slerp
45merge_method: slerp
46base_model: sometimesanotion/Qwenvergence-14B-v6-Prose
47tokenizer_source: sometimesanotion/Qwenvergence-14B-v6-Prose
48dtype: bfloat16
49out_dtype: bfloat16
50parameters:
51 int8_mask: true
52 normalize: true
53 rescale: false
54parameters:
55 t:
56 - value: 0.40
57slices:
58 - sources:
59 - model: sometimesanotion/Qwenvergence-14B-v6-Prose
60 layer_range: [ 0, 8 ]
61 - model: sometimesanotion/Qwentinuum-14B-v6
62 layer_range: [ 0, 8 ]
63 - sources:
64 - model: sometimesanotion/Qwenvergence-14B-v6-Prose
65 layer_range: [ 8, 16 ]
66 - model: sometimesanotion/Qwentinuum-14B-v6
67 layer_range: [ 8, 16 ]
68 - sources:
69 - model: sometimesanotion/Qwenvergence-14B-v6-Prose
70 layer_range: [ 16, 24 ]
71 - model: sometimesanotion/Qwentinuum-14B-v6
72 layer_range: [ 16, 24 ]
73 - sources:
74 - model: sometimesanotion/Qwenvergence-14B-v6-Prose
75 layer_range: [ 24, 32 ]
76 - model: sometimesanotion/Qwentinuum-14B-v6
77 layer_range: [ 24, 32 ]
78 - sources:
79 - model: sometimesanotion/Qwenvergence-14B-v6-Prose
80 layer_range: [ 32, 40 ]
81 - model: sometimesanotion/Qwentinuum-14B-v6
82 layer_range: [ 32, 40 ]
83 - sources:
84 - model: sometimesanotion/Qwenvergence-14B-v6-Prose
85 layer_range: [ 40, 48 ]
86 - model: sometimesanotion/Qwentinuum-14B-v6
87 layer_range: [ 40, 48 ]
88
89---
90name: Qwen2.5-14B-Vimarckoso-v3-model_stock
91merge_method: model_stock
92base_model: sometimesanotion/Base-Qwenvergence
93tokenizer_source: sometimesanotion/Abliterate-Qwenvergence
94dtype: bfloat16
95out_dtype: bfloat16
96parameters:
97 int8_mask: true
98 normalize: true
99 rescale: false
100# With this many models, it's good to pre-merge some LoRAs from Abliterate-Qwenvergence, with their ranks indicated in the suffixes.
101models:
102 - model: EVA-UNIT-01/EVA-Qwen2.5-14B-v0.2-qv512
103 - model: arcee-ai/Virtuoso-Small-qv128
104 - model: v000000/Qwen2.5-Lumen-14B-qv256
105 - model: VAGOsolutions/SauerkrautLM-v2-14b-DPO-qv256
106 - model: rombodawg/Rombos-LLM-V2.6-Qwen-14b
107 - model: sometimesanotion/Qwentinuum-14B-v013
108 - model: sometimesanotion/Abliterate-Qwenvergence
109---
110name: Qwen2.5-14B-Vimarckoso-v3-slerp
111merge_method: slerp
112base_model: sometimesanotion/Qwen2.5-14B-Vimarckoso-v3-model_stock
113tokenizer_source: base
114dtype: float32
115out_dtype: bfloat16
116parameters:
117 t:
118 - value: 0.20
119slices:
120 - sources:
121 - model: sometimesanotion/Qwen2.5-14B-Vimarckoso-v3-model_stock
122 layer_range: [ 0, 48 ]
123 - model: sometimesanotion/Qwentinuum-14B-v6-Prose+sometimesanotion/Qwenvergence-Abliterate-256
124 layer_range: [ 0, 48 ]
125