LLM_MERGE_CC4 est une fusion des modèles suivants créée par ManoloPueblo utilisant
mergekit:
1merge_method: passthrough
2slices:
3 - sources:
4 - model: OpenPipe/mistral-ft-optimized-1218
5 layer_range: [0, 32]
6 - sources:
7 - model: mlabonne/NeuralHermes-2.5-Mistral-7B
8 layer_range: [24, 32]
9merge_method: passthrough
10dtype: bfloat16
LLM_MERGE_CC4 est un modèle de langage créé par la fusion de deux modèles Mistral :
Cette fusion utilise la méthode "passthrough" avec normalisation et une précision float16 pour combiner les forces des deux modèles.
Le modèle conserve l'architecture de base de OpenPipe/mistral-ft-optimized-1218 tout en incorporant les améliorations des deux versions à travers une fusion pondérée.
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3tokenizer = AutoTokenizer.from_pretrained("ManoloPueblo/LLM_MERGE_CC4")
4model = AutoModelForCausalLM.from_pretrained("ManoloPueblo/LLM_MERGE_CC4")
Comme pour tout modèle de langage, les utilisateurs doivent être conscients des biais potentiels et des limitations inhérentes aux modèles sources. Les performances peuvent varier selon les cas d'utilisation.