1models:2-model: mixedbread-ai/phi-23# no parameters necessary for base model4-model: rhysjones/phi-2-orange
5parameters:6density:0.57weight:0.58-model: cognitivecomputations/dolphin-2_6-phi-29parameters:10density:0.511weight:0.312merge_method: ties
13base_model: mixedbread-ai/phi-214parameters:15normalize:true16dtype: float16
17
💻 Usage
python
1!pip install -qU transformers accelerate
23from transformers import AutoTokenizer
4import transformers
5import torch
67model ="Venkman42/Phiter"8messages =[{"role":"user","content":"What is a large language model?"}]910tokenizer = AutoTokenizer.from_pretrained(model)11prompt = tokenizer.apply_chat_template(messages, tokenize=False, add_generation_prompt=True)12pipeline = transformers.pipeline(13"text-generation",14 model=model,15 torch_dtype=torch.float16,16 device_map="auto",17)1819outputs = pipeline(prompt, max_new_tokens=256, do_sample=True, temperature=0.7, top_k=50, top_p=0.95)20print(outputs[0]["generated_text"])