Views
No views yet
1base_model: akameswa/mistral-7b-instruct-v0.2-bnb-16bit
2gate_mode: hidden
3dtype: float16
4experts:
5 - source_model: akameswa/mistral-7b-instruct-javascript-16bit
6 positive_prompts: ["You are helpful a coding assistant good at javascript"]
7 - source_model: akameswa/mistral-7b-instruct-java-16bit
8 positive_prompts: ["You are helpful a coding assistant good at java"]
9 - source_model: akameswa/mistral-7b-instruct-cpp-16bit
10 positive_prompts: ["You are helpful a coding assistant good at cpp"]
11 - source_model: akameswa/mistral-7b-instruct-python-16bit
12 positive_prompts: ["You are helpful a coding assistant good at python"]1from transformers import AutoTokenizer
2import transformers
3import torch
4
5model = "akameswa/mixtral-4x7b-instruct-code-trial"
6messages = [{"role": "user", "content": "What is a large language model?"}]
7
8tokenizer = AutoTokenizer.from_pretrained(model)
9prompt = tokenizer.apply_chat_template(
10 messages,
11 tokenize=False,
12 add_generation_prompt=True
13)
14pipeline = transformers.pipeline(
15 "text-generation",
16 model=model,
17 torch_dtype=torch.float16,
18 device_map="auto",
19 model_kwargs={"load_in_4bit": True},
20)
21
22outputs = pipeline(prompt, max_new_tokens=256, do_sample=True, temperature=0.7, top_k=50, top_p=0.95)