Views
No views yet
QuantumLM is a Llama2 7B model finetuned on an Wizard-Orca style DatasetQuantumLM-7B using the following code snippet:1import torch
2from transformers import AutoModelForCausalLM, AutoTokenizer, pipeline
3
4tokenizer = AutoTokenizer.from_pretrained("quantumaikr/QuantumLM-7B", use_fast=False)
5model = AutoModelForCausalLM.from_pretrained("quantumaikr/QuantumLM-7B", torch_dtype=torch.float16, low_cpu_mem_usage=True, device_map="auto")
6system_prompt = "### System:\nYou are QuantumLM, an AI that follows instructions extremely well. Help as much as you can. Remember, be safe, and don't do anything illegal.\n\n"
7
8message = "Write me a poem please"
9prompt = f"{system_prompt}### User: {message}\n\n### Assistant:\n"
10inputs = tokenizer(prompt, return_tensors="pt").to("cuda")
11output = model.generate(**inputs, do_sample=True, top_p=0.95, top_k=0, max_new_tokens=256)
12
13print(tokenizer.decode(output[0], skip_special_tokens=True))### System:
This is a system prompt, please behave and help the user.
### User:
Your prompt here
### Assistant
The output of QuantumLM