Views
No views yet
pip install accelerate peft bitsandbytes pip install git+https://github.com/huggingface/transformers trl py7zr auto-gptq optimum1from peft import AutoPeftModelForCausalLM
2from transformers import GenerationConfig
3from transformers import AutoTokenizer
4import torch
5tokenizer = AutoTokenizer.from_pretrained("npvinHnivqn/Mistral-7B-Instruct")
6
7
8model = AutoPeftModelForCausalLM.from_pretrained(
9 'npvinHnivqn/Mistral-7B-Instruct',
10 low_cpu_mem_usage=True,
11 return_dict=True,
12 torch_dtype=torch.float16,
13 device_map="cuda")
14
15generation_config = GenerationConfig(
16 do_sample=True,
17 top_k=1,
18 temperature=0.1,
19 max_new_tokens=25,
20 pad_token_id=tokenizer.eos_token_id
21)
22
23inputs = tokenizer("""<|SYSTEM|> You are a very good chatbot, you can answer every question from users. <|USER|> Summarize this following dialogue: Vasanth: I'm at the railway station in Chennai Karthik: No problems so far? Vasanth: no, everything's going smoothly Karthik: good. lets meet there soon! [INPUT] <|BOT|>""", return_tensors="pt").to("cuda")
24outputs = model.generate(**inputs, generation_config=generation_config)
25print(tokenizer.decode(outputs[0], skip_special_tokens=True))