Views
No views yet
1#https://huggingface.co/docs/peft/quicktour
2
3from peft import AutoPeftModelForCausalLM
4from transformers import AutoTokenizer
5import torch
6
7model = AutoPeftModelForCausalLM.from_pretrained("Sentdex/Walls1337bot-Llama2-7B-003.004.500")
8tokenizer = AutoTokenizer.from_pretrained("NousResearch/Llama-2-7b-chat-hf")
9
10model = model.to("cuda")
11model.eval()
12
13prompt = "Your text here."
14formatted_prompt = f"### BEGIN CONVERSATION ###\n\n## Speaker_0: ##\n{prompt}\n\n## Walls1337bot: ##\n"
15inputs = tokenizer(formatted_prompt, return_tensors="pt")
16outputs = model.generate(input_ids=inputs["input_ids"].to("cuda"), max_new_tokens=128)
17print(tokenizer.batch_decode(outputs.detach().cpu().numpy(), skip_special_tokens=True)[0])