Views
No views yet
1from transformers import LlamaForCausalLM, LlamaTokenizer
2from peft import PeftModelForCausalLM
3
4base_model = LlamaForCausalLM.from_pretrained("your/llama/path")
5tokenizer = LlamaTokenizer.from_pretrained("your/llama/path")
6
7llama_lora = PeftModelForCausalLM.from_pretrained(base_model, "logits/llama2-7b-book-qa")
8
9prompt = "your prompt"
10input_ids = tokenizer(prompt).input_ids.cuda()
11
12output_ids = llama_lora(input_ids=input_ids)
13output = tokenizer.decode(output_ids)
14
15print(output)