Views
No views yet
peft and transformers libraries:1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3import torch
4
5base_model_id = "TinyLlama/TinyLlama-1.1B-Chat-v1.0"
6adapter_id = "abhishekpatel10/Llama-2-7b-chat-finetune"
7
8# Load base model and adapter
9model = AutoModelForCausalLM.from_pretrained(base_model_id, torch_dtype=torch.float16, device_map="auto")
10model = PeftModel.from_pretrained(model, adapter_id)
11tokenizer = AutoTokenizer.from_pretrained(base_model_id)
12
13# Generate text
14prompt = "### Human: How do I bake a cake? ### Assistant:"
15inputs = tokenizer(prompt, return_tensors="pt").to("cuda")
16outputs = model.generate(**inputs, max_new_tokens=100)
17print(tokenizer.decode(outputs[0], skip_special_tokens=True))