Views
No views yet
1# Install: pip install unsloth transformers peft accelerate
2
3import torch
4from unsloth import FastLanguageModel
5from peft import PeftModel
6
7# Load base model with Unsloth
8BASE_MODEL = "TinyLlama/TinyLlama-1.1B-Chat-v1.0"
9ADAPTER = "arif-butt/tinyllama-unsloth-lora-adapter"
10
11base_model, tokenizer = FastLanguageModel.from_pretrained(
12 model_name=BASE_MODEL,
13 max_seq_length=512,
14 dtype=torch.float16,
15 device_map="auto",
16)
17
18# Attach adapter
19model = PeftModel.from_pretrained(base_model, ADAPTER)
20model.eval()
21
22# Test prompt
23prompt = "Q: Name all the courses Arif butt teach?\nA:"
24inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
25
26with torch.no_grad():
27 outputs = model.generate(
28 **inputs,
29 max_new_tokens=100,
30 temperature=0.2,
31 do_sample=True,
32 pad_token_id=tokenizer.eos_token_id,
33 )
34
35response = tokenizer.decode(outputs[0], skip_special_tokens=True)
36print(f"Response: {response}")
37