Views
No views yet
1from transformers import AutoTokenizer, AutoModelForCausalLM
2from peft import PeftModel
3
4base_model = "TinyLlama/TinyLlama-1.1B-Chat-v1.0"
5adapter_model = "Sujith2121/tinyllama-dora-model"
6
7tokenizer = AutoTokenizer.from_pretrained(adapter_model)
8
9model = AutoModelForCausalLM.from_pretrained(base_model, device_map="auto")
10model = PeftModel.from_pretrained(model, adapter_model)
11
12prompt = "Explain Docker simply"
13
14inputs = tokenizer(prompt, return_tensors="pt").to("cuda")
15outputs = model.generate(**inputs, max_new_tokens=100)
16
17print(tokenizer.decode(outputs[0], skip_special_tokens=True))