Views
No views yet
### Prompt:
{user_input}
### Response:
{model_response}pip install torch transformers peft accelerate1import torch
2from transformers import AutoModelForCausalLM, AutoTokenizer
3from peft import PeftModel
4
5# Load model
6base_model = AutoModelForCausalLM.from_pretrained("TinyLlama/TinyLlama-1.1B-Chat-v1.0")
7model = PeftModel.from_pretrained(base_model, "./lora-finetuned")
8tokenizer = AutoTokenizer.from_pretrained("TinyLlama/TinyLlama-1.1B-Chat-v1.0")
9
10# Generate response
11prompt = "### Prompt:\nHello, how are you?\n\n### Response:\n"
12inputs = tokenizer(prompt, return_tensors="pt")
13outputs = model.generate(**inputs, max_new_tokens=200)
14response = tokenizer.decode(outputs[0], skip_special_tokens=True)
15print(response)1@misc{tinyllama-finetuned-2025,
2 author = {Makwana Mukesh},
3 title = {Fine-tuned TinyLlama Model},
4 year = {2025},
5 publisher = {Hugging Face},
6 howpublished = {\url{[Your model URL]}}
7}