Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3import torch
4
5# Load base model
6base_model = AutoModelForCausalLM.from_pretrained("TinyLlama/TinyLlama-1.1B-Chat-v1.0")
7tokenizer = AutoTokenizer.from_pretrained("TinyLlama/TinyLlama-1.1B-Chat-v1.0")
8
9# Load fine-tuned adapter
10model = PeftModel.from_pretrained(base_model, "Irutingabo/pregnancy-assistant-tinyllama")
11
12# Generate response
13prompt = "What are the signs of early labor?"
14inputs = tokenizer(prompt, return_tensors="pt")
15with torch.no_grad():
16 outputs = model.generate(**inputs, max_new_tokens=200, temperature=0.7)
17response = tokenizer.decode(outputs[0], skip_special_tokens=True)