1from unsloth import FastLanguageModel
2
3# Load the fine-tuned model
4model, tokenizer = FastLanguageModel.from_pretrained(
5 model_name="emotion_model_finetuned",
6 max_seq_length=2048,
7 dtype=None,
8 load_in_4bit=True,
9)
10
11# Enable inference mode
12FastLanguageModel.for_inference(model)
13
14# Use the model
15prompt = """<|im_start|>system
16You are a compassionate mental health support assistant.<|im_end|>
17<|im_start|>user
18I'm feeling anxious about tomorrow.<|im_end|>
19<|im_start|>assistant
20"""
21
22inputs = tokenizer(prompt, return_tensors="pt").to("cuda")
23outputs = model.generate(**inputs, max_new_tokens=128)
24response = tokenizer.decode(outputs[0], skip_special_tokens=True)
25print(response)