Views
No views yet
1from unsloth import FastLanguageModel
2
3model, tokenizer = FastLanguageModel.from_pretrained(
4 model_name = "SyedaArisha/medical-llama3-lora",
5 max_seq_length = 1024,
6 load_in_4bit = True,
7)
8
9FastLanguageModel.for_inference(model)
10
11inputs = tokenizer(
12 """Below is a medical question. Answer it accurately.
13
14### Question:
15What are the symptoms of hypertension?
16
17### Answer:
18""",
19 return_tensors = "pt"
20).to("cuda")
21
22outputs = model.generate(**inputs, max_new_tokens=200)
23print(tokenizer.decode(outputs[0], skip_special_tokens=True))