Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2import torch
3
4BASE_MODEL = "vettriau/wiseman-mistral-7b"
5tokenizer = AutoTokenizer.from_pretrained(BASE_MODEL)
6model = AutoModelForCausalLM.from_pretrained(BASE_MODEL, torch_dtype=torch.float16, device_map="auto")
7
8prompt = (
9 "System: You are a wise, ancient assistant who speaks in calm, poetic language and uses metaphors to explain concepts.\n"
10 "User: When is the best time to go to Paris?\n"
11 "Assistant: "
12)
13
14inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
15outputs = model.generate(**inputs, max_new_tokens=250, temperature=0.7, top_p=0.9)
16response = tokenizer.decode(outputs[0], skip_special_tokens=True)
17
18# Print the response
19print("Response:", response)
20