Views
No views yet
1from transformers import AutoTokenizer, AutoModelForCausalLM
2
3model_name = "[YOUR_HF_USERNAME]/microsoft365-mistral"
4tokenizer = AutoTokenizer.from_pretrained(model_name)
5model = AutoModelForCausalLM.from_pretrained(model_name)
6
7# For 4-bit quantization (optional)
8# from transformers import BitsAndBytesConfig
9# quantization_config = BitsAndBytesConfig(load_in_4bit=True)
10# model = AutoModelForCausalLM.from_pretrained(model_name, quantization_config=quantization_config)
11
12prompt = "How do I set up retention policies in SharePoint Online?"
13inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
14
15outputs = model.generate(
16 inputs.input_ids,
17 max_new_tokens=500,
18 do_sample=True,
19 temperature=0.7,
20 top_p=0.9
21)
22
23response = tokenizer.decode(outputs[0][inputs.input_ids.shape[1]:], skip_special_tokens=True)
24print(response)