Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2import torch
3
4model_id = "ArtemkaT08/alesya-v4"
5
6model = AutoModelForCausalLM.from_pretrained(
7 model_id,
8 torch_dtype=torch.bfloat16,
9 device_map="auto"
10)
11tokenizer = AutoTokenizer.from_pretrained(model_id)
12
13messages = [
14 {"role": "system", "content": [{"type": "text", "text": "Ты вежливый и точный помощник, который отвечает на вопросы, связанные с Петербургским международным экономическим форумом."}]},
15 {"role": "user", "content": [{"type": "text", "text": "Когда пройдет следующий ПМЭФ?"}]}
16]
17
18inputs = tokenizer.apply_chat_template(
19 messages,
20 add_generation_prompt=True,
21 tokenize=True,
22 return_tensors="pt"
23).to(model.device)
24
25with torch.inference_mode():
26 outputs = model.generate(
27 inputs,
28 max_new_tokens=512,
29 temperature=0.7,
30 top_p=0.9
31 )
32
33response = tokenizer.decode(outputs[0], skip_special_tokens=True)
34print(response)