Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model = AutoModelForCausalLM.from_pretrained(
4 "{HF_REPO_NAME}",
5 trust_remote_code=True,
6 device_map="auto"
7)
8tokenizer = AutoTokenizer.from_pretrained("{HF_REPO_NAME}", trust_remote_code=True)
9
10# Пример запроса
11messages = [
12 {{"role": "system", "content": "Ты - эксперт в автомобилях."}},
13 {{"role": "user", "content": "Расскажи мне про автомобиль XCITE X-Cross 7"}}
14]
15
16text = tokenizer.apply_chat_template(
17 messages,
18 tokenize=False,
19 add_generation_prompt=True
20)
21
22inputs = tokenizer(text, return_tensors="pt").to(model.device)
23
24outputs = model.generate(
25 **inputs,
26 max_new_tokens=512,
27 temperature=0.7,
28 do_sample=True,
29 pad_token_id=tokenizer.eos_token_id,
30)
31
32response = tokenizer.decode(outputs[0], skip_special_tokens=True)
33print(response)