Views
No views yet
1from transformers import AutoTokenizer, AutoModelForCausalLM
2from transformers import pipeline
3import torch
4
5pipeline = pipeline(
6 "text-generation",
7 model="datapaf/llama3_8b_hn_rus_continued",
8 torch_dtype=torch.bfloat16,
9 device_map='auto'
10)
11
12messages = [
13 {"role": "system", "content": "Ты AI-помощник, ответь на вопрос"},
14 {"role": "user", "content": "Привет! Как дела?"},
15]
16
17prompt = pipeline.tokenizer.apply_chat_template(
18 messages,
19 tokenize=False,
20 add_generation_prompt=True
21)
22
23terminators = [
24 pipeline.tokenizer.eos_token_id,
25 pipeline.tokenizer.convert_tokens_to_ids("<|eot_id|>")
26]
27
28outputs = pipeline(
29 prompt,
30 max_new_tokens=256,
31 eos_token_id=terminators,
32 do_sample=False,
33 repetition_penalty=1.2,
34 return_full_text=False
35)
36
37print(outputs)