Views
No views yet
1import torch
2from transformers import AutoTokenizer, AutoModelWithLMHead
3tokenizer = AutoTokenizer.from_pretrained('SiberiaSoft/ruGPT3_medium_chitchat')
4model = AutoModelWithLMHead.from_pretrained('SiberiaSoft/ruGPT3_medium_chitchat')
5inputs = tokenizer('[FIRST] Привет [SECOND]', return_tensors='pt')
6generated_token_ids = model.generate(
7 **inputs,
8 top_k=10,
9 top_p=0.95,
10 num_beams=3,
11 num_return_sequences=5,
12 do_sample=True,
13 no_repeat_ngram_size=2,
14 temperature=1.0,
15 repetition_penalty=1.2,
16 length_penalty=1.0,
17 eos_token_id=50257,
18 max_length = 400
19)
20generation = [tokenizer.decode(sample_token_ids) for sample_token_ids in generated_token_ids]
21print(generation)