Views
No views yet
pad_token は eos_token を再利用1from transformers import AutoTokenizer, GPT2LMHeadModel
2
3repo = "Teto59/gpt2-small-aozora-ja-125m"
4tok = AutoTokenizer.from_pretrained(repo)
5model = GPT2LMHeadModel.from_pretrained(repo)
6
7prompt = "吾輩は猫である。名前はまだ無い。"
8x = tok(prompt, return_tensors="pt")
9y = model.generate(
10 **x,
11 max_new_tokens=160,
12 do_sample=False, # まずはGreedyで安定出力
13 eos_token_id=tok.eos_token_id,
14 pad_token_id=tok.eos_token_id,
15)
16print(tok.decode(y[0], skip_special_tokens=True))