Views
No views yet
1from transformers import (
2 AutoModelForMaskedLM, AutoTokenizer
3)
4
5
6tokenizer = AutoTokenizer.from_pretrained("ken11/albert-base-japanese-v1-with-japanese-tokenizer")
7model = AutoModelForMaskedLM.from_pretrained("ken11/albert-base-japanese-v1-with-japanese-tokenizer")
8
9text = "明日は明日の[MASK]が吹く"
10tokens = tokenizer(text, return_tensors="pt")
11mask_index = tokens["input_ids"][0].tolist().index(tokenizer.mask_token_id)
12predict = model(**tokens)[0]
13_, result = predict[0, mask_index].topk(5)
14
15print(tokenizer.convert_ids_to_tokens(result.tolist()))1from transformers import (
2 TFAutoModelForMaskedLM, AutoTokenizer
3)
4import tensorflow as tf
5
6
7tokenizer = AutoTokenizer.from_pretrained("ken11/albert-base-japanese-v1-with-japanese-tokenizer")
8model = TFAutoModelForMaskedLM.from_pretrained("ken11/albert-base-japanese-v1-with-japanese-tokenizer")
9
10text = "明日は明日の[MASK]が吹く"
11tokens = tokenizer(text, return_tensors="tf")
12mask_index = tokens["input_ids"][0].numpy().tolist().index(tokenizer.mask_token_id)
13predict = model(**tokens)[0]
14result = tf.math.top_k(predict[0, mask_index], k=5)
15
16print(tokenizer.convert_ids_to_tokens(result.indices.numpy()))