Views
No views yet
1from transformers import pipeline, AutoTokenizer, AutoModelForMaskedLM
2
3tokenizer = AutoTokenizer.from_pretrained('tugstugi/bert-base-mongolian-uncased', use_fast=False)
4model = AutoModelForMaskedLM.from_pretrained('tugstugi/bert-base-mongolian-uncased')
5
6## declare task ##
7pipe = pipeline(task="fill-mask", model=model, tokenizer=tokenizer)
8
9## example ##
10input_ = 'Миний [MASK] хоол идэх нь тун чухал.'
11
12output_ = pipe(input_)
13for i in range(len(output_)):
14 print(output_[i])
15
16## output ##
17#{'sequence': 'миний хувьд хоол идэх нь тун чухал.', 'score': 0.7889143824577332, 'token': 126, 'token_str': 'хувьд'}
18#{'sequence': 'миний бодлоор хоол идэх нь тун чухал.', 'score': 0.18616807460784912, 'token': 6106, 'token_str': 'бодлоор'}
19#{'sequence': 'миний зүгээс хоол идэх нь тун чухал.', 'score': 0.004825591575354338, 'token': 761, 'token_str': 'зүгээс'}
20#{'sequence': 'миний биед хоол идэх нь тун чухал.', 'score': 0.0015743684489279985, 'token': 3010, 'token_str': 'биед'}
21#{'sequence': 'миний тухайд хоол идэх нь тун чухал.', 'score': 0.0014919431414455175, 'token': 1712, 'token_str': 'тухайд'}1@misc{mongolian-bert,
2 author = {Tuguldur, Erdene-Ochir and Gunchinish, Sharavsambuu and Bataa, Enkhbold},
3 title = {BERT Pretrained Models on Mongolian Datasets},
4 year = {2019},
5 publisher = {GitHub},
6 journal = {GitHub repository},
7 howpublished = {\url{https://github.com/tugstugi/mongolian-bert/}}
8}