Views
No views yet
1from transformers import AutoTokenizer, AutoModelForMaskedLM
2
3tokenizer = AutoTokenizer.from_pretrained("burakaytan/roberta-small-turkish-clean-uncased")
4model = AutoModelForMaskedLM.from_pretrained("burakaytan/roberta-small-turkish-clean-uncased")1from transformers import pipeline
2
3fill_mask = pipeline(
4 "fill-mask",
5 model="burakaytan/roberta-small-turkish-clean-uncased",
6 tokenizer="burakaytan/roberta-small-turkish-clean-uncased"
7)
8
9fill_mask("iki ülke arasında <mask> başladı")
10
11[{'sequence': 'iki ülke arasında savaş başladı',
12 'score': 0.14830906689167023,
13 'token': 1745,
14 'token_str': ' savaş'},
15 {'sequence': 'iki ülke arasında çatışmalar başladı',
16 'score': 0.1442396193742752,
17 'token': 18223,
18 'token_str': ' çatışmalar'},
19 {'sequence': 'iki ülke arasında gerginlik başladı',
20 'score': 0.12025047093629837,
21 'token': 13638,
22 'token_str': ' gerginlik'},
23 {'sequence': 'iki ülke arasında çatışma başladı',
24 'score': 0.0615813322365284,
25 'token': 5452,
26 'token_str': ' çatışma'},
27 {'sequence': 'iki ülke arasında görüşmeler başladı',
28 'score': 0.04512731358408928,
29 'token': 4736,
30 'token_str': ' görüşmeler'}]1
2@article{aytan2023deep,
3 title={Deep learning-based Turkish spelling error detection with a multi-class false positive reduction model},
4 author={AYTAN, BURAK and {\c{S}}AKAR, CEMAL OKAN},
5 journal={Turkish Journal of Electrical Engineering and Computer Sciences},
6 volume={31},
7 number={3},
8 pages={581--595},
9 year={2023}
10}
11