Views
No views yet
1>>> from transformers import AutoTokenizer, AutoModelForPreTraining
2>>> model = AutoModelForPreTraining.from_pretrained("Jinhwan/krelectra-base-mecab")
3>>> tokenizer = AutoTokenizer.from_pretrained("Jinhwan/krelectra-base-mecab")1>>> from transformers import AutoTokenizer
2>>> tokenizer = AutoTokenizer.from_pretrained("Jinhwan/krelectra-base-mecab")
3>>> tokenizer.tokenize("[CLS] 한국어 ELECTRA를 공유합니다. [SEP]")
4['[CLS]', '한국어', 'EL', '##ECT', '##RA', '##를', '공유', '##합', '##니다', '.', '[SEP]']
5>>> tokenizer.convert_tokens_to_ids(['[CLS]', '한국어', 'EL', '##ECT', '##RA', '##를', '공유', '##합', '##니다', '.', '[SEP]'])
6[2, 7214, 24023, 24663, 26580, 3195, 7086, 3746, 5500, 17, 3]