Views
No views yet
1from transformers import AutoModelForMaskedLM, AutoTokenizer
2
3tokenizer = AutoTokenizer.from_pretrained('HeNLP/HeRo')
4model = AutoModelForMaskedLM.from_pretrained('HeNLP/HeRo'
5
6# Tokenization Example:
7# Tokenizing
8tokenized_string = tokenizer('שלום לכולם')
9
10# Decoding
11decoded_string = tokenizer.decode(tokenized_string ['input_ids'], skip_special_tokens=True)@article{shalumov2023hero,
title={HeRo: RoBERTa and Longformer Hebrew Language Models},
author={Vitaly Shalumov and Harel Haskey},
year={2023},
journal={arXiv:2304.11077},
}