Views
No views yet

1from transformers import AutoTokenizer, AutoModel, TFAutoModel
2
3tokenizer = AutoTokenizer.from_pretrained("GroNLP/bert-base-dutch-cased")
4model = AutoModel.from_pretrained("GroNLP/bert-base-dutch-cased") # PyTorch
5model = TFAutoModel.from_pretrained("GroNLP/bert-base-dutch-cased") # TensorflowGroNLP/bert-base-dutch-cased tokenizer, use use the following tokenizer:tokenizer = AutoTokenizer.from_pretrained("GroNLP/bert-base-dutch-cased", revision="v1") # v1 is the old vocabulary| Model | CoNLL-2002 | SoNaR-1 | spaCy UD LassySmall |
|---|---|---|---|
| BERTje | 90.24 | 84.93 | 86.10 |
| mBERT | 88.61 | 84.19 | 86.77 |
| BERT-NL | 85.05 | 80.45 | 81.62 |
| RobBERT | 84.72 | 81.98 | 79.84 |
| Model | UDv2.5 LassySmall |
|---|---|
| BERTje | 96.48 |
| mBERT | 96.20 |
| BERT-NL | 96.10 |
| RobBERT | 95.91 |
1@misc{devries2019bertje,
2\ttitle = {{BERTje}: {A} {Dutch} {BERT} {Model}},
3\tshorttitle = {{BERTje}},
4\tauthor = {de Vries, Wietse and van Cranenburgh, Andreas and Bisazza, Arianna and Caselli, Tommaso and Noord, Gertjan van and Nissim, Malvina},
5\tyear = {2019},
6\tmonth = dec,
7\thowpublished = {arXiv:1912.09582},
8\turl = {http://arxiv.org/abs/1912.09582},
9}