This model has been pre-trained for Chinese, training and random input masking has been applied independently to word pieces (as in the original BERT paper).
Significant research has explored bias and fairness issues with language models (see, e.g.,
Sheng et al. (2021) and
Bender et al. (2021)).
1from transformers import AutoTokenizer, AutoModelForMaskedLM
2
3tokenizer = AutoTokenizer.from_pretrained("bert-base-chinese")
4
5model = AutoModelForMaskedLM.from_pretrained("bert-base-chinese")
6