Views
No views yet

transformers1from transformers import pipeline
2
3fill_mask = pipeline(
4 "fill-mask",
5 model="aubmindlab/araelectra-base-generator",
6 tokenizer="aubmindlab/araelectra-base-generator"
7)
8
9print(
10 fill_mask(" عاصمة لبنان هي [MASK] .)
11)pip install arabert1from arabert.preprocess import ArabertPreprocessor
2
3model_name="aubmindlab/araelectra-base"
4arabert_prep = ArabertPreprocessor(model_name=model_name)
5
6text = "ولن نبالغ إذا قلنا إن هاتف أو كمبيوتر المكتب في زمننا هذا ضروري"
7arabert_prep.preprocess(text)
8
9>>> output: ولن نبالغ إذا قلنا : إن هاتف أو كمبيوتر المكتب في زمننا هذا ضروري| Model | HuggingFace Model Name | Size (MB/Params) |
|---|---|---|
| AraELECTRA-base-generator | araelectra-base-generator | 227MB/60M |
| AraELECTRA-base-discriminator | araelectra-base-discriminator | 516MB/135M |
| Model | Hardware | num of examples (seq len = 512) | Batch Size | Num of Steps | Time (in days) |
|---|---|---|---|---|---|
| AraELECTRA-base | TPUv3-8 | - | 256 | 2M | 24 |
aubmindlab usernamewget https://huggingface.co/aubmindlab/MODEL_NAME/resolve/main/tf1_model.tar.gz where MODEL_NAME is any model under the aubmindlab name@inproceedings{antoun-etal-2021-araelectra,
title = "{A}ra{ELECTRA}: Pre-Training Text Discriminators for {A}rabic Language Understanding",
author = "Antoun, Wissam and
Baly, Fady and
Hajj, Hazem",
booktitle = "Proceedings of the Sixth Arabic Natural Language Processing Workshop",
month = apr,
year = "2021",
address = "Kyiv, Ukraine (Virtual)",
publisher = "Association for Computational Linguistics",
url = "https://www.aclweb.org/anthology/2021.wanlp-1.20",
pages = "191--195",
}