Views
No views yet
unshuffled_deduplicated_id subset. The model was trained from scratch and achieved an evaluation loss of 1.798 and an evaluation accuracy of 62.45%.| Model | #params | Arch. | Training/Validation data (text) |
|---|---|---|---|
indonesian-roberta-base | 124M | RoBERTa | OSCAR unshuffled_deduplicated_id Dataset |
| train loss | valid loss | valid accuracy | total time |
|---|---|---|---|
| 1.870 | 1.798 | 0.6245 | 18:25:39 |
1from transformers import pipeline
2
3pretrained_name = "flax-community/indonesian-roberta-base"
4
5fill_mask = pipeline(
6 "fill-mask",
7 model=pretrained_name,
8 tokenizer=pretrained_name
9)
10
11fill_mask("Budi sedang <mask> di sekolah.")1from transformers import RobertaModel, RobertaTokenizerFast
2
3pretrained_name = "flax-community/indonesian-roberta-base"
4model = RobertaModel.from_pretrained(pretrained_name)
5tokenizer = RobertaTokenizerFast.from_pretrained(pretrained_name)
6
7prompt = "Budi sedang berada di sekolah."
8encoded_input = tokenizer(prompt, return_tensors='pt')
9output = model(**encoded_input)