Views
No views yet
Trainer class from the Transformers library was used to train the model. PyTorch was used as the backend framework during training, but the model remains compatible with other frameworks nonetheless.| Model | #params | Arch. | Training/Validation data (text) |
|---|---|---|---|
gpt2-indo-medium-kids-stories | 345M | GPT2 Medium | Indonesian Kids' Stories (860 KB) |
| Epoch | Training Loss | Validation Loss |
|---|---|---|
| 1 | 3.909100 | 3.627678 |
| 2 | 3.375300 | 3.562854 |
| 3 | 3.113300 | 3.578999 |
1from transformers import pipeline
2
3pretrained_name = "bookbot/gpt2-indo-medium-kids-stories"
4
5nlp = pipeline(
6 "text-generation",
7 model=pretrained_name,
8 tokenizer=pretrained_name
9)
10
11nlp("Archie sedang mengendarai roket ke planet Mars.")1from transformers import GPT2LMHeadModel, GPT2TokenizerFast
2
3pretrained_name = "bookbot/gpt2-indo-medium-kids-stories"
4model = GPT2LMHeadModel.from_pretrained(pretrained_name)
5tokenizer = GPT2TokenizerFast.from_pretrained(pretrained_name)
6
7prompt = "Archie sedang mengendarai roket ke planet Mars."
8encoded_input = tokenizer(prompt, return_tensors='pt')
9output = model(**encoded_input)