Views
No views yet
t5-base-indonesian-summarization-cased model is based on t5-base-bahasa-summarization-cased by huseinzol05, finetuned using id_liputan6 dataset.1from transformers import T5Tokenizer, T5Model, T5ForConditionalGeneration
2
3tokenizer = T5Tokenizer.from_pretrained("cahya/t5-base-indonesian-summarization-cased")
4model = T5ForConditionalGeneration.from_pretrained("cahya/t5-base-indonesian-summarization-cased")1from transformers import T5Tokenizer, T5ForConditionalGeneration
2
3tokenizer = T5Tokenizer.from_pretrained("cahya/t5-base-indonesian-summarization-cased")
4model = T5ForConditionalGeneration.from_pretrained("cahya/t5-base-indonesian-summarization-cased")
5
6#
7ARTICLE_TO_SUMMARIZE = ""
8
9# generate summary
10input_ids = tokenizer.encode(ARTICLE_TO_SUMMARIZE, return_tensors='pt')
11summary_ids = model.generate(input_ids,
12 min_length=20,
13 max_length=80,
14 num_beams=10,
15 repetition_penalty=2.5,
16 length_penalty=1.0,
17 early_stopping=True,
18 no_repeat_ngram_size=2,
19 use_cache=True,
20 do_sample = True,
21 temperature = 0.8,
22 top_k = 50,
23 top_p = 0.95)
24
25summary_text = tokenizer.decode(summary_ids[0], skip_special_tokens=True)
26print(summary_text)