Views
No views yet
1from transformers import T5Tokenizer, T5ForConditionalGeneration
2
3# Load model
4tokenizer = T5Tokenizer.from_pretrained("Bashaarat1/t5-small-arxiv-summarizer")
5model = T5ForConditionalGeneration.from_pretrained("Bashaarat1/t5-small-arxiv-summarizer")
6
7# Prepare input
8text = "summarize: Your academic paper text here..."
9inputs = tokenizer(text, return_tensors="pt", max_length=512, truncation=True)
10
11# Generate summary
12outputs = model.generate(
13 **inputs,
14 max_length=128,
15 num_beams=4,
16 early_stopping=True
17)
18
19summary = tokenizer.decode(outputs[0], skip_special_tokens=True)
20print(summary)1import requests
2
3API_URL = "https://api-inference.huggingface.co/models/Bashaarat1/t5-small-arxiv-summarizer"
4headers = {"Authorization": "Bearer YOUR_HF_TOKEN"}
5
6def query(payload):
7 response = requests.post(API_URL, headers=headers, json=payload)
8 return response.json()
9
10output = query({"inputs": "summarize: Your paper text..."})1- max_input_length: 512
2- max_target_length: 128
3- num_beams: 4
4- learning_rate: 5e-5
5- warmup_steps: 500
6- weight_decay: 0.01| Metric | Base T5-small | Fine-tuned | Improvement |
|---|---|---|---|
| ROUGE-1 | 0.2200 | 0.2823 | +28.29% |
| ROUGE-2 | 0.0564 | 0.0826 | +46.45% |
| ROUGE-L | 0.1405 | 0.1796 | +27.85% |
1@misc{t5-arxiv-summarizer,
2 author = {Bashaarat1},
3 title = {T5-Small Fine-tuned for Academic Summarization},
4 year = {2024},
5 publisher = {Hugging Face},
6 howpublished = {\url{https://huggingface.co/Bashaarat1/t5-small-arxiv-summarizer}}
7}