This dataset is derived from csebuetnlp/xlsum (subset: bengali).
Dataset Description
Overview
Original dataset: csebuetnlp/xlsum
Subset: bengali
Total samples: 10126
Split source: Original splits from dataset
Train split: 8102 samples (80.0%)
Validation split: 1012 samples (10.0%)
Test split: 1012 samples (10.0%)
{
"id": "object",
"url": "object"… See the full description on the dataset page:
https://huggingface.co/datasets/kawsarahmd/xlsum_bangla.