WCEP10 dataset for summarization.
From paper: "A Large-Scale Multi-Document Summarization Dataset from the Wikipedia
Current Events Portal" by D. Gholipour et al."
From paper: "PRIMER: Pyramid-based Masked Sentence Pre-training for Multi-document
Summarization" by W. Xiao et al."