Dataset Card for mr-tydi/en
The mr-tydi/en dataset, provided by the ir-datasets package.
For more information about the dataset, see the documentation.
This dataset provides:
docs (documents, i.e., the corpus); count=32,907,100
queries (i.e., topics); count=5,194
qrels: (relevance assessments); count=5,360
This dataset is used by: mr-tydi_en_dev, mr-tydi_en_test, mr-tydi_en_train
from datasets import load_dataset
docs =… See the full description on the dataset page:
https://huggingface.co/datasets/irds/mr-tydi_en.