This dataset is part of a Table + Text retrieval benchmark. Includes queries and relevance judgments across test split(s), with corpus in 3 format(s): corpus_linearized, corpus_md, corpus_structure.
Config
Description
Split(s)
default
Relevance judgments (qrels): qid, did, score
test
queries
Query IDs and text
test_queries
corpus_linearized
Linearized table representation
corpus_linearized
corpus_md
Markdown table… See the full description on the dataset page:
https://huggingface.co/datasets/ibm-research/OpenWikiTablesRetrieval.