Question–Answer–Context (QAC) data for chemistry patent retrieval, multiple languages. Configs/subsets: corpus, queries, qrels, qac, plus cross_language-corpus, cross_language-queries, cross_language-qrels, cross_language-qac (MTEB-style). Each config currently contains a train split.
Source dataset: Patent text (titles, abstracts) in this dataset is derived from Google Patents Public Data… See the full description on the dataset page:
https://huggingface.co/datasets/MehdiAstaraki/multi-lingual-qac-epo.