JQaRARerankingLite
An MTEB dataset
Massive Text Embedding Benchmark
JQaRA (Japanese Question Answering with Retrieval Augmentation) is a reranking dataset consisting of questions from JAQKET and corpus from Japanese Wikipedia. This is the lightweight version with a reduced corpus (172,897 documents) constructed using hard negatives from 5 high-performance models.
Task category
t2t
Domains
Encyclopaedic, Non-fiction, Written
Reference… See the full description on the dataset page:
https://huggingface.co/datasets/lsz05/JQaRARerankingLite.