MuPLeR-retrieval
An MTEB dataset
Massive Text Embedding Benchmark
MuPLeR: Multilingual Parallel Legal Retrieval
MuPLeR-retrieval is a multilingual, parallel legal dataset designed for evaluating retrieval and cross-lingual retrieval tasks. Dataset contains 10,000 human-translated parallel passages (derived from the European Union's DGT-Acquis corpus) & 200 parallel queries (synthetic) across 14 European languages.