This dataset contains experimental results from the Multi-Turn RAG (MT-RAG) benchmark focusing on retrieval tasks across multiple domains.
Competition: MT-RAG Benchmark - Task A (Retrieval)Date: January 2026Domains: CLAPNQ, CLOUD, FIQA, GOVT
Contents
1. Baseline Results with Ground Truth Rewrites
Directory: submissions/baselines_rewrite/
Results for 5 retrieval models using query rewrites… See the full description on the dataset page:
https://huggingface.co/datasets/vania-janet/multiturn-rag-retrieval-data.