Part of ChatBench: a benchmark for evaluating embedding models on chat/conversational retrieval tasks.
Given the beginning of a conversation, retrieve the continuation.
Split
Queries
Corpus Documents
test
500
1173
from datasets import load_dataset
Load corpus
corpus = load_dataset("GabeA/chatbench-response-retrieval", "corpus", split="test")
Load queries