A multi-annotator benchmark dataset for evaluating retrieval systems on blockchain and cryptocurrency research papers. This dataset contains 250 cryptography and security papers from arXiv (cs.CR category), each independently annotated by 5 different large language models for relevance to blockchain research from a scientific perspective.