This dataset was created for the SHROOM-CAP 2025 Shared Task on multilingual scientific hallucination detection. It combines and unifies multiple hallucination detection datasets into a single, balanced training corpus for fine-tuning XLM-RoBERTa-Large.