Dataset Card for RAG_Multilingual
Dataset Summary
RAG_Multilingual is an instruction-following synthetic QA dataset created from extractive QA datasets from Catalan, English and Spanish reference sets.
The reference datasets were: SQAD (
https://huggingface.co/datasets/rajpurkar/squad), Catalanqa (
https://huggingface.co/datasets/projecte-aina/catalanqa) and SQAC (
https://huggingface.co/datasets/PlanTL-GOB-ES/SQAC).
This dataset, of 56.406 instances, was created by… See the full description on the dataset page:
https://huggingface.co/datasets/projecte-aina/RAG_Multilingual.