Dataset Card for CA-GL Parallel Corpus
Dataset Description
Dataset Summary
The CA-GL Parallel Corpus is a Catalan-Galician synthetic dataset parallel sentences created to
support the use of co-official languages from Spain, such as Catalan and Galician,
in NLP tasks, specifically Machine Translation.