The MangaliCa Bilingual Image–Caption Dataset is a large-scale Hungarian–English multimodal dataset containing approximately 70 million aligned image–caption pairs.
Each image is paired with:
an original English caption
a machine-translated Hungarian caption