Wikipedia Multilingual Dataset
This dataset contains 10 language configurations, each with its own train split. The data for each config is stored in its respective subfolder.
from datasets import load_dataset
Load the 'eng' config
eng_ds = load_dataset("danghaidang-passau/wikipedia-ref-links-20260101", name="eng")
Load the 'ger' config
ger_ds = load_dataset("danghaidang-passau/wikipedia-ref-links-20260101", name="ger")