This dataset is organized into multiple configurations (subsets), one for each language.
You can load a specific language subset like this:
from datasets import load_dataset
vi_train = load_dataset("tungvu3196/vlm-projects-multi-lang-final", "Vietnamese", split="train")