A Sinhala-language Visual Question Answering dataset of 37,318 QA pairs, constructed by translating Visual Genome QA annotations into Sinhala using gemini-3-flash-preview. This dataset was developed as part of research on benchmarking and adapting compact multimodal models for Sinhala VQA under low-resource conditions.