Latvian Wikipedia QA Synthetic Dataset
Dataset Description
This dataset contains approximately 118,000 multi-turn conversations with approximately 454,000 synthetic question-answer pairs generated from Latvian Wikipedia articles using Gemma 3 27B.
Dataset Summary
Language: Latvian (lv)
Task: Question Answering, Conversational AI
Format: Multi-turn conversations with user-assistant exchanges
Total Conversations: ~118,000
Total Q&A Pairs: ~454,000
Avg Q&A per… See the full description on the dataset page: https://huggingface.co/datasets/martinsu/latvian-wikipedia-qa-gemma3.