This dataset provides a sentence-level, feature-augmented corpus for diagnosing dyslexic writing patterns in Sinhala.Each instance consists of a dyslexic sentence, its corresponding clean reference sentence, a set of explicit character-level error features, and a dominant dyslexic writing pattern label.
Unlike correction-focused datasets, this corpus is designed for diagnostic classification, enabling models to… See the full description on the dataset page: https://huggingface.co/datasets/akura-official/akura-sinhala-dyslexic-writing-patterns.