Данный датасет представляет результат статистического анализа текста книги "Harry Potter and the Philosopher's Stone", выполненного с использованием различных методов обработки естественного языка. В процессе анализа были проведены три ключевых типа анализа:
Анализ уникальности данных: Оценка доли уникальных слов в корпусе текста и вычисление коэффициента лексического разнообразия.
Анализ частоты POS-тегов: Изучение частоты… See the full description on the dataset page: https://huggingface.co/datasets/lamdary/task2_advanced.