The Masrad dataset contains 19,405 examples with features related to semantic similarity, lexical similarity, entity recognition, phonetic matching, and part-of-speech tagging for Arabic text.
Features
Feature
Type
Description
semantic
float
Semantic similarity score
semantic_rank
float
Rank based on semantic similarity
semantic_diff
float
Difference from top semantic score