Bu veri seti, Türkçe cümle çiftleri arasındaki anlamsal benzerliği değerlendirmek amacıyla hazırlanmış 80 özgün örnekten oluşur.
sentence1: Birinci cümle
sentence2: İkinci cümle
score: İnsan değerlendirmesiyle belirlenen anlamsal benzerlik puanı
5: Aynı anlamı ifade eden cümleler
4: Büyük ölçüde aynı, küçük ayrıntı farkları bulunan cümleler
3:… See the full description on the dataset page:
https://huggingface.co/datasets/aliFurkan123/semantic_textual_similarity_dataset.