A large-scale bilingual (Turkish–English) collection of abstracts from Turkish academic theses (YÖK Ulusal Tez Merkezi).
This dataset focuses only on abstracts, provided in Turkish (abstract_tr) and English (abstract_en), suitable for summarization, translation, classification, and retrieval.
Records: ~650k abstracts (TR & EN)
Format: Parquet (.parquet) — fast & analytics-friendly
Language: 🇹🇷 Turkish + 🇬🇧 English (parallel abstracts… See the full description on the dataset page:
https://huggingface.co/datasets/umutertugrul/turkish-academic-theses-dataset.