A large-scale synthetic Turkish logic-puzzle dataset designed for pretraining and
fine-tuning language models on structured reasoning tasks.
Property
Value
Language
Turkish (tr)
Format
Parquet (HuggingFace Datasets compatible)
Approximate tokens
~100 million
Number of examples
~720,000
Split
train only
License
CC BY 4.0
from datasets import load_dataset