Dataset fiksi bahasa Indonesia untuk riset NLP.
Proses: Hanya deduplikasi baris (remove duplicate).
Format: Skema bervariasi namun konsisten memiliki key title dan text (key tags bersifat opsional/tergantung baris).
Kualitas Teks: Karena pengumpulan massal, broken text (glitch HTML atau karakter aneh) mungkin masih ada yang lolos.
Hak Cipta: Hak cipta sepenuhnya milik penulis asli