Model ini merupakan hasil fine-tuning bert-base-uncased untuk klasifikasi teks biner:
TEKS_MANUSIA / label 0: teks yang ditulis manusia
TEKS_AI / label 1: teks yang dihasilkan AI
Kegunaan Model
Model digunakan pada aplikasi Detectra AI untuk memperkirakan apakah sebuah teks memiliki pola yang lebih dekat dengan tulisan manusia atau teks hasil generasi AI.
Dataset
Model dilatih menggunakan dataset AI vs Human Text berbahasa Inggris yang telah melalui proses:
penghapusan data kosong dan duplikat,
balancing kelas,
sampling seimbang,
pembagian data train, validation, dan test.
Batasan
Model dilatih menggunakan teks berbahasa Inggris. Prediksi terhadap teks berbahasa Indonesia belum dapat dianggap valid tanpa pelatihan atau evaluasi tambahan menggunakan dataset bahasa Indonesia.
Hasil prediksi model tidak dapat digunakan sebagai satu-satunya dasar untuk menentukan plagiarisme, pelanggaran akademik, atau keaslian suatu tulisan.