این مدل یک نسخهی
BERT-Tiny است که از صفر بر اساس دیتاست
FineWiki آموزش داده شده است.
بخشی از دیتاست FineWiki شامل حدود
۱ میلیون صفحه فارسی ویکیپدیا (حدود ۲ گیگابایت متن) است و به عنوان یک مرجع عمومی برای پیشتمرین مدلهای زبانی فارسی طراحی شده است.
مدل پایهی استفادهشده
prajjwal1/bert-tiny است که یک نسخهی سبک و کوچک از BERT بوده و برای تحقیقات سریع و محیطهای با منابع محدود مناسب است.