Er wurde auf über 11.000 Beispielen von reinem, aufgearbeitetem Text trainiert. Es kam keine synthetische Datengenerierung, sondern ein pures Training auf von durch menschliche Prüfer:innen als lesbar bewerteten Texten in Leichter Sprache zum Einsatz.
Der Classifier wird kostenfrei
online angeboten, um bereits erste Proben mit ihm durchzuführen.
In späteren Iterationen des Projekts ist ein Training von Jacob 24b mittels RLHF und diesem Modell als "reward predictor" geplant.