Volgens Gebru et al. (Datasheets for Datasets). Beschrijft de drie datasets die in v0.1 zijn gebruikt: synthetic training/val, handgeschreven evaluation, en jurisprudentie-extractie.
1. Motivatie
Waarom is deze dataset gemaakt?
Om een Nederlandse Awb-typering classifier te trainen en evalueren zonder afhankelijkheid van casuïstiek uit gemeenten (privacy-gevoelig, AVG-blokker voor v0.1). De combinatie van… See the full description on the dataset page: https://huggingface.co/datasets/NoaberAI/govmodel-awb-data-v0.1.