Ce modèle permet de classer les textes en fonction des objectifs de développement durable (ODD) des Nations Unies.
Ce modèle de classification de texte a été développé en fine-tuning le modèle pré-entraîné dbmdz/bert-base-french-europeana-cased.
Les données d'entraînement de ce modèle affiné proviennent de l'ensemble de données communautaires OSDG (OSDG-CD) accessible au public à l'adresse
https://zenodo.org/record/5550238#.ZBulfcJByF4.
Ce modèle a été réalisé dans le cadre d'une recherche universitaire à l'
Université Laval.
L'objectif était de créer un modèle de classification de texte SDG basé sur transformers en français.
Les principaux détails du modèle sont mis en évidence ci-dessous :
Utilisez le code ci-dessous pour commencer à utiliser le modèle.
1from transformers import AutoTokenizer, AutoModelForSequenceClassification
2tokenizer = AutoTokenizer.from_pretrained("ilovebots/Flaubert_large_SDG_French")
3model = AutoModelForSequenceClassification.from_pretrained("ilovebots/Flaubert_large_SDG_French")
La base disponible dans
https://zenodo.org/record/5550238#.ZBulfcJByF4 a été enrichie des objectifs de développement durable des Nations Unies et traduite en en français.