Views
No views yet
Trainer on a labeled toxic comment dataset.1from transformers import AutoTokenizer, AutoModelForSequenceClassification, pipeline
2
3model_id = "Youssef-El-SaYed/toxic-comment-classifier"
4
5# Define mapping
6id2label = {0: "Non-Toxic", 1: "Toxic"}
7label2id = {"Non-Toxic": 0, "Toxic": 1}
8
9tokenizer = AutoTokenizer.from_pretrained(model_id)
10model = AutoModelForSequenceClassification.from_pretrained(
11 model_id,
12 id2label=id2label,
13 label2id=label2id
14)
15
16nlp = pipeline("text-classification", model=model, tokenizer=tokenizer)
17
18print(nlp("You are so stupid and annoying!"))
19print(nlp("I really like your work, keep it up!"))
20
21