Views
No views yet
bert-base-chinese1from transformers import AutoTokenizer, AutoModelForSequenceClassification
2tokenizer = AutoTokenizer.from_pretrained("ming030890/chinese-langid")
3model = AutoModelForSequenceClassification.from_pretrained("ming030890/chinese-langid")
4text = "係唔係廣東話?"
5inputs = tokenizer(text, return_tensors="pt")
6outputs = model(**inputs)
7# 0 for Cantonese, 1 for Traditional Chinese
8prediction = outputs.logits.argmax(-1).item()