Views
No views yet
1from transformers import AutoTokenizer, AutoModelForTokenClassification, pipeline
2
3# Load model
4model_name = "sravan1817/indicbertv2-ner-te-kn"
5
6tokenizer = AutoTokenizer.from_pretrained(model_name)
7model = AutoModelForTokenClassification.from_pretrained(model_name)
8
9# Build NER pipeline
10ner = pipeline(
11 "ner",
12 model=model,
13 tokenizer=tokenizer,
14 aggregation_strategy="average" # groups subwords into full words
15)
16
17# Example Telugu text
18text_te = "విరాట్ కోహ్లీ భారత క్రికెట్ జట్టు మాజీ కెప్టెన్."
19
20# Example Kannada text
21text_kn = "ಬೆಂಗಳೂರು ಕರ್ನಾಟಕದ ರಾಜಧಾನಿ ನಗರ."
22
23# Run predictions
24print("Telugu Prediction:")
25print(ner(text_te))
26
27print("\nKannada Prediction:")
28print(ner(text_kn))