Views
No views yet
1ner = pipeline(
2 task="token-classification",
3 model="ivlcic/xlmr-ner-slavic-pline",
4 tokenizer="ivlcic/xlmr-ner-slavic-pline",
5 aggregation_strategy="simple",
6)
7text = " Janez Novak... Metka Kralj,,. in Boris A. Novak živijo v Ljubljani in delajo za Microsoft."
8tokens = re.findall(r"\s+|\w+|[^\w\s]", text, flags=re.UNICODE)
9result = ner(tokens, is_split_into_words=True, delimiter="")
10
11for r in result[0]:
12 print(f'[{text[r['start']:r['end']]}]({r["entity_group"]}@{r["start"]}:{r["end"]})')1[Janez Novak](PER@1.00|1:12)
2[Metka Kralj](PER@1.00|16:27)
3[Boris A. Novak](PER@1.00|34:48)
4[Ljubljani](LOC@1.00|58:67)
5[Microsoft](ORG@1.00|81:90)