Views
No views yet
EMBEDDIA/est-roberta on a custom dataset for extracting quantifier constructions (e.g., "kari koeri", "hunnik raamatuid") in Estonian text.O: OutsideB-QUANT: Beginning of a quantifier expressionI-QUANT: Inside a quantifier expression1from transformers import AutoTokenizer, AutoModelForTokenClassification
2import torch
3
4model = AutoModelForTokenClassification.from_pretrained("ahtokiil/est-roberta-quant-extraction_EKI")
5tokenizer = AutoTokenizer.from_pretrained("ahtokiil/est-roberta-quant-extraction_EKI")
6
7sentence = "Arsti juures tuli tükk aega oodata."
8inputs = tokenizer(sentence, return_tensors="pt")
9outputs = model(**inputs)
10predictions = torch.argmax(outputs.logits, dim=2)
11
12tokens = tokenizer.convert_ids_to_tokens(inputs["input_ids"][0])
13labels = [model.config.id2label[p.item()] for p in predictions[0]]
14
15print(list(zip(tokens, labels)))