Views
No views yet
1import torch
2from transformers import AutoTokenizer, AutoModelForMaskedLM
3
4
5model_id = "eliasjacob/ModernBERT-large-portuguese"
6tokenizer = AutoTokenizer.from_pretrained(model_id)
7model = AutoModelForMaskedLM.from_pretrained(model_id)
8
9device = torch.device("cpu")
10model.to(device)
11
12text = "O código penal brasileiro estabelece, em seu artigo [MASK], o crime de homicídio"
13inputs = tokenizer(text, return_tensors="pt")
14outputs = model(**inputs)
15
16# To get predictions for the mask:
17masked_index = inputs["input_ids"][0].tolist().index(tokenizer.mask_token_id)
18predicted_token_id = outputs.logits[0, masked_index].argmax(axis=-1)
19predicted_token = tokenizer.decode(predicted_token_id)
20print("Predicted token:", predicted_token)Predicted token: 121