Modelo multitask para Natural Language Inference (NLI) em português brasileiro, baseado no
NorBERTo.
Treinado no
ASSIN2 (Avaliação de Similaridade Semântica e Inferência Natural).
1from transformers import AutoTokenizer
2from huggingface_hub import hf_hub_download
3import onnxruntime as ort
4import numpy as np
5
6tokenizer = AutoTokenizer.from_pretrained(
7 "palaciodata/NorBERTo-base-NLI-Multitask"
8)
9
10model_path = hf_hub_download(
11 repo_id="palaciodata/NorBERTo-base-NLI-Multitask",
12 filename="model.onnx"
13)
14
15session = ort.InferenceSession(model_path)
16
17premissa = "Uma criança risonha está segurando uma pistola de água e sendo espirrada com água"
18hipotese = "Uma criança está segurando uma pistola de água"
19
20inputs = tokenizer(
21 premissa,
22 hipotese,
23 return_tensors="np",
24 max_length=256,
25 truncation=True,
26 padding="max_length"
27)
28
29logits, similarity = session.run(
30 None,
31 {
32 "input_ids": inputs["input_ids"].astype(np.int64),
33 "attention_mask": inputs["attention_mask"].astype(np.int64),
34 }
35)
36
37classe = np.argmax(logits, axis=1)[0]
38
39print(
40 f"Classe: {classe}, Similaridade: {float(similarity[0]):.3f}"
41)