Views
No views yet
1import torch
2from transformers import AutoTokenizer
3from huggingface_hub import hf_hub_download
4from model_utils import MultiTaskXLMR
5
6# Load model
7model_path = hf_hub_download("{repo_id_multilingual}", "pytorch_model.bin")
8model = MultiTaskXLMR(model_name="xlm-roberta-large", num_intents=5)
9model.load_state_dict(torch.load(model_path))
10model.eval()
11
12# Inference in any supported language
13tokenizer = AutoTokenizer.from_pretrained("xlm-roberta-large")
14text = "Tu es un idiot!" # French
15inputs = tokenizer(text, return_tensors="pt", padding=True, truncation=True)
16
17with torch.no_grad():
18 tox_logits, _ = model(inputs['input_ids'], inputs['attention_mask'])
19 tox_prob = torch.sigmoid(tox_logits).item()
20 print(f"Toxicity: {tox_prob:.4f}")