Views
No views yet
vit5645e-6321005N/AN/AN/A0.00631from transformers import AutoTokenizer, AutoModelForTokenClassification
2import torch
3
4model_name = "vit5-hsd-span"
5tok = AutoTokenizer.from_pretrained(model_name)
6model = AutoModelForTokenClassification.from_pretrained(model_name)
7text = "Ví dụ câu tiếng Việt có nội dung thù ghét ..."
8enc = tok(text, return_tensors="pt", truncation=True, max_length=256, is_split_into_words=False)
9with torch.no_grad():
10 logits = model(**enc).logits
11 pred_ids = logits.argmax(-1)[0].tolist()
12# TODO: chuyển pred_ids -> spans theo scheme nhãn của bạn (BIO/BILOU/char-offset)