A multilingual PII (Personally Identifiable Information) detector fine-tuned from
microsoft/mdeberta-v3-base
by
HikmaAI.
1from optimum.onnxruntime import ORTModelForTokenClassification
2from transformers import AutoTokenizer, pipeline
3
4model = ORTModelForTokenClassification.from_pretrained(
5 "HikmaAI/hikmaai-mdeberta-v3-base-pii-multilingual",
6 subfolder="onnx/fp16",
7)
8tokenizer = AutoTokenizer.from_pretrained(
9 "HikmaAI/hikmaai-mdeberta-v3-base-pii-multilingual",
10 subfolder="tokenizer",
11)
12
13ner = pipeline(
14 "token-classification",
15 model=model,
16 tokenizer=tokenizer,
17 aggregation_strategy="simple",
18)
19ner("My name is Jane Doe and my email is jane@example.com")
1@misc{hikmaai-pii-2026,
2 title={hikmaai-mdeberta-v3-base-pii-multilingual},
3 author={HikmaAI},
4 year={2026},
5 publisher={HuggingFace},
6 url={https://huggingface.co/HikmaAI/hikmaai-mdeberta-v3-base-pii-multilingual}
7}