Views
No views yet
yhavinga/dutch-llama-tokenizer (SentencePiece, Dutch-optimized)1from transformers import AutoTokenizer, ModernBertForMaskedLM
2
3model = ModernBertForMaskedLM.from_pretrained("yhavinga/dmbert-1024h-22l-fineweb2-2000000")
4tokenizer = AutoTokenizer.from_pretrained("yhavinga/dmbert-1024h-22l-fineweb2-2000000")
5
6# Masked language modeling
7inputs = tokenizer("Amsterdam is de <mask> van Nederland.", return_tensors="pt")
8outputs = model(**inputs)1@model{dmbert_1024h_fineweb2,
2 title={Dutch ModernBERT 1024h-22L FineWeb2},
3 author={Yeb Havinga},
4 year={2025},
5 publisher={Hugging Face},
6 url={https://huggingface.co/yhavinga/dmbert-1024h-22l-fineweb2-2000000}
7}