Views
No views yet
1from transformers import AutoTokenizer 2 3tokenizer = AutoTokenizer.from_pretrained("metythorn/xlm-roberta-tokenizer-100k") 4 5# Example usage 6text = "ខ្ញុំចង់រៀនភាសាខ្មែរ" 7tokens = tokenizer.tokenize(text) 8print(tokens)