Views
No views yet
1from transformers import AutoTokenizer, TFAutoModelForMaskedLM
2import tensorflow as tf
3
4# Tokenizer ve model yükleme
5tokenizer = AutoTokenizer.from_pretrained("msbayindir/legal-turkish-bert-base-cased")
6model = TFAutoModelForMaskedLM.from_pretrained("msbayindir/legal-turkish-bert-base-cased")
7
8# Örnek metin "Hukuk"
9text = "Anayasa, millet iradesinin hürriyetçi demokrasi ve [MASK] düzeni çerçevesinde kullanılacağını belirtiyor."
10
11# Tokenizer kullanarak metni işleme
12inputs = tokenizer(text, return_tensors="tf")
13
14# Maskeli tokenın indeksini bulma
15mask_token_index = tf.where(inputs["input_ids"] == tokenizer.mask_token_id)[0, 1]
16
17# Modeli çalıştırma ve logits değerlerini alma
18logits = model(**inputs).logits
19
20# Maskelenmiş token için tahmin edilen olasılıkları alma
21mask_token_logits = logits[0, mask_token_index, :]
22
23# En iyi 3 tahmini seçme
24top_3_tokens = tf.math.top_k(mask_token_logits, 3).indices.numpy()
25
26# Tahmin edilen kelimelerle metni değiştirme ve yazdırma
27for token in top_3_tokens:
28 print(text.replace(tokenizer.mask_token, tokenizer.decode([token])))
29
30## Output
31Anayasa, millet iradesinin hürriyetçi demokrasi ve hukuk düzeni çerçevesinde kullanılacağını belirtiyor.
32Anayasa, millet iradesinin hürriyetçi demokrasi ve kamu düzeni çerçevesinde kullanılacağını belirtiyor.
33Anayasa, millet iradesinin hürriyetçi demokrasi ve toplum düzeni çerçevesinde kullanılacağını belirtiyor.