Views
No views yet
1from transformers import AutoTokenizer, AutoModelForSequenceClassification
2
3tokenizer = AutoTokenizer.from_pretrained("Kendamarron/fineweb-edu-classifier-ja")
4model = AutoModelForSequenceClassification.from_pretrained("Kendamarron/fineweb-edu-classifier-ja")
5
6def predict(text):
7 inputs = tokenizer(text, return_tensors="pt")
8 outputs = model(**inputs)
9 logits = outputs.logits
10 predicted_class = torch.argmax(logits, dim=-1).item()
11 return predicted_class
12
13text = "富士山は、日本で最も有名な山であり、日本全土にわたる広大な自然公園の一つです。高さは3,776メートルで、日本で最も高い山です。富士山は、東京都、静岡県、山梨県の3つの県にまたがっています。"
14print(predict(text))
15# >> 2