Views
No views yet
tohoku-nlp/bert-base-japanese| タイプ | 説明 |
|---|---|
| PERSON_NAME | 氏名 |
| ORGANIZATION_NAME | 組織名 |
| PHONE_NUMBER | 電話番号 |
| メールアドレス | |
| ADDRESS | 住所 |
| MY_NUMBER | マイナンバー |
| PASSPORT_NUMBER | パスポート番号 |
| DRIVER_LICENSE | 運転免許証番号 |
| INSURANCE_NUMBER | 保険証番号 |
| EMPLOYEE_ID | 社員番号 |
| STUDENT_ID | 学籍番号 |
| BANK_ACCOUNT | 銀行口座番号 |
| CREDIT_CARD | クレジットカード番号 |
| DATE_OF_BIRTH | 生年月日 |
| AGE | 年齢 |
| IP_ADDRESS | IPアドレス |
| URL | URL |
| USERNAME | ユーザー名 |
1import numpy as np
2import onnxruntime as ort
3from transformers import AutoTokenizer
4
5# セッション作成
6session = ort.InferenceSession("model.onnx")
7tokenizer = AutoTokenizer.from_pretrained(".")
8
9# 推論
10text = "田中太郎の電話番号は090-1234-5678です。"
11inputs = tokenizer(text, return_tensors="np", padding="max_length", max_length=512)
12logits = session.run(None, {
13 "input_ids": inputs["input_ids"],
14 "attention_mask": inputs["attention_mask"],
15})[0]
16
17predictions = np.argmax(logits, axis=-1)O, B-PERSON_NAME, I-PERSON_NAME, ...| 入力 | 形状 | 型 |
|---|---|---|
| input_ids | [batch_size, sequence_length] | int64 |
| attention_mask | [batch_size, sequence_length] | int64 |
| 出力 | 形状 | 型 |
|---|---|---|
| logits | [batch_size, sequence_length, 37] | float32 |