Views
No views yet
1import * as ort from 'onnxruntime-web';
2
3// Load model
4const session = await ort.InferenceSession.create('model.onnx');
5
6// Tokenize input (you'll need to implement tokenization in JS)
7const inputIds = tokenize("What is 25 + 17?"); // Returns Int64Array
8
9// Run inference
10const feeds = {
11 input_ids: new ort.Tensor('int64', inputIds, [1, inputIds.length]),
12 attention_mask: new ort.Tensor('int64', attentionMask, [1, attentionMask.length])
13};
14
15const results = await session.run(feeds);
16const logits = results.logits.data;1from optimum.onnxruntime import ORTModelForSequenceClassification
2from transformers import AutoTokenizer
3
4tokenizer = AutoTokenizer.from_pretrained("RunsOnBacon/distilbert-intent-classifier-onnx-int8")
5model = ORTModelForSequenceClassification.from_pretrained(
6 "RunsOnBacon/distilbert-intent-classifier-onnx-int8",
7 provider="CPUExecutionProvider"
8)
9
10inputs = tokenizer("What is 25 + 17?", return_tensors="pt")
11outputs = model(**inputs)
12predicted_class = outputs.logits.argmax(-1).item()