Views
No views yet
1from transformers import AutoTokenizer 2import onnxruntime as ort 3 4tokenizer = AutoTokenizer.from_pretrained("granite-onnx") 5session = ort.InferenceSession("granite-onnx/model_quantized.onnx")