Views
No views yet
ibm-granite/granite-embedding-english-r2.pip install -U transformers optimum[onnxruntime]1from transformers import AutoTokenizer
2from optimum.onnxruntime import ORTModelForFeatureExtraction
3
4repo_id = "yasserrmd/granite-embedding-r2-onnx"
5
6# Load tokenizer + ONNX model
7tokenizer = AutoTokenizer.from_pretrained(repo_id)
8model = ORTModelForFeatureExtraction.from_pretrained(repo_id)
9
10# Encode sentences
11inputs = tokenizer(["Hello world", "مرحباً"], padding=True, return_tensors="pt")
12outputs = model(**inputs)
13
14# Apply mean pooling over tokens
15embeddings = outputs.last_hidden_state.mean(dim=1)
16print(embeddings.shape) # (2, 768)optimum.onnxruntime.