Views
No views yet
1from transformers import AutoTokenizer, AutoModel
2from modeling import BiEncoderModelRegression
3
4# Load model components
5tokenizer = AutoTokenizer.from_pretrained("minoosh/bert-reg-biencoder-mse")
6base_model = AutoModel.from_pretrained("bert-base-uncased")
7model = BiEncoderModelRegression(base_model, loss_fn="mse")
8
9# Load weights
10state_dict = torch.load("pytorch_model.bin")
11model.load_state_dict(state_dict)
12
13# Prepare inputs
14texts1 = ["first text"]
15texts2 = ["second text"]
16inputs = tokenizer(
17 texts1, texts2,
18 padding=True,
19 truncation=True,
20 return_tensors="pt"
21)
22
23# Get similarity scores
24outputs = model(**inputs)
25similarity_scores = outputs["logits"]