Views
No views yet
This is not an official implementation of BGE-M3. Official implementation can be found in Flag Embedding project.
1from transformers import AutoModel, AutoTokenizer
2
3# Trust remote code is required to load the model
4tokenizer = AutoTokenizer.from_pretrained(model_path, trust_remote_code=True)
5model = AutoModel.from_pretrained(model_path, trust_remote_code=True)
6
7input_str = "Hello, world!"
8input_ids = tokenizer(input_str, return_tensors="pt", padding=True, truncation=True)
9
10output = model(**input_ids, return_dict=True)
11
12dense_output = output.dense_output # To align with Flag Embedding project, a normalization is required
13colbert_output = output.colbert_output # To align with Flag Embedding project, a normalization is required
14sparse_output = output.sparse_output