Views
No views yet
BAAI/bge-m3.torch.nn.Linear;torch.qint8;bge_m3_quantized_state_dict.pt — квантованный state_dict;load_quantized_model.py — скрипт восстановления модели;quantization_config.json — параметры квантизации;requirements.txt — зависимости.from load_quantized_model import load_model
model = load_model()
embeddings = model.encode(
["Первый текст", "Второй текст"],
batch_size=4,
show_progress_bar=False,
normalize_embeddings=True,
convert_to_numpy=True,
device="cpu",
)
print(embeddings.shape)BAAI/bge-m3,
затем применяется динамическая INT8-квантизация и загружается state_dict.