Views
No views yet
paraphrase-MiniLM-L6-v2) on the STS Benchmark English dataset (stsb_multi_mt) to perform semantic similarity scoring between two text inputs.sentence-transformers/paraphrase-MiniLM-L6-v2stsb_multi_mt dataset (English split)similarity_model.ptpip install -q transformers datasets sentence-transformers evaluate --upgrade1
2from datasets import load_dataset
3
4dataset = load_dataset("stsb_multi_mt", name="en", split="train")
5dataset = dataset.shuffle(seed=42).select(range(10000)) # Sample subset for faster training