Views
No views yet
| Task | Multi-Dataset | QA-only | NLI-only | Improvement |
|---|---|---|---|---|
| NorQuadRetrieval (ndcg@10) | 0.232 | 0.209 | 0.163 | +11.0% |
| SNLRetrieval (ndcg@10) | 0.818 | 0.765 | 0.519 | +6.9% |
1from sentence_transformers import SentenceTransformer
2
3model = SentenceTransformer("thivy/norbert4-base-scandinavian-embedding")
4
5# Encode sentences
6sentences = [
7 "Dette er en norsk setning",
8 "Detta är en svensk mening",
9 "Dette er en dansk sætning"
10]
11
12embeddings = model.encode(sentences)
13
14# Compute similarity
15from sentence_transformers.util import cos_sim
16similarity = cos_sim(embeddings[0], embeddings[1])1@misc{norbert4-scandi-embedding,
2 title={NorBERT4 Scandinavian Embedding Model},
3 author={Thivyesh Ahilathasan},
4 year={2025},
5 url={https://huggingface.co/thivy/norbert4-base-scandinavian-embedding}
6}