Vietnamese Semantic Embedding Triplets
A large-scale Vietnamese triplet dataset for training text embedding, semantic retrieval, reranking, and contrastive learning models.
Vietnamese Semantic Embedding Triplets is a general-domain Vietnamese dataset containing triplets in the form:
anchor: source sentence
positive: semantically equivalent or highly related sentence
negative: semantically unrelated sentence
The dataset is designed for: