Generated embeddings dataset for vector database training and evaluation.
Dataset Summary
This dataset contains 100,000 text samples with vector embeddings (2048 dimensions)
generated from the BioASQ-BEIR dataset using Qwen/Qwen3-Embedding-8B.
Dataset Structure
Base dataset: 100,000 samples with embeddings
Embedding dimension: 2048