NEJM Brain-to-Text Sonified (iSTFT)
Pre-shuffled dataset (seed: 42) at 16kHz, 0-8000Hz range.
Sharded into 1500 files per shard for efficient loading.
from datasets import load_dataset
ds = load_dataset("ljcamargo/nejm-brain-to-text-sonified-istft-2")